Claude Haiku 5.5
Claude Haiku 5.5 是 Anthropic 于 2026 年 10 月 7 日发布的当前小型 Claude 模型。它面向高吞吐、成本敏感的任务,例如分类、摘要、上下文压缩、数据库查询、浏览器使用,以及范围明确的编码子智能体;API 模型 ID 为 claude-haiku-5-5。
核心能力
- 低成本高吞吐:提示词不超过 100K token 时,输入为每百万 $0.10、输出为 $0.50;超过 100K 时分别为 $0.50 和 $2.50。
- 提示词缓存计费:不超过 / 超过 100K token 的缓存读取为每百万 $0.01 / $0.05,缓存写入为 $0.125 / $0.625。
- 可调 effort:Anthropic 表示这是首个带可调 effort 设置的 Haiku 级模型,团队可以在成本与智能间取舍。
- 多平台可用:官方列出 Claude Platform、AWS、Google Cloud 与 Microsoft Azure 均可使用。
适用场景与工作流
当工作流包含大量短小且相互独立的调用时,Haiku 5.5 很合适,例如分流客服消息、抽取结构化字段、请求路由、生成简短摘要,或为更大模型承担检索与工具调用。一个实用搭配是让 Claude Sonnet 5.5 负责规划和审阅,让 Haiku 执行压缩、检索或重复性步骤。
建议先用一小批有代表性的真实样本试跑,记录提示词长度、缓存命中率、输出质量与延迟;再选择能通过验收测试的最低 effort。不要用厂商基准替代自己业务数据上的评测。
定价
Anthropic 的发布表以 100K 提示词 token 为分界:不超过时适用低价,超过时适用高价。价格会变化,上线预算前应复核官方发布页与当前 API 文档。
| 每百万 token | 不超过 100K 提示词 | 超过 100K 提示词 |
|---|---|---|
| 输入 | $0.10 | $0.50 |
| 输出 | $0.50 | $2.50 |
| 缓存读取 | $0.01 | $0.05 |
| 缓存写入 | $0.125 | $0.625 |
局限与替代方案
Haiku 5.5 不是 Anthropic 对最困难、长程智能体编码任务的首选;公告仍将 Sonnet 5.5 与 Claude Opus 5.5定位为更复杂工作的选择。它的安全措施也仍会阻止渗透测试等高风险网络安全技术。接入生产系统前,应评估模型行为、工具权限与成本上限。
- Claude Sonnet 5.5:更适合需要持续智能体编码能力的任务。
- Claude Opus 5.5:适合最具挑战性的 Claude 推理与编码工作。
- GPT-6 Luna:可与 Haiku 并行评估的低成本 OpenAI 选项。
常见问题
Haiku 4.5 还是当前快速 Claude 吗?
不是。Haiku 5.5 已作为 Anthropic 新发布的小型模型;Claude Haiku 4.5仅适合做历史比较。
如何开始?
先阅读 Anthropic 的发布说明,用 claude-haiku-5-5 跑可量化的小规模试验,确认输出质量与成本后再推广。
评论
还没有评论。成为第一个评论的人!
相关工具
相关洞察
GPT-6 Astra 没追上 Fable 5.1,追上的是账单
Artificial Analysis 智能指数上 Fable 5.1 66 分、Astra 61 分,Astra 没追上智力。但完成同一批任务的成本只要 Fable 5.1 的不到一半,真正收紧的是账单,不是脑子。

Anthropic Subagent:多智能体时代的架构革命
深入解析 Anthropic 的多智能体架构设计。了解如何通过 Subagent 突破上下文窗口限制,实现性能提升 90%,以及多智能体系统在 Claude Code 中的实际应用。
Claude Skills 完全指南 - 十大必备 Skills 详解
深入解析 Claude Skills 扩展机制,详细介绍十大核心技能及 Obsidian 集成,帮助你打造高效的 AI 工作流