Claude Haiku 5.5 logo

Claude Haiku 5.5

打开

Anthropic 面向高吞吐、低成本任务的快速 Claude 模型,适合摘要、分类、浏览器使用与编码子智能体。

分享:
查看替代方案

Claude Haiku 5.5

Claude Haiku 5.5 是 Anthropic 于 2026 年 10 月 7 日发布的当前小型 Claude 模型。它面向高吞吐、成本敏感的任务,例如分类、摘要、上下文压缩、数据库查询、浏览器使用,以及范围明确的编码子智能体;API 模型 ID 为 claude-haiku-5-5。

核心能力

  • 低成本高吞吐:提示词不超过 100K token 时,输入为每百万 $0.10、输出为 $0.50;超过 100K 时分别为 $0.50 和 $2.50。
  • 提示词缓存计费:不超过 / 超过 100K token 的缓存读取为每百万 $0.01 / $0.05,缓存写入为 $0.125 / $0.625。
  • 可调 effort:Anthropic 表示这是首个带可调 effort 设置的 Haiku 级模型,团队可以在成本与智能间取舍。
  • 多平台可用:官方列出 Claude Platform、AWS、Google Cloud 与 Microsoft Azure 均可使用。

适用场景与工作流

当工作流包含大量短小且相互独立的调用时,Haiku 5.5 很合适,例如分流客服消息、抽取结构化字段、请求路由、生成简短摘要,或为更大模型承担检索与工具调用。一个实用搭配是让 Claude Sonnet 5.5 负责规划和审阅,让 Haiku 执行压缩、检索或重复性步骤。

建议先用一小批有代表性的真实样本试跑,记录提示词长度、缓存命中率、输出质量与延迟;再选择能通过验收测试的最低 effort。不要用厂商基准替代自己业务数据上的评测。

定价

Anthropic 的发布表以 100K 提示词 token 为分界:不超过时适用低价,超过时适用高价。价格会变化,上线预算前应复核官方发布页与当前 API 文档。

每百万 token 不超过 100K 提示词 超过 100K 提示词
输入 $0.10 $0.50
输出 $0.50 $2.50
缓存读取 $0.01 $0.05
缓存写入 $0.125 $0.625

局限与替代方案

Haiku 5.5 不是 Anthropic 对最困难、长程智能体编码任务的首选;公告仍将 Sonnet 5.5 与 Claude Opus 5.5定位为更复杂工作的选择。它的安全措施也仍会阻止渗透测试等高风险网络安全技术。接入生产系统前,应评估模型行为、工具权限与成本上限。

  • Claude Sonnet 5.5:更适合需要持续智能体编码能力的任务。
  • Claude Opus 5.5:适合最具挑战性的 Claude 推理与编码工作。
  • GPT-6 Luna:可与 Haiku 并行评估的低成本 OpenAI 选项。

常见问题

Haiku 4.5 还是当前快速 Claude 吗?

不是。Haiku 5.5 已作为 Anthropic 新发布的小型模型;Claude Haiku 4.5仅适合做历史比较。

如何开始?

先阅读 Anthropic 的发布说明,用 claude-haiku-5-5 跑可量化的小规模试验,确认输出质量与成本后再推广。

评论

还没有评论。成为第一个评论的人!