AIHub

Claude Haiku 5.5 今天发布:价格只有 4.5 代的 1/10,但 10 万 Token 处有一座成本悬崖——接入实战与省账清单

进阶约 11 分钟读完2026-10-08#Claude#Anthropic#Claude Haiku 5.5#AI 编程#Agent#API
Claude Haiku 5.5 今天发布:价格只有 4.5 代的 1/10,但 10 万 Token 处有一座成本悬崖——接入实战与省账清单

10 月 7 日(北京时间 10 月 8 日凌晨),Anthropic 正式发布 Claude Haiku 5.5。如果你翻过这个系列前几代的定价页,第一眼大概率会怀疑自己看错了:这比 Haiku 4.5 便宜了将近一个数量级。

官方给它的定位也很清楚——不是聊天机器人,而是编程场景的子智能体:在 Agent 工作流里负责那些「量大、重复、单步不难」的活,比如批量改样式、跑测试修小错、给代码库做初筛分类。Claude Code、Agent SDK 和 API 三端同时可用,AWS、GCP、Azure 三条云渠道同步上线。

一、发布事实速览:两代 Haiku 放在一起看

项目 Claude Haiku 4.5 Claude Haiku 5.5
输入定价(≤10 万 Token 档) $1.00 / 百万 $0.10 / 百万
输出定价(≤10 万 Token 档) $5.00 / 百万 $0.50 / 百万
超长输入档位 无分档 >10 万输入 Token:$0.50 / $2.50,跳 5 倍
上下文窗口 200K 1M
定位 通用轻量模型 编程子智能体(成本敏感的 Agent 任务)
状态 退役窗口 10 月 15 日开启 全平台上线

配套还有两条别忽略的消息:Sonnet 5.5 的缓存读取价下调 50% 到 $0.10/百万 Token(缓存写入价不变);所有 Max 和 Team 级用户新增月度 API 使用额度。一手把最便宜的模型打到 1 毛钱,一手把缓存这条「老用户通道」也降价,Anthropic 这轮明显是在抢 Agent 流水线的批量调用场景。

二、先算成本悬崖:10 万输入 Token 是两道世界

Haiku 5.5 的定价是按单次请求的输入大小分档的,阈值定在 100,000 输入 Token:

  • 门槛以内:$0.10 / $0.50(每百万输入 / 输出 Token)——这是宣传里的价格;
  • 门槛以外:$0.50 / $2.50——输入价直接翻 5 倍。

这意味着上下文窗口扩到 1M 是有代价的。如果你把一个 80 万 Token 的代码库整体塞进一次请求,哪怕模型本身处理得了,你也会按 $0.50 的输入价付费,是「切碎喂」场景的 5 倍。

做个具体测算:一次 Agent 子任务,输入 90K Token(含系统提示和历史)、输出 8K Token,成本约 0.09 × $0.10 + 0.008 × $0.50 ≈ $0.013;同样任务输入变成 110K Token,成本约 0.11 × $0.50 + 0.008 × $2.50 ≈ $0.075,贵了将近 6 倍,而任务本身什么都没变。

工程结论:把 Haiku 5.5 的单次输入压在 10 万 Token 以内,是这个模型性价比的生命线。 超了不是不能用,而是该认真考虑拆任务、做检索,或者干脆上 Sonnet 5.5 走缓存价。

三、接入实战:最小调用与工具路由

API 侧和 Claude 其他模型完全同构,只是 model 名换成 claude-haiku-5-5。一个带用量统计的最小调用:

curl https://api.anthropic.com/v1/messages   -H "x-api-key: $ANTHROPIC_API_KEY"   -H "anthropic-version: 2023-06-01"   -H "content-type: application/json"   -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 4096,
    "system": "你是代码审查子智能体。只输出 JSON:{file, issues[], severity}。",
    "messages": [{"role": "user", "content": "审查以下 diff:
..."}]
  }'

如果你已经在 Claude Code 里跑多 Agent 工作流,可以把机械性子任务的模型路由切到 Haiku 5.5,例如:

export CLAUDE_CODE_SMALL_FAST_MODEL=claude-haiku-5-5

配合这次 Max / Team 新增的月度 API 额度,日常流水线上「起任务、读文件、跑命令、写总结」这些高频低难度调用,账单会明显变薄。

四、任务路由清单:什么给 Haiku 5.5,什么别给

适合交给 Haiku 5.5 建议留在 Sonnet / Opus
批量重命名、格式统一、注释补全 跨多文件的架构级重构
单测补写、lint 修复、简单 bug 定位 含糊需求的产品代码从零设计
日志/报错分类、代码初筛打标签 长链路推理的安全关键改动
任何单次输入 <10 万 Token 的高频子任务 必须一次吞下大代码库的审计

一句话原则:单步确定性高、可以独立验收、输入可控的任务下沉给 Haiku 5.5;需要多步规划、模糊判断或超大上下文的留给大哥。验收标准越明确,便宜模型的翻车成本越低。

五、注意事项与常见问题

  • Haiku 4.5 的退役窗口 10 月 15 日开启:还在用它跑定时任务的话,这周就把 model 名换成 5.5,顺手还能降本。
  • 10 万 Token 分档看的是每次请求,不是累计——一个 Agent 循环十轮、每轮 9 万 Token,依然全部按低价档计。
  • 缓存写入价没有跟着降:只有缓存读取便宜了($0.10/百万),高频复用系统提示的场景记得开 prompt caching,收益立刻翻倍。
  • 1M 上下文是能力不是默认:别把「能塞 1M」当成「该塞 1M」,越过 10 万门槛后每百万输入 $0.50,很多场景检索切片更划算。
  • 第三方平台(Bedrock / Vertex 等)的价目和生效时间可能滞后于官方,上线前以对应控制台为准。

小结

Haiku 5.5 是 Anthropic 把「Agent 流水线上的体力活」单独定价的一次尝试:1/10 的标价、1M 的窗口、明确的分档悬崖。用它只需要记住三件事——单次输入压过 10 万 Token 就亏,机械子任务大胆下沉,缓存和额度新政别浪费。如果这套打法在你的项目里跑顺了,Agent 的日常账单还有继续下探的空间。

相关教程

Claude Haiku 5.5 今天发布:价格只有 4.5 代的 1/10,但 10 万 Token 处有一座成本悬崖——接入实战与省账清单 | AIHub