Claude Haiku 5.5 发布:低价高速模型与订阅 API 额度
Anthropic 发布了新的快速、低成本模型 Claude Haiku 5.5。与上一代 Haiku 4.5 相比,新模型在定价、推理能力和订阅 API 额度方面都有明显变化。
定价:100K token 内更有竞争力
上一代 Claude Haiku 4.5 发布于约一年前,当时价格为:
- 输入:1 美元 / 百万 token
- 输出:5 美元 / 百万 token
这个价格即使在当时也不算便宜,并且是 OpenAI 上月发布的 GPT-6 Luna 的 10 倍。
Claude Haiku 5.5 在 100,000 token 以内 的价格与 GPT-6 Luna 完全一致:
- 输入:0.10 美元 / 百万 token
- 输出:0.50 美元 / 百万 token
但超过 100,000 token 后,Haiku 5.5 的价格会上涨 5 倍:
- 输入:0.50 美元 / 百万 token
- 输出:2.50 美元 / 百万 token
相比之下,GPT-6 Luna 的涨价阈值在 272,000 token,涨价后为:
- 输入:0.20 美元 / 百万 token
- 输出:0.75 美元 / 百万 token
因此,如果工作负载能控制在 100,000 token 以内,Haiku 5.5 的价格与 Luna 相同,并且官方基准分数更高;但如果经常超过 100,000 token,Luna 的成本看起来更有优势。
Tokenizer 变化带来“隐性涨价”
Haiku 5.5 使用了新的 tokenizer,但它并不如上一代“慷慨”。同一段较长提示词,在 Haiku 5.5 中消耗的 token 数大约是 Haiku 4.5 的 1.25 倍。
这意味着即使标价下降,实际使用成本也需要结合 tokenizer 变化重新估算。对于长上下文应用,这一点尤其值得关注。
推理模式:无法关闭,默认 medium
在测试中,Haiku 5.5 不允许关闭 reasoning,并且默认推理强度为 medium。
测试命令示例:
llm install -U llm-anthropic
llm anthropic refresh
llm -m claude-haiku-5.5 "Generate an SVG of a pelican riding a bicycle" -o thinking_effort low
使用“鹈鹕骑自行车”的 SVG 生成任务进行测试时,不同推理强度包括:
- low
- medium
- high
- xhigh
- max
测试结果显示,除 low 之外,其他推理强度都生成了较好的自行车车架。
其中:
low推理强度耗时 7 秒,成本约 0.0936 美分max推理强度耗时 5 分 9 秒,成本约 3.3826 美分
与一年前的 Haiku 4.5 相比,Haiku 5.5 在该绘图任务上的表现有明显提升。
Sonnet 5.5 缓存读取价格下调
除了 Haiku 5.5,Anthropic 还宣布将 Sonnet 5.5 的缓存读取价格减半。
这对大量使用上下文缓存的应用有直接影响,尤其是长提示词、多轮对话、代码分析等场景。
Max 和 Team 订阅加入每月 API 额度
Anthropic 还为订阅计划加入了新的每月 API credit:
- Max 5x 用户:每月 100 美元 API 额度
- Max 20x 用户:每月 200 美元 API 额度
- Team 用户:最高每月 500 美元 API 额度,由团队成员共享
这些 API 额度与订阅费用金额相匹配。用户可以在设置的 Billing 页面中绑定 API organization,以便每月领取额度。
Anthropic 也允许用户关闭 API 自动充值。关闭后,当余额耗尽时,API 请求会停止。这对于只想用完订阅附带额度、避免意外账单的用户比较有用。
需要注意的是,这些每月 API 额度 不会滚存,当月不用就会失效。
与 OpenAI 订阅的差异
OpenAI 仍允许用户将 Codex 订阅用于个人 API 使用。对于重度 API 用户来说,这种模式可能仍然更划算。
Anthropic 新增的 API 额度机制在一定程度上缩小了这一差距,也让 Claude 订阅用户更容易开始使用 API。
