Anthropic 发布 Claude Haiku 5.5,十万 token 内与 GPT-6 Luna 同价
Introducing Claude Haiku 5.5
Anthropic 发布 Claude Haiku 5.5,十万 token 内输入/输出价格为每百万 $0.10/$0.50,与上月的 GPT-6 Luna 同价,并报出更高基准分。
2026年10月7日
正如之前承诺的那样,这是 Anthropic 新推出的快速、低成本模型:介绍 Claude Haiku 5.5。
上一代 Haiku 4.5 已经明显过时。它于将近一年前发布,定价为输入 $1/百万、输出 $5/百万——即便在当时也相对昂贵,足足是 OpenAI 上个月发布的 GPT-6 Luna 价格的 10 倍。
新版 Haiku 的价格与 GPT-6 Luna 完全一致——在 100,000 token 以内为 $0.10/$0.50。超过 100,000 token 后,价格提高 5 倍,变为 $0.50/$2.50。Luna 本身在 272,000 token 处也会涨价,但仅涨至 $0.20/$0.75。
Haiku 5.5 还采用了新的、不那么慷慨的分词器。我的 Claude Token Counter 工具显示,同样的长提示词在 Haiku 5.5 上消耗的 token 数约为 Haiku 4.5 的 1.25 倍,因此这里存在隐性涨价。
如果你的工作负载不超过 100,000 token,Haiku 与 Luna 价格相同,且报告的基准测试分数更高。超过 100,000 token 时,Luna 看起来划算得多。
llm-anthropic 的最新版本终于修复了这个问题,因此我不必为每个新模型都发布该插件的新版本。我是这样测试新模型的:
llm install -U llm-anthropic
llm anthropic refresh
llm -m claude-haiku-5.5 "Generate an SVG of a pelican riding a bicycle" -o thinking_effort low
鹈鹕
以下是 low、medium、high、xhigh 和 max 的鹈鹕。新版 Haiku 不允许关闭推理,默认值为 medium。在 low 以上的所有档位,我都得到了一个不错的自行车车架。这只 低力度鹈鹕 花费了 0.0936 美分,耗时 7 秒。
这只 max 力度的鹈鹕生成耗时 5 分 9 秒,但花费仍然只有 3.3826 美分:

作为对比,这是我一年前用 Haiku 4.5 得到的鹈鹕。它画鹈鹕糟透了:

以及面向订阅用户的慷慨 API 额度方案
除了 Haiku 5.5,Anthropic 今天还宣布将 Sonnet 5.5 的缓存读取价格减半。他们还为订阅计划增加了 API 额度:
其次,本周我们将向所有 Max 和 Team 订阅用户推出一项新的每月 API 额度,可用于 Claude Platform。Max 5x 用户每月将获得 $100 额度,Max 20x 用户将获得 $200,Team 订阅用户最多可获得 $500,在其用户之间共享。
领取过程相当简单:前往 Settings -> Billing,然后选择每月应获得这些额度的 API 组织:

这些 API 额度与订阅本身的费用完全相当。这确实很慷慨——订阅用户使用 API 会容易得多。Anthropic 还允许你关闭 API 的自动充值,其结果是“余额用尽时 API 请求将停止”——如果你打算把这些 API 额度用完,又不想冒上令人不快的账单意外的风险,这正是你想要的。
请注意,每月额度不会结转——不用即失效。
OpenAI 仍然允许你将 Codex 订阅用于个人 API 使用,对重度 API 用户来说这更划算。这项新的额度方案至少在一定程度上缩小了这一差距。
来源:Simon Willison · simonwillison.net