跳到正文
原文
Simon Willison·· 7 天前精选AI 评分81

Claude Opus 5.5 与 GPT-6 Sol、Luna 同日发布,OpenAI 价格降至 GPT-5.6 同档一半

Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price war

AI 导读

Anthropic 发布 Claude Opus 5.5,约一小时后 OpenAI 发布 GPT-6 Sol 与 GPT-6 Luna,售价均为对应 GPT-5.6 型号的一半。

推荐理由

把当天新旧模型单价并列之后,GPT-6 Luna 与 Sol 约为对应 GPT-5.6 的一半,Opus 5.5 将缓存读取价格下调六成并因此改变更长智能体对话的成本结构。

正文 · AI 翻译

22nd September 2026

昨天是 Grok 4.7(鹈鹕)和 MiMo v2.6 Flash/Pro(更多鹈鹕)。今天 Anthropic 发布了 Claude Opus 5.5,大约一小时后 OpenAI 发布了 GPT-6 Sol 和 GPT-6 Luna。要全面摸清这些新模型还需要一段时间,但以下是我目前的印象。

GPT-6 Sol 和 Luna 的价格是对应 GPT-5.6 型号的一半

GPT-5.6 Luna 本已是我最喜欢用来构建应用的模型,因为它将出色的性能与非常便宜结合在了一起。不知为何,GPT-6 Luna 的价格又是它的一半——而 GPT-6 Sol 相比 GPT-5.6 Sol 也有类似幅度的下降。

今天的定价格局如下:

模型 输入 缓存输入 输出
GPT-6 Luna $0.10/M $0.01/M $0.50/M
GPT-5.6 Luna $0.20/M $0.02/M $1.20/M
Grok 4.7 $2/M $0.50/M $6/M
GPT-6 Sol $2/M $0.20/M $10/M
GPT-5.6 Terra $2/M $0.20/M $12/M
Claude Opus 5.5 $4/M $0.20/M $20/M
GPT-5.6 Sol $4/M $0.40/M $20/M
Claude Fable 5.1 $10/M $0.25/M $50/M
GPT-6 Astra $10/M $1/M $50/M

请注意,GPT-5.6 计划在 November 涨价 25%,因此 GPT-6 的价格是这些模型促销定价的一半。

(由于 GPT-5.6 Terra 的定价与 GPT-6 Sol 相同,继续使用 Terra 的任何剩余理由都已不复存在。)

这种定价的竞争力再怎么强调也不为过。Grok 4.7 将自身定价为 $2/$6,不到 GPT-5.6 Sol 价格的一半,但现在输入价格与 GPT-6 Sol 相同,输出价格也更接近。

以 $0.10/$0.50 的价格,GPT-6 Luna 是 OpenAI 有史以来发布过的最便宜的模型之一,只有弱得多的 GPT-4.1 Nano($0.10/$0.40,April 2025)和 GPT-5 Nano($0.05/$0.40,August 2025)比它更便宜。

我渲染了 为 GPT-6 Luna 的鹈鹕 和 为 GPT-6 Sol 的,然后把它们与 GPT-5.6 的鹈鹕一起汇总到 这个对比网格 中。我喜欢你能立刻看出,5.6 系列选择了更大胆、更明亮的颜色,而 6 系列则柔和得多。我仍然认为 GPT-6 Astra 在 max 下生成了最好的鹈鹕。

A grid of pelicans for six GPT models at different thinking efforts.

Claude Opus 5.5 也降价了

Opus 5.5 看来解决了人们对其沟通风格最大的不满。Thariq Shihipar:

Opus 5.5 是你们反馈的结果。

它沟通清晰,按 token 计比 Opus 5.0 更便宜,具备 Fable 5.1 的智能,token 效率很高,并且适用于每一个 effort 级别。

它还应当 更擅长 Blender。我期待在这方面好好考验它。

Opus 4.5、4.6、4.7、4.8 和 5 的价格都一样:输入 $5/million tokens,输出 $25/million。5.5 降价 20%——$4/million 和 $20/million。

缓存读取的价格下降了 60%。这对更长的智能体对话意义重大,其中 90%+ 的输入 token 按缓存 token 价格处理。

Opus 5.5 的新价格与 GPT-5.6 Sol 的价格相同,但那是在 OpenAI 将 Sol 价格减半之前。

GPT-6 Astra 和 Claude Fable 5.1 的定价均为输入 $10/million、输出 $50/million。目前的价格战影响的是比这低一档的模型。

Anthropic 表示 Sonnet 5.5 和 Haiku 5.5 即将推出。考虑到目前 Haiku 4.5 为 $1/$5,而最新的 GPT-6 Luna 价格是其十分之一,为 $0.10/$0.50,Haiku 能否在低端重新获得价格竞争力,将会很有看头。

Claude Opus 5.5 max 过度思考到崩溃的地步

对我的“生成一只鹈鹕骑自行车的 SVG”测试来说,这是第一次 Claude Opus 5.5 在“max”思考级别下未能返回响应!

它一开始把这称为“一个经典的测试请求”,然后对自己正在做的事情想得非常、非常认真:

这是一个经典的测试请求,所以我想规划出一只构图精良的鹈鹕,带有其标志性的喙和喉囊,骑着一辆有合适车轮、车架和踏板的自行车,背景是简单的天空和地面。[...]

核实小腿长度大约为 95.2,足够接近。现在我正在推算近侧腿从髋部到膝盖再到脚踝的路径,然后勾画搁在踏板上的脚形——用由直线和曲线组成的路径勾勒脚跟、趾尖和脚底轮廓,使其自然贴合在大约 y=478-494 的踏板表面上。[...]

我喜欢鱼从篮子里醒目地探出来、鹈鹕盯着它看这一有趣细节,值得保留。我还在确认眼睛位于喙基部附近是否符合典型的鹈鹕解剖结构,并考虑给它一个稍微更开心的表情。[...]

远侧的腿正确地表现为从车架后方经过,所以我接着检查齿盘的齿并确认图层顺序——远侧曲柄臂应当大部分被座管和齿盘挡住。我正在确定最终 SVG 的 width 和 height 属性以及 viewBox,以确保正确缩放,并注意到没有文本,因此不需要 font-family。[...]

我当时特别兴奋地想看到这只鹈鹕……但随后它停了。Opus 5.5 的最大输出 token 上限为 128,000(其他 Claude 模型也是如此),而它在仍在对 SVG 进行推理时就达到了这个上限!

我又试了第二次,得到了同样的结果。这让我怀疑“max”实际上毫无用处——如果它会在一个愚蠢的 SVG 提示上过度思考到崩溃,我就不相信它在更有意思的工作上不会同样如此。

(那两次失败每次都花了我 $2.56,并耗时将近 20 分钟。)

Fable 5.1 在“max”下没有过度思考,并且确实从所有 Anthropic 模型中给了我我见过的最好的鹈鹕。

这里是Opus 5.5 的鹈鹕,不包括 5.5 max。

我还制作了这个对比网格,将它们与 Opus 5、Fable 5.1 和 Sonnet 5 所画的鹈鹕进行比较:

A grid of pelicans for four Claude models at different thinking efforts.

如今按画一只骑自行车的鹈鹕画得如何来比较不同模型厂商,可能没什么意义(如果曾经有过的话),但我仍然觉得,用它们来比较同一模型系列在不同推理级别下的表现是有价值的。

我现在在 Codex 和 Claude Code 中把 GPT-6 Sol 和 Claude Opus 5.5 用作默认模型。我已将 agent.datasette.io 上的 Datasette Agent 演示升级为使用 GPT-6 Luna,它在 SQL 查询以及为 Datasette Apps 构建 HTML 和 JavaScript 方面似乎既快又胜任。

来源:Simon Willison · simonwillison.net