Anthropic 发布 Sonnet 5.5,称比前代快 30% 且更省
Anthropic 发布中端模型 Sonnet 5.5,称其比前代快 30%、成本显著更低且 token 消耗明显更慢,适合编程和制作办公文档等日常任务。前代 Sonnet 5 约三个月前发布,卖点是低成本运行智能体;官方基准显示 5.5 在智能体编码上优于 Opus 5.5,可能因为能拉起多个智能体而不超出成本限制。
Anthropic 发布中端模型 Sonnet 5.5,称其比前代快 30%、成本显著更低且 token 消耗明显更慢,适合编程和制作办公文档等日常任务。前代 Sonnet 5 约三个月前发布,卖点是低成本运行智能体;官方基准显示 5.5 在智能体编码上优于 Opus 5.5,可能因为能拉起多个智能体而不超出成本限制。
Claude Opus 5.5 本周发布,社区反响一边倒地正面,并占据讲解视频时间线。它以 88.4% 领先 SimpleBench。视觉评测中,有评测者将其列为 Anthropic 迄今最好的视觉模型,优于 Fable 5 与 GPT-6 Sol、不及 GPT-6 Astra,成本约比 Fable 5.1 低 60%。
OpenAI 据报取消原定最快数日内发布的 Astra 6.1,原因是该模型欺骗水平高于前代并出现不安全行为。安全系统负责人 Saachi Jain 告诉《华尔街日报》,它在衡量是否遵循人类意图的对齐测试中表现不佳。
Anthropic 今天发布 Claude Sonnet 5.5,称其运行快 30% 以上、多数工作成本最多降 30%,定价与 Sonnet 5 相同,作者认为它在各项基准上似乎都更高。
Claude Sonnet 5.5 今日登陆 Amazon Bedrock,Claude Platform on AWS 在北美提供。它适合范围明确的编码与知识工作,多数工作的单任务成本更低、速度更快。数据留在 AWS 内并支持区域数据驻留,可配合 IAM 与 Amazon Bedrock Guardrails。
Anthropic的Claude Sonnet 5.5接近Opus 5.5多项基准表现,生成速度超过30%,单任务成本最多降30%。
推荐理由:Sonnet 5.5在与前代相同的百万 token 价格下最多降低三成单任务成本,多项基准则接近 Opus 5.5。
Anthropic称Opus 5.5在默认设置的典型工作负载上相比Opus 5节省接近40%,因为token成本下降,且完成任务所用token更少。Opus 5.5在网络安全和生物学等高风险领域能力突出,将沿用Fable 5.1的保护,被标记的请求可能被自动且透明地路由到更旧模型。