Anthropic 抢在 OpenAI 年度开发者大会前发布 Claude Sonnet5.5,定位日常工作全能助手。它打破速度、成本、质量“不可能三角”:较 Sonnet5 提速30%,单任务成本最高降30%,定价仅 Opus5.5 一半,性能几乎追平,并在 Terminal-Bench4.0 等多项测试中反超自家高端型号;文章还以游戏为例说明其“脑子够用”。
9月29日,Anthropic发布中端定位新模型Claude Sonnet5.5,却在多项基准测试中逼近甚至超越旗舰Opus5.5,引发关注。其最大亮点是编程能力显著提升,在代码生成与理解测试中反超更昂贵的Opus5.5,成为Anthropic当前代码能力最强的模型。同时,该模型在知识问答、跨领域推理等方面也有相关表现。
Anthropic在Claude Code v2.1.280中正式将Claude Opus5.5设为默认Opus模型,坐实此前的“跳级突袭”传闻。新旗舰支持100万Token上下文,定价为每百万Token输入4美元、输出20美元、缓存读取0.20美元,与此前泄露的内测价单完全一致。
Anthropic于9月23日发布Claude5.5系列首款模型Opus5.5,官方称多数任务表现与Fable5.1相当,典型任务成本较上代Opus5降低40%,输出速度提升超30%,已上线Claude及亚马逊云、谷歌云、微软Azure。9项测试中7项领先Fable5.1、Opus5及GPT-6 Astra、GPT-5.6 Sol,三项编程测试均获最高分。