小米全模态大模型MiMo-V2.6-Pro在Arena.ai Code Arena: WebDev测评中首次亮相即重返总榜前十,并在MIT许可证开源权重模型中排名前三;早期自动评估获1628分,与Claude Fable5(High)持平,展现开源模型在网页开发领域的竞争力。
Anthropic于9月23日发布Claude5.5系列首款模型Opus5.5,官方称多数任务表现与Fable5.1相当,典型任务成本较上代Opus5降低40%,输出速度提升超30%,已上线Claude及亚马逊云、谷歌云、微软Azure。9项测试中7项领先Fable5.1、Opus5及GPT-6 Astra、GPT-5.6 Sol,三项编程测试均获最高分。
9月22日,小米发布新一代大模型MiMo-V2.6,推出Pro和Flash两个原生全模态版本。Pro版在Artificial Analysis综合智能指数上拿到46分,超越Kimi K3和Qwen3.8Max,成为当前最强开源模型;但小米坦言,与Claude Fable5.1、GPT-6Astra等顶级闭源模型仍有差距。
Anthropic或跳过Opus5.2,被曝内测代号claude-wafer-eap的Opus5.5,最快本周二发布;定价每百万Token输入4美元、输出20美元,直指GPT-6,性能传超Astra。另有Claude Fable5.2暗中筹备,IPO前动作密集。