小米全模態大模型MiMo-V2.6-Pro在Arena.ai Code Arena: WebDev測評中首次亮相即重返總榜前十,並在MIT許可證開源權重模型中排名前三;早期自動評估獲1628分,與Claude Fable5(High)持平,展現開源模型在網頁開發領域的競爭力。
Anthropic於9月23日發佈Claude5.5系列首款模型Opus5.5,官方稱多數任務表現與Fable5.1相當,典型任務成本較上代Opus5降低40%,輸出速度提升超30%,已上線Claude及亞馬遜雲、谷歌雲、微軟Azure。9項測試中7項領先Fable5.1、Opus5及GPT-6 Astra、GPT-5.6 Sol,三項編程測試均獲最高分。
9月22日,小米發佈新一代大模型MiMo-V2.6,推出Pro和Flash兩個原生全模態版本。Pro版在Artificial Analysis綜合智能指數上拿到46分,超越Kimi K3和Qwen3.8Max,成爲當前最強開源模型;但小米坦言,與Claude Fable5.1、GPT-6Astra等頂級閉源模型仍有差距。
Anthropic或跳過Opus5.2,被曝內測代號claude-wafer-eap的Opus5.5,最快本週二發佈;定價每百萬Token輸入4美元、輸出20美元,直指GPT-6,性能傳超Astra。另有Claude Fable5.2暗中籌備,IPO前動作密集。