SuperCLUE發佈手機端側大模型測評,vivo藍心BlueLM3.5 Nano 3B以89.86分居綜合第一。該3B小模型得分逼近谷歌Gemini3.6 Flash、豆包Seed2.1 Pro、千問Qwen3.8 Max等雲端大模型,展現端側性能突破。
CLUE發佈的SuperCLUE-Terminal中文智能體編程測評榜顯示,DeepSeek-V4-Pro-0813以51.52分位列第二,僅次於Kimi K3,且調用成本極低,性價比突出。該榜面向國內開發者,採用本土真實編程任務,統一以Claude Code運行,公平對比各模型。
SuperCLUE公佈騰訊Hy3語言模型編程專項測評,與DeepSeek-V4-Pro等對比。Hy3爲MoE架構,總參數295B、激活僅21B,支持256K上下文,號稱混元最強。結果參數遠小卻表現意外出色,從四大維度評估兼顧性能與花銷,測評針對國內程序員日常寫代碼的真實場景。
OpenAI的GPT Image2在SuperCLUE最新評測中超越谷歌Nano Banana2,成爲全球文生圖模型冠軍。該模型自4月21日上線後,在畫質、理解力和細節還原度上顯著提升,刷新行業標準。評測覆蓋多個核心維度,尤其解決了海外模型長期存在的漢語文本生成難題,展現了全面優勢。
領先的AI評測基準,衡量和比較AI模型性能。
Tencent
$0.8
輸入tokens/百萬
$2
輸出tokens/百萬
30
上下文長度
01-ai
-
32
Chatglm
$100
128