SuperCLUE发布手机端侧大模型测评,vivo蓝心BlueLM3.5 Nano 3B以89.86分居综合第一。该3B小模型得分逼近谷歌Gemini3.6 Flash、豆包Seed2.1 Pro、千问Qwen3.8 Max等云端大模型,展现端侧性能突破。
CLUE发布的SuperCLUE-Terminal中文智能体编程测评榜显示,DeepSeek-V4-Pro-0813以51.52分位列第二,仅次于Kimi K3,且调用成本极低,性价比突出。该榜面向国内开发者,采用本土真实编程任务,统一以Claude Code运行,公平对比各模型。
SuperCLUE公布腾讯Hy3语言模型编程专项测评,与DeepSeek-V4-Pro等对比。Hy3为MoE架构,总参数295B、激活仅21B,支持256K上下文,号称混元最强。结果参数远小却表现意外出色,从四大维度评估兼顾性能与花销,测评针对国内程序员日常写代码的真实场景。
OpenAI的GPT Image2在SuperCLUE最新评测中超越谷歌Nano Banana2,成为全球文生图模型冠军。该模型自4月21日上线后,在画质、理解力和细节还原度上显著提升,刷新行业标准。评测覆盖多个核心维度,尤其解决了海外模型长期存在的汉语文本生成难题,展现了全面优势。
领先的AI评测基准,衡量和比较AI模型性能。
Tencent
$0.8
输入tokens/百万
$2
输出tokens/百万
30
上下文长度
01-ai
-
32
Chatglm
$100
128