阿里发布新一代大模型Qwen3.8-Max,在编程、办公、长程任务及多模态智能体等能力上全面升级,可端到端自主执行复杂任务,极少人工干预即可完成从目标理解到成果交付。模型权重下周开源,重点强化智能体在真实场景下的执行与交付能力。
字节跳动上线豆包Seed 2.1系列模型(含Pro/Turbo版)及Seed-Evolving,定位“面向Coding与Agent时代”,主攻复杂工程交付和规模化生产。新模型在编码工程交付、Agent长链路任务执行、多模态理解三大方向全面升级,具备更强的自主规划与动态修复能力。
字节跳动旗下AI助手豆包正式上线“任务模式”,从单一文本交互升级为具备复杂工作流处理能力的AI智能体。该模式支持多轮搜索、深度推理、浏览器自动操作及多模态内容生成,能主动将用户宏观目标拆解为子任务,并通过联网搜索等方式执行,显著提升自动化与任务处理效率。
今日,开源模型Step3.7Flash正式发布,以Apache2.0协议开放权重,直击Agent时代效率、可靠性与多模态执行等核心痛点。在多项基准测试中表现突出:ClawEval-1.1获67.1分排名第一,SimpleVQA Search得79.2分居首,SWE-PRO以56.3分位列第二,V* Python得分高达95.3,展现了在Agent任务、代码生成及视觉执行等领域的实战能力。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
-
Anthropic
$105
$525
200
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
Baidu
128
$6
$24
$2
$20
$8
$240
52