寒武纪今日宣布,已基于 vLLM 推理框架完成对深度求索(DeepSeek)最新开源模型
针对
硬件层面,寒武纪深度挖掘了 MLU 的访存与排序加速特性,有效应对
行业分析指出,DeepSeek-V4凭借百万字(1M)超长上下文及顶尖的逻辑推理性能,对底层算力架构提出了严苛要求。寒武纪在模型发布首日的敏捷适配,不仅展示了国产算力平台对超大规模、复杂结构模型的承载能力,也预示着国产 AI 产业链在软硬协同层面已进入成熟期,为大模型应用普惠提供了高效的算力底座支持。
寒武纪今日宣布,已基于 vLLM 推理框架完成对深度求索(DeepSeek)最新开源模型
针对
硬件层面,寒武纪深度挖掘了 MLU 的访存与排序加速特性,有效应对
行业分析指出,DeepSeek-V4凭借百万字(1M)超长上下文及顶尖的逻辑推理性能,对底层算力架构提出了严苛要求。寒武纪在模型发布首日的敏捷适配,不仅展示了国产算力平台对超大规模、复杂结构模型的承载能力,也预示着国产 AI 产业链在软硬协同层面已进入成熟期,为大模型应用普惠提供了高效的算力底座支持。
欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。
姚顺雨称大模型并无秘密,腾讯混元4(Hy4preview)近期表现印证此言。面对智谱、月之暗面、DeepSeek、千问等竞争,腾讯四个月内完成混元大语言与多模态部门重组,推出770B参数、支持百万上下文的模型,显示所谓技术壁垒并非不可逾越。
DeepSeek开源V4系列首个实验性多模态模型V4-Flash-Vision-Exp。该模型基于V4-Flash架构融合视觉模块,在原有文本能力上新增深度图像理解与分析能力,总参数量达3050亿,视觉与文本架构有机结合,可精准解读图像并实现多模态融合。

欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。新鲜AI产品点击了解:https://app.aibase.com/zh1、不到四百美元还能自己动手训练!8、一个创意,一支AI团队:千问创作AgentTeams上线,编剧导演美术全承包千问创作上线AgentTeams功能,通过多智能体协作模式,实现从创意到成片的全流程自动化制作,显著降低专业内容生产的门槛。
腾讯发布混元Hy4预览版,早于摩根士丹利预期的9月,兑现年内亮相承诺。自2025年Q4姚顺雨加入后,腾讯模型更新提速:4月Hy3预览版、7月正式版,如今Hy4预览提前登场,市场预计原定Q4的Hy4正式版大概率提前落地。
科大讯飞9月1日将开源星火X2.5-4B和1.7B两款端侧通用大模型,原生支持1M token长上下文,重点提升智能体交互、数学计算与通用理解能力,面向车载、智能硬件及万物互联等端侧场景。9月7日还将发布更大规模模型。
中国信通院报告显示,上海原点星辉(StartLux)研发的本地大模型StartLux-V1.0-27B-Preview在可信AI大模型MCP专项测试中表现突出,以27B参数量获综合性能第二,超越DeepSeek-V4-Flash,进入DeepSeek-V4-Pro万亿参数模型能力区间。测试覆盖位置导航、网页等场景。
腾讯混元8月31日声明,旗舰模型Hy4preview自8月28日接入WorkBuddy后,因Agent能力升级引发体验热潮,首日高并发致任务排队。腾讯已紧急扩容推理集群并动态调配资源保障响应,反映大模型加速向复杂Agent应用落地。

欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。新鲜AI产品点击了解:https://app.aibase.com/zh1、腾讯混元发布开源旗舰模型Hy4preview,总参数770B、上下文1M腾讯混元发布开源旗舰模型Hy4preview,总参数770B、上下文1M,定位真实生产力场景。该技术在生物医药、量子计算和先进制造等领域展现出强大的提速能力。

8月28日,腾讯WorkBuddy首发接入混元开源旗舰大模型Hy4preview,国内外版同步上线。Hy4preview限时免费两周,Hy3免费期延至9月30日。该模型总参数770B、激活49B,上下文1M,面向代码、办公、科学等生产力场景,已开源至HuggingFace等平台。

腾讯发布混元 Hy4 preview 开源模型,总参数770B、激活参数49B,上下文长度1M。官方称预训练与后训练同步进步,智能水平跃升,居开源第一梯队。模型已在 HuggingFace、GitHub、ModelScope、Gitcode 上线,并接入腾讯云 TokenHub 与 OpenRouter。生产力场景盲测力压 GLM-5.3 与 Kimi K3。