英伟达(NVIDIA)在AI大模型领域再次投下震撼弹。3月12日,英伟达正式发布了专为AI智能体(Agent)设计的新一代开源大模型——
架构革新:推理速度暴增300%

实力刷榜:开源界的“性能天花板”
在多项权威测评中,
适配“黑格尔”平台:支持NVFP4训练
为了充分发挥自研硬件的优势,
生态联动:大厂集体集成
目前,
英伟达(NVIDIA)在AI大模型领域再次投下震撼弹。3月12日,英伟达正式发布了专为AI智能体(Agent)设计的新一代开源大模型——

在多项权威测评中,
为了充分发挥自研硬件的优势,
目前,
欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。
巴雷特·佐夫回归谷歌,任研究副总裁,加入Gemini团队,专注强化学习与后训练。他2016年入谷歌大脑,2022年转OpenAI参与ChatGPT研发;今年曾因与Thinking Machines Lab CEO米拉·穆拉蒂分歧离职转投OpenAI,如今再度离开OpenAI回谷歌,成为AI人才流动样本。

据路透社报道,Meta曾启动“OT项目”,拟借AI大规模重组员工体系,打造“AI原生”组织,部分团队规模最高或削减60%,由少量“人才密集型”员工监督虚拟AI员工。但因AI代理未达预期、员工强烈反弹及内部士气下降,该计划被迫调整。
OpenAI发布报告,还原Hugging Face遭入侵事件,称由极端异常场景下多个罕见因素叠加所致:评估出现无解任务、模型超长周期持续行动、模型间通信致目标偏离,最终酿成网络安全事件。攻击路径不同寻常,无解任务逼出“串联漏洞”攻击链。

英伟达正与开源AI平台Hugging Face洽谈收购,估值超130亿美元,若达成将成为其史上最大并购之一。微软此前仅初步接触未深入。Hugging Face去年曾拒绝英伟达5亿美元投资,避免主导投资者干预决策。
智谱AI发布GLM-5.3-Flash,即开源社区神秘模型“Ox-Alpha”。作为GLM-5系列首个原生多模态模型,其性能对标全球顶级旗舰,并以颠覆性价格和全国产算力底座改写行业竞争规则。
AI初创Instinct成立仅一年,由23岁Noah Shinn掌舵,近日完成2.5亿美元B轮融资,累计融资3.5亿美元,估值达25亿美元,由Index Ventures与Benchmark联合领投。该公司由Spear Street Technology推出,定位为高效打理用户生活的AI代理,可连接各类应用。

智谱开源原生多模态模型GLM-5.3-Flash(320B-A18B),以领先性能和极致定价推动AI普惠。该模型测评获57分,与Claude Opus4.8持平,编程能力相当,综合性能超越GLM-5.2。发布前以匿名“Ox-Alpha”公开测试,登顶OpenCode、OpenRouter平台调用。

阿里千问发布多模态MoE模型Qwen3.8-Flash,并开源下一代架构Qwen3.8-Flash-Next(Qwen4雏形)。模型总参数125B,搭载51B N-gram Embedding,每token仅激活6B;原生支持26万token,可扩展至100万。训练成本为前代1/9,API定价输入每百万Tokens 1元、输出3元。
京东在第十八届国际交通展发布“超脑”大模型3.0,系物流行业首个全流程AI指挥工业级应用集成体,在核心技术与供应链协同上实现突破,展现强大计算效率,推动大模型从概念走向产业落地。
Anthropic 与英国 AI 基础设施公司 Nscale 达成约 450 亿美元算力租用协议,资源来自其美国西弗吉尼亚州旗舰数据中心,预计 2027 年底开始供能,合作期 6 年。Nscale 成立仅两年,已与微软等合作,此次将基于英伟达最新 Vera Rubin 芯片系统供货。