在开源大模型赛道,欧洲之光
当地时间3月16日,

核心参数: 总参数量为119B,激活参数仅为6B,在保证性能的同时极大优化了运行效率。
超长视野: 拥有 256k 的超长上下文窗口,能够轻松处理整本技术文档或大规模代码库。
灵活模式: 支持快速响应与深度推理两种模式,并以 Apache2.0协议 正式开源,诚意十足。
在性能表现上,
部署门槛与硬件建议:
为了发挥该模型的最大威力,
随着
在开源大模型赛道,欧洲之光
当地时间3月16日,

核心参数: 总参数量为119B,激活参数仅为6B,在保证性能的同时极大优化了运行效率。
超长视野: 拥有 256k 的超长上下文窗口,能够轻松处理整本技术文档或大规模代码库。
灵活模式: 支持快速响应与深度推理两种模式,并以 Apache2.0协议 正式开源,诚意十足。
在性能表现上,
部署门槛与硬件建议:
为了发挥该模型的最大威力,
随着
欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。

欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。新鲜AI产品点击了解:https://app.aibase.com/zh1、MiniMax发布Music3音乐模型:给歌词和描述,可生成最长5分钟歌曲MiniMax-Music3是一款能够根据歌词和音乐描述生成最长5分钟完整歌曲的音乐生成模型,其采用分层自回归架构,由全局语言模型和局部语言模型协同工作,分别负责歌曲的长程语义与结构变化以及细粒度的声学信息补全。AI荐饮功能将根据用户身体状况智能推荐咖啡因摄入量,体现了零售场景智能化的进一步发展。
MiniMax推出音乐生成模型MiniMax-Music3,输入歌词与音乐描述即可生成最长5分钟完整歌曲,输出32kHz、16-bit立体声WAV。其采用分层自回归架构,两模型分工:全局语言模型Global LLM参数8B,逐帧预测首个RVQ码本,负责歌曲长程语义与结构变化;该模型由Qwen3-8B初始化,训练时先让嵌入层和输出层适配音乐。
一汽-大众纯电新车ID. AURA T6于8月14日开启盲订,确认接入火山引擎豆包大模型。双方智能座舱合作由此前覆盖全系燃油车,正式拓展至纯电新能源领域,标志合作全面升级。
苹果HomePod mini发布近六年终将换代,第二代最快今秋亮相,推迟主因是等待新一代Siri成熟。新款Apple TV 4K、全尺寸HomePod及智能家居屏等多款硬件也因AI研发延期,反映AI能力已成苹果硬件迭代关键掣肘,软件成熟度直接决定硬件发布节奏。
DeepSeek-V4-Pro-0813在硅基流动Day-0首发,主打1M上下文、低/高/最大三档推理强度,重心转向编码、工具调用与智能体工作流,维持MIT开源。定价为输入每百万token 1.32美元、输出3.96美元,缓存命中仅0.44美元,缓存成本优势显著。

本地部署大模型不等于胜任真实业务,AI还需精准理解复杂规则、遵守安全边界、正确调用外部工具。针对这一痛点,蚂蚁ASystem团队联合开源社区维护的本地化后训练工具包AReno,携手百灵大模型推出轻量级后训练实践路径,以提升模型业务落地能力。
金山办公“灵犀专业版”于2026年8月14日接入DeepSeek-V4-Pro正式版,用户无需配置,手动切换即可体验。该模型支持100万token超长上下文,单次最大输出38.4万token,基准测试较Preview全面提升,落地场景具差异化优势。
智谱发布大模型GLM-5.3,参数量仍为7400多亿,与GLM-5.2同底,未升级万亿参数(或留待5.5)。其依靠后训练使性能较上代提升50%,在多项主流基准中居开源模型榜首,编程与智能体能力接近Claude Fable5,编程体验优于其他国产模型。
腾讯大模型布局调整:原混元资深研究员徐灿转岗微信事业群,加入WeLM团队,专注后训练与Agent研发。徐灿曾创建WizardLM并提出Evol-Instruct,在合成数据、强化学习等领域积淀深厚。此举正值微信AI加速落地期。
苹果在华销量承压,正调整AI布局,已专为中国市场训练专属大语言模型,并与阿里巴巴深度合作,由后者提供技术支持完成核心训练。此前外界预计苹果会引入国内第三方大模型。