人工智能企业 xAI 近日宣布推出新一代语音识别与生成模型
在权威的 Artificial Analysis 语音识别基准测试中,
在语音转录精度方面,官方测试表明,新模型在多语言环境下的转录准确率较上一代提升了约 1.4 倍,并在多国语言的大规模音频测试中展现出强大实力。特别是在背景噪音干扰和电话压缩等复杂现实场景中,其抗干扰能力与竞品的差距被进一步拉大。
技术架构上,
目前,该技术已在实际业务场景中展开验证,并在
人工智能企业 xAI 近日宣布推出新一代语音识别与生成模型
在权威的 Artificial Analysis 语音识别基准测试中,
在语音转录精度方面,官方测试表明,新模型在多语言环境下的转录准确率较上一代提升了约 1.4 倍,并在多国语言的大规模音频测试中展现出强大实力。特别是在背景噪音干扰和电话压缩等复杂现实场景中,其抗干扰能力与竞品的差距被进一步拉大。
技术架构上,
目前,该技术已在实际业务场景中展开验证,并在
欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。
阶跃星辰9月15日发布StepAudio3系列语音大模型,涵盖Realtime、ASR、TTS、Gen、Music五款产品,多款在权威评测Artificial Analysis登顶全球第一。五款模型已在开放平台全面上线,分别面向真人级语音生成、完整音频内容生成、实时语音交互、复杂场景语音理解及音乐创作。
加拿大AI研究员克鲁格警告,避免人类末日仅放缓AI研发远远不够,必须立即、无限期暂停前沿AI研发,停止开发能力更强的AI。他是蒙特利尔大学助理教授、Mila核心成员,研究方向为降低AI导致人类灭绝的风险。
多家主要企业客户(英伟达、Palantir、Booz Allen Hamilton等)因担忧专有数据安全,限制在敏感项目中使用Anthropic和OpenAI前沿模型,引发企业AI市场震动。起因是Anthropic今年6月政策允许其Fable模型保留客户数据30天以检测滥用,触发信任危机。
微信AI助手“小微”因隐私质疑上热搜,微信澄清“直接读取聊天记录、偷看隐私”等说法失实。该助手为原生AI,尚在小范围内测,支持文字语音交互,可查天气、快递、外卖,并在朋友圈、公众号、聊天、视频号等场景主动唤起,辅助内容总结。
盖茨基金会未来两年将投入10亿美元推动人工智能发展,让前沿技术惠及最贫困地区。盖茨还就全球大模型格局、算力碳排放及中国人形机器人等话题发表看法,指出按不同衡量方式,中美目前各有四家领先大模型企业。
微软CEO纳德拉发布内部备忘录,称AI应处于人类控制下,支持更广泛第三方测试,强调必须花时间确保技术安全,否则将失去运营许可。微软同步发布37页行为准则,回应行业对AI发展过快的担忧。

OpenAI被曝雇数百名合同工审核真实ChatGPT用户对话,对回复按1至7分评分,以改进模型,重点减少过度奉承和拟人化。用户多不知聊天可能被真人阅读;匿名化处理仍可能含敏感个人信息,OpenAI隐私过滤器亦被承认可能出现漏洞。
OpenAI首席执行官奥尔特曼表态支持人工智能“控速”发展,避免尖端模型能力超出人类可控范围,与Anthropic CEO阿莫迪观点相近。他承认转向安全会付出一定代价,但有助于维持外界信心,证明美国企业在研发日益强大的AI时能够恪守责任。
百图生科与华大智造达成战略合作,共建细胞大模型,提升细胞状态建模与扰动响应预测能力,并打造高质量数据基础设施,探索“设备+模型+智能体”一体化产品模式,加速AI4S进程。华大智造提供测序与自动化硬件入口,百图生科负责AI建模,双方分工互补。
DeepSeek本周发布V4.1 Flash,架构变化巨大但未升大版本号。V4.1 Pro已确定,具体升级未公布,性能上限或较高,但鉴于前代Pro不及预期,外界期待不宜过高。另有Code 2.0被曝即将发布,主打电脑控制,后续还有更多大模型。