OpenAI的视频生成神器Sora,自面世以来就备受瞩目,但它究竟师从何处,却始终是个谜。如今,谜团的一角似乎被揭开:Sora的训练数据中,极有可能潜藏着大量来自Twitch的游戏直播和攻略视频!




OpenAI的视频生成神器Sora,自面世以来就备受瞩目,但它究竟师从何处,却始终是个谜。如今,谜团的一角似乎被揭开:Sora的训练数据中,极有可能潜藏着大量来自Twitch的游戏直播和攻略视频!




欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。
Cloudflare发布全新开放权重决策模型Clef-omni。该模型在Clef系列基础上升级,原生支持文本与图像,并首次新增音频和完整视频输入的直接处理能力。模型权重已在Hugging Face全面开源。技术上,它改变传统处理链路,此前Clef处理视频需先按时间轴拆解为连续片段。
科技观察家Azeem Azhar赴伦敦出差时,将笔记本电脑忘在阿姆斯特丹家中,意外开启为期一周的“纯语音办公”实验。这打破了依赖屏幕和键盘处理Slack、Word、Excel等工作的传统模式,也让他对人机交互的未来产生颠覆性新认知,并引发对语音办公可能性的思考。
OpenAI近日公开722篇前沿数学手稿,其中两篇核心论文瞄准数学世纪难题挂谷猜想:一篇聚焦三维挂谷极大函数猜想,另一篇给出四维一般挂谷集合的满维证明。该进展刷新了多维数学认知边界,也引发全球学术界对AI在前沿基础科学研究中扮演何种角色的深刻讨论。

Cloudflare于10月9日发布开放权重决策模型Clef-omni。它在原有文本、图像处理基础上,新增音频和完整视频支持,可通过单次API调用同时处理多模态内容。相比传统Clef仅处理文本、图像及按时间间隔抽取的静态连续画面,Clef-omni原生支持wav、mp3等音频格式,并涉及多模态升级与架构解析。
OpenAI公开700多份由内部前沿AI模型生成的数学研究文稿,引发数学界广泛关注与激烈讨论。部分学者振奋于AI在数学领域的突破,也有专家担忧其冲击学术生态和青年研究人员,青年研究员成果受冲击、数据安全遭质疑。纽约大学数学教授巴克马斯特批评OpenAI一次性放出如此庞大的研究成果。

生数科技发布新一代视频生成旗舰模型预览版Vidu Q4Preview,在生成质量、多模态参考与画面精度上显著升级,标志国产视频大模型向影视级质感迈出关键一步。该模型全面支持图生视频与参考生视频两种主流模式:图生视频可依据图片和文字描述自然延伸出高质量画面,参考生视频则强化多模态参考生成能力。

生数科技发布视频生成旗舰模型Vidu Q4 Preview预览版,面向影视创作、AI短剧、广告营销等场景。新版本在画质分辨率、参考控制与镜头表现力上显著升级,支持2K/4K高分辨率、10bit色深,单次最长生成16秒视频,并具备多维度参考控制能力。
《金融时报》及Axios等外媒称,OpenAI截至9月底年化营收约500亿美元;此前近700亿美元数字主要因会计标准差异。Anthropic通过云伙伴销售时记录客户支付全额、将分成计为费用,OpenAI在部分伙伴交易中仅将自身分得部分计为营收,两者均符合美国GAAP。尽管口径不同,差异由此而来。
OpenAI近期因三名研究人员Jasmine、Mikita和Tomek离职陷入舆论争议。针对外界猜测及公开信质疑,OpenAI研究负责人发布官方说明,全面澄清事件核心细节。声明明确,上周终止与三人雇佣关系,并非因他们公开表达安全担忧或批评公司。OpenAI还强调,公司内部一直非常欢迎……
OpenAI最新预测显示,在企业级业务强劲拉动下,到2026年底年化收入将达或超700亿美元。此前市场传其9月底年化收入仅500亿美元,引发投资人对AI回报率担忧,拖累美股科技板块下跌;最新数据回升市场信心。不过,公司仍面临资本与盈利双重挑战,营收高速扩张伴随巨大现金消耗压力,预计到2030年累计……