OpenAI升级ChatGPT桌面应用并整合Codex,推出基于GPT-Live的全新语音模式。覆盖聊天、办公和编程场景,用户可用语音发起、检查、调整任务,实现多线程协同。核心亮点是全双工语音,支持同时聆听与对话,边聊边干活。该技术源于2024年首次语音识别,逐渐进化至今。
OpenAI今日为ChatGPT桌面端大升级,该客户端已与Codex整合,正式上线基于GPT-Live模型的ChatGPT Voice语音模式。新版本支持在聊天、办公和编程三个板块通过语音直接发起、检查或调整任务,将多线程工作协同从键盘移至语音。早在2024年,OpenAI便为ChatGPT添加语音识别,此后持续发力语音技术。
彭博社披露,OpenAI 正筹备首款硬件——自主移动的无屏智能音箱。该设备搭载升级版语音模型 GPT-Live,支持自然语音交互,既充当便携式智能家居中枢,也标志 OpenAI 正式进军实体硬件生态,开启端侧 AI 交互新范式。它内置可充电电池,可随身携带。
OpenAI推出基于GPT-Live架构的全新ChatGPT语音体验,告别传统语音系统,专为智能语音代理打造实时音频模型。此前已公开的GPT-Realtime-2将GPT-5级推理引入实时交互,能更稳定地处理复杂请求,实现语音技术架构跃迁。