AIBase
首页
AI 资讯
AI 产品库
GEO 平台
MCP 服务
模型算力广场
VIP会员
ZH

AI资讯

查看更多

拒绝“一问一答”:京东开源实时视频交互模型 JoyAI-VL-Interaction

京东开源全球首个全栈实时视频交互模型 JoyAI-VL-Interaction,获 vLLM-Omni 深度支持。该模型突破传统被动响应模式,实现 AI 主动“边看边说”,标志着视觉助手从等待提问转向自主观察与即时交互。

14.9k 前天
拒绝“一问一答”:京东开源实时视频交互模型 JoyAI-VL-Interaction

vLLM-Omni开源:把扩散模型、ViT、LLM塞进一条流水线,多模态推理一次跑完

vLLM团队推出首个“全模态”推理框架vLLM-Omni,将文本、图像、音频、视频的统一生成从概念验证变为可落地的代码。该框架采用解耦流水线架构,包括模态编码器(如ViT、Whisper)、LLM核心(沿用vLLM自回归引擎)和模态生成器(如DiT、Stable Diffusion),支持多模态输入与输出。开发者可通过GitHub和ReadTheDocs获取,并立即pip安装使用。

23.4k 3 小时前
vLLM-Omni开源:把扩散模型、ViT、LLM塞进一条流水线,多模态推理一次跑完

vLLM-Omni 发布:可以处理文本、图像、音频和视频

vLLM团队推出vLLM-Omni推理框架,支持文本、图像、音频和视频等多模态输入输出,旨在简化多模态推理过程,为新一代全模态模型提供强大支持。

19.7k 昨天
vLLM-Omni 发布:可以处理文本、图像、音频和视频
AIBase
智启未来,您的人工智能解决方案智库
English简体中文繁體中文にほんご
友情链接:
AI Newsletters AI ToolsMCP ServersAI NewsAI MarketingLLM LeaderboardAI Ranking
© 2026AIBase
商务合作网站地图