京東在JDD大會上發佈JoyAI-Echo兩項進展:音視頻生成模型升級至1.5,持續生成超10分鐘;開源可交互視聽世界模型EchoWM,融合原生視聽生成與用戶控制,讓AI內容從“能看”走向“能進、能探索”。長視頻採用音視頻Memory Bank架構,支持多鏡頭生成。