京东和Open AI前CTO Mira Murati,押注了同一个AI赛道
京东开源了全球首个全栈开源视觉语言交互模型JoyAI-VL-Interaction,旨在突破传统AI“问答式”交互的局限,让AI能够基于连续视频流主动感知、判断并在适当时机提供帮助,例如在老人摔倒或赛事关键时刻自动预警或解说。该模型将视觉作为核心驱动模态,能自主决定何时响应、保持沉默或移交复杂任务给后台大模型。其8B参数设计轻量,支持在单张3090显卡上部署,并已集成至vLLM-Omni。
几乎同时,OpenAI前CTO Mira Murati创办的Thinking Machines Lab也提出了“交互模型”概念,预示主动交互正成为行业重要方向。京东凭借在零售、物流、健康等真实场景的积累,正构建大规模物理世界数据集,以推动视觉交互在家庭看护、机器人、工业巡检等领域的落地。通过全栈开源,京东希望降低开发门槛,加速AI在物理世界中的主动应用生态发展。
marsbit06/24 10:23