把学习笔记变为游戏,谷歌 Gemini Notebook 新功能曝光
2026-08-04
2026-08-08 0
近期,京东正式对外宣布,开源自研的实时流式视频编辑模型JoyAI-Video-Edit。这款全新的开源模型打破了传统视频创作“先拍完素材、再慢慢后期修改”的老模式,用户可以一边实时观看视频画面,一边直接修改里面的人物形象、场景细节,全程不用漫长等待渲染,实现了边看边改的流畅互动编辑体验。

很多做过视频剪辑的人都有过类似的糟心经历:对着一段视频素材想调整某个画面里的人物穿搭、替换背景场景,用传统AI编辑工具操作完,得等好几分钟甚至十几分钟的渲染时间才能看到修改后的效果,要是改完发现不满意,又得重新调整参数再等一轮渲染,来回折腾好几次,大半天时间就耗进去了。京东这次开源的JoyAI-Video-Edit,就专门瞄准这个行业痛点做了核心突破,把视频编辑的响应速度提升到了实时流式的水平,你刚在操作界面输入修改指令,几乎立刻就能在播放窗口里看到画面的变化,不用再漫长等待渲染。
根据公开的技术测试结果,在流式实时视频编辑这个方向上,JoyAI-Video-Edit的各项表现指标都全面超过了当前业内的代表性模型,整体能力达到了世界一流水平。普通用户用它做短视频创作的时候,不用再掌握复杂的专业剪辑软件操作,只需要用自然语言说出自己的修改想法,就能实时看到画面调整的效果,哪怕是完全没有剪辑经验的新手,也能轻松做出效果不错的创意视频。专业创作者也能靠它大幅提升工作效率,调整视频细节的时候不用反复等待渲染,边看边改快速迭代创意,把更多精力放在内容构思上,而不是耗在等待渲染的时间里。
这次开源的JoyAI-Video-Edit,也是京东面向物理世界打造的JoyAI大模型矩阵里的重要一环。目前京东已经搭建起了覆盖多个核心方向的完整基础模型体系:JoyAI-Image-Edit负责让AI精准理解和编辑空间图像内容,JoyAI-Echo主打长音视频的高质量生成,JoyAI-VL-Interaction能让AI持续观察画面并实时给出回应,JoyAI-Talker提供流畅自然的实时语音交互能力,JoyAI-RA则专门面向机器人操控场景做优化,整套模型矩阵覆盖了语音、图像、视频、实时交互、具身智能等多个核心领域。
JoyAI-Video-Edit的正式开源,不仅给视频创作领域带来了一款实用的新工具,也为后续具身智能的大规模数据合成积累了扎实的底层技术。依托这套实时视频编辑能力,后续可以快速生成海量贴近真实物理世界的动态场景数据,给机器人、智能终端的训练提供充足的素材支撑,为京东正在加速建设的全球最大物理世界运营中心提供配套的AI技术底座。
目前这款实时流式视频编辑模型已经正式对外开源,所有开发者和创作者都可以直接获取使用,后续京东也会持续迭代优化模型能力,把更流畅的实时编辑体验开放给全行业用户。