PChome 8月5日消息,京东正式开源自研的实时流式视频编辑模型JoyAI-Video-Edit。这意味着视频创作的传统逻辑——“先有素材、再做后期"——被重新定义。
PChome 8月5日消息,京东正式开源自研的实时流式视频编辑模型JoyAI-Video-Edit。这意味着视频创作的传统逻辑——“先有素材、再做后期"——被重新定义:用户现在可以一边观看视频,一边实时修改人物与场景。

流式编辑最大的门槛是速度。JoyAI-Video-Edit基于全自研JoyAI-Video底座,在720P分辨率下实现每秒30帧的推理速度,画面处理无明显延迟,能够匹配常见影视视频的播放节奏;同时突破了此前流式模型只能处理几秒或分钟级片段的限制,支持任意时长的稳定流式编辑,用户无需等待整段视频生成完毕,即可在播放过程中持续调整。

在业界权威的OpenVE-Bench通用评测中,JoyAI-Video-Edit超越了目前所有流式编辑方法,在全局风格转换、局部替换、局部删除、字幕编辑等任务中优势突出,实时出图画质可对标离线专业剪辑模型。对比SANA Streaming、LiveEdit等海外主流流式编辑方案,其综合性能达到世界一流水平。
借助自然语言指令,创作者可实时更换人物着装、增删物体、迁移场景甚至重构整个画面的艺术风格。这不仅适用于零售营销、家装设计、影视预演等商用场景,也为具身智能的大规模数据合成提供了底层能力——例如将人手操作视频转化为机械臂训练素材。
目前,JoyAI-Video-Edit已在Hugging Face与GitHub双平台开源,开发者与内容创作者可自主部署调试或进行二次开发。这也是京东JoyAI物理世界模型矩阵的又一关键补位,与其既有的图像编辑、长音视频生成、实时语音交互、机器人操控等模型共同构成覆盖多模态的体系化布局。