大模型之家讯 8月5日,京东宣布开源自研的实时流式视频编辑模型 JoyAI-Video-Edit,用户可一边观看视频一边修改人物与场景,将视频创作从"先有素材再修改"变为实时互动编辑。该模型基于全自研 JoyAI-Video 底座,在 720P 分辨率下实现每秒 30 帧的推理速度,支持任意时长的稳定流式编辑,无需等待整段视频生成完成,即可实时修改场景、替换物体、调整人物形象或改变画面风格。
在与 SANA Streaming、LiveEdit、Xmax-X2.0 等国际代表性模型对比中,JoyAI-Video-Edit 在 OpenVE-Bench 通用评测中全面领先,尤其在全局风格、局部替换、局部删除和字幕编辑等任务上优势突出。该模型还能为具身智能数据合成提供新路径,可将人手操作视频转化为机械臂操作素材,扩展机器人训练样本。开源代码已发布至 Hugging Face 与 GitHub。
原创文章,作者:志斌,如若转载,请注明出处:http://damoai.com.cn/archives/17891