京东开源JoyAI-Video-Edit

说个能让视频创作者兴奋的消息:视频编辑终于可以实时交互修改了。


8月5日,京东宣布,开源自研的实时流式视频编辑模型——JoyAI-Video-Edit,用户在观看视频的同时,可实时修改人物形象、替换场景、调整画面风格,彻底打破了传统视频创作“先有素材再修改的局限,实现了“边观看,边创作”的突破性体验。


0567b2a3-9bf8-4a1c-97b4-c403b1c2d346.png


有的人会问了,这到底有什么特殊之处?


经常接触AI生成的朋友都知道,通常来说,视频是由一帧帧连续画面构成。传统视频生成模型处理的是把生成连续画面,然后拼接在一起的工作,用户输入指令,模型花几十秒甚至几分钟生成一段视频,只有在完成后才能看到结果。


这导致如果你对结果里的某个细节不满意,只能重新输入指令、重新等待,这个过程也被我们称为“抽卡”。 


作为对比,JoyAI-Video-Edit的生成过程是完全实时的,就像这样,你输入的素材位于画面左侧,右侧则在对你的需求进行实时渲染,你可以选择添加帽子、更换衣服,模型会自然地根据需求进行右侧画面的调整。


屏幕截图 2026-08-06 162700.png


就像这样,家装设计也可以一边播放,一边切换家具、墙面和灯光效果。


image.png


在我看来,这种边播边改的能力一旦普及,预计将极大赋能零售营销、家装设计和影视制作等行业。电商主播可以瞬间展示几十种穿搭,设计师能让客户实时看到墙面变色、家具换新的效果,大幅减少返工成本。


有趣的是,如果我们把视线拉回整个行业,不难发现这次京东新模型的开源,只是今年视频模型竞逐的一个剪影。


前阵子,MiniMax发布开源全模态模型H3,特地强调视频编辑能力登顶全球第一;字节跳动更新Seedance 2.5,不仅将单段视频从15秒拉到30秒,更是强调了局部编辑的上线。


但是目前有,而且仅有JoyAI-Video-Edit几乎能够做到生成和编辑的无缝同步。


从“能不能生成一段好看的视频”到“生成出来的内容能否被编辑、控制”,从一次性输出到可交互编辑,从离线生成到流式处理,我认为这正是视频模型从玩具走向工具的必经之路。


目前,JoyAI-Video-Edit已开源,开发者与内容创作者可通过下方链接获取模型,体验实时视频编辑能力并探索更多应用场景。


https://huggingface.co/jdopensource/JoyAI-Video-Edit

https://github.com/jd-opensource/JoyAI-Video-Edit


机器人产业最重要风向标,世界机器人大会(WRC)2026重磅来袭,还有世界人形机器人运动会紧随其后。


宇树、智元、启元、魔法原子、银河通用、云深处、灵心巧手等300余家TOP展商联袂呈现,定义全球机器人产业未来!


所有关于机器人的核心问题,WRC都将给出答案。


雷科技WRC 2026报道团,空降北京重磅呈现。

114e2bead2b054cb07a25e40eadbc765.png