8月5日,京东正式官宣开源旗下自研实时流式视频编辑模型JoyAI-Video-Edit,凭借颠覆性的实时交互编辑能力,打破行业沿用多年的视频创作固有流程。该模型依托京东自研JoyAI-Video底层架构打造,彻底告别传统“先拍摄素材、后剪辑渲染”的离线创作模式,创新性实现视频播放与实时修改同步进行,让视频创作迈入“边看边改、实时交互”的全新阶段,为短视频创作、电商直播、影视制作等领域带来高效智能新方案。
长期以来,全球视频编辑行业始终遵循固定制作逻辑,创作者需完整拍摄视频素材后,再导入剪辑软件进行逐帧修改、画面调整、特效叠加、渲染导出,全程工序繁琐、耗时冗长,且修改容错率低。尤其是长时长视频、批量短视频内容创作,往往需要耗费大量人力、算力与时间成本,单次修改后需等待完整渲染预览,反复迭代效率极低。传统离线剪辑模式,早已无法适配当下短视频高速迭代、直播实时优化、电商内容高频更新的产业刚需,行业亟需全新技术范式突破瓶颈。
本次开源的JoyAI-Video-Edit模型,核心突破在于构建了流式实时编辑体系,重塑视频创作底层逻辑。不同于常规AI视频工具的局部修图、后置优化功能,该模型支持任意时长视频的稳定流式编辑,用户在视频播放过程中,可通过自然语言指令实时修改人物穿搭、服饰色彩、五官细节,同时灵活替换场景背景、调整画面风格、优化光影质感,甚至实现画面主体的智能替换,全程无需暂停播放、无需等待渲染,修改效果即时呈现,真正实现“所见即所编、所改即所得”。
在核心性能层面,该模型具备行业领先的实时推理能力,完美适配民用与商用主流场景。实测数据显示,模型在720P常规分辨率下可实现30帧每秒的稳定推理速度,精准匹配常规视频与直播的播放帧率,有效杜绝编辑卡顿、画面延迟、帧错位等问题。同时模型依托自主研发的自回归扩散架构,逐帧实时处理视频流,无需预设视频长度、无需回溯重算,在保障画面流畅度与清晰度的同时,大幅提升编辑效率,解决了传统AI视频模型延迟高、稳定性差、长视频适配弱的痛点。
依托极致的实时编辑能力,JoyAI-Video-Edit可广泛落地多元商业化场景,尤其适配电商内容创作赛道。对于电商直播、商品短视频带货场景,模型可实现主播服饰一键换色、商品背景一键替换、展示场景智能切换,无需主播反复换装、无需重复拍摄素材,极大降低电商内容的制作成本与时间成本。同时可快速批量生成差异化宣传视频,助力商家丰富内容矩阵、提升营销效率,精准适配电商高频、高效、轻量化的内容迭代需求。
作为全开源技术成果,京东同步开放模型权重与免费商用API,面向个人创作者、中小企业、影视团队、科技开发者全面开放,降低行业AI视频创作的技术门槛与商用成本。开发者可基于该模型二次开发,定制适配直播剪辑、短视频创作、影视后期、教育培训、虚拟内容制作等细分场景的专属工具,快速拓展实时视频编辑的应用边界,推动AI视频创作技术的普惠化落地。
业内分析表示,京东JoyAI-Video-Edit的开源落地,是AI视频创作领域的一次技术革新。其彻底颠覆了数十年的离线剪辑逻辑,将视频创作从后置加工模式升级为实时交互模式,大幅重构内容生产链路。未来随着模型持续迭代与生态普及,将全面赋能短视频、电商、影视、传媒等多个行业,推动视频创作向轻量化、智能化、实时化升级,引领AI内容生产行业迈入全新发展阶段。