京东开源实时视频编辑AI:边播边改超便捷,适配电商多场景

   发布时间:2026-08-06 06:32 作者:沈瑾瑜

在视频创作领域,一项突破性技术正引发行业关注。京东近日宣布开源自主研发的实时流式视频编辑模型JoyAI-Video-Edit,该技术允许用户在视频播放过程中直接修改人物穿搭、替换商品或场景元素,彻底颠覆传统"先拍摄后编辑"的生产流程。

实测体验显示,用户只需在操作界面输入文字指令,系统即可实时完成视频内容修改。当测试者穿着绿色T恤自拍并输入"将上衣改为粉色"的指令后,画面中的服装颜色立即发生改变。更复杂的操作如"佩戴红色棒球帽和深色墨镜"同样能快速响应,虽然存在约0.3秒的轻微延迟,但整体流畅度已达到实用标准。该技术已实现六大核心功能:服装颜色/款式/材质的实时替换、配饰调整、艺术风格转换、场景置换、角色形象转换以及参考图驱动换装。

技术团队透露,JoyAI-Video-Edit基于全自研架构,在720P分辨率下可保持每秒30帧的处理速度。这种性能表现使其能够无缝适配电商直播场景——主播在展示商品时,观众看到的画面可同步替换为不同颜色或款式的商品,无需中断直播进行后期制作。测试中发现,系统的响应精度高度依赖提示词质量,当指令过于宽泛时,模型可能自主添加未要求的配饰或改变发型设计。

与行业主流的"文生视频"技术路线形成鲜明对比,京东选择押注"边播边改"的实时编辑赛道。当前市场上,阿里通义万相、快手可灵AI、字节即梦等平台均专注于通过文本或图像生成完整视频,而京东的技术方案更侧重于对现有视频流的动态修改。这种差异化策略在电商领域展现出独特优势,特别是对于需要即时调整商品展示效果的直播场景。

技术突破的背后,隐藏着京东在具身智能领域的战略布局。据研发团队介绍,该模型可通过编辑人手操作视频,批量生成机械臂训练所需的合成数据。通过保留物体空间关系和动作轨迹,同时替换场景、物体和机器人形态,单段视频可扩展出数十倍的训练样本,有效解决真实数据采集成本高、危险场景难以复现等行业痛点。

作为京东JoyAI模型矩阵的最新成员,JoyAI-Video-Edit与现有图像编辑、长音视频生成、实时画面反馈等模块形成技术协同。该矩阵已包含空间理解、语音交互、机器人操控等能力模块,此次开源的实时视频编辑技术,标志着京东在物理世界AI应用领域完成重要拼图。

 
 
更多>同类内容
全站最新
热门内容
 
智快科技微信账号
微信群

微信扫一扫
加微信拉群
电动汽车群
科技数码群