ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

京东开源实时视频编辑AI:边播边改超便捷,适配电商多场景

时间:2026-08-06 06:32:27来源:天脉网编辑:快讯

在视频创作领域,一项突破性技术正引发行业关注。京东近日宣布开源自主研发的实时流式视频编辑模型JoyAI-Video-Edit,该技术允许用户在视频播放过程中直接修改人物穿搭、替换商品或场景元素,彻底颠覆传统"先拍摄后编辑"的生产流程。

实测体验显示,用户只需在操作界面输入文字指令,系统即可实时完成视频内容修改。当测试者穿着绿色T恤自拍并输入"将上衣改为粉色"的指令后,画面中的服装颜色立即发生改变。更复杂的操作如"佩戴红色棒球帽和深色墨镜"同样能快速响应,虽然存在约0.3秒的轻微延迟,但整体流畅度已达到实用标准。该技术已实现六大核心功能:服装颜色/款式/材质的实时替换、配饰调整、艺术风格转换、场景置换、角色形象转换以及参考图驱动换装。

技术团队透露,JoyAI-Video-Edit基于全自研架构,在720P分辨率下可保持每秒30帧的处理速度。这种性能表现使其能够无缝适配电商直播场景——主播在展示商品时,观众看到的画面可同步替换为不同颜色或款式的商品,无需中断直播进行后期制作。测试中发现,系统的响应精度高度依赖提示词质量,当指令过于宽泛时,模型可能自主添加未要求的配饰或改变发型设计。

与行业主流的"文生视频"技术路线形成鲜明对比,京东选择押注"边播边改"的实时编辑赛道。当前市场上,阿里通义万相、快手可灵AI、字节即梦等平台均专注于通过文本或图像生成完整视频,而京东的技术方案更侧重于对现有视频流的动态修改。这种差异化策略在电商领域展现出独特优势,特别是对于需要即时调整商品展示效果的直播场景。

技术突破的背后,隐藏着京东在具身智能领域的战略布局。据研发团队介绍,该模型可通过编辑人手操作视频,批量生成机械臂训练所需的合成数据。通过保留物体空间关系和动作轨迹,同时替换场景、物体和机器人形态,单段视频可扩展出数十倍的训练样本,有效解决真实数据采集成本高、危险场景难以复现等行业痛点。

作为京东JoyAI模型矩阵的最新成员,JoyAI-Video-Edit与现有图像编辑、长音视频生成、实时画面反馈等模块形成技术协同。该矩阵已包含空间理解、语音交互、机器人操控等能力模块,此次开源的实时视频编辑技术,标志着京东在物理世界AI应用领域完成重要拼图。

更多热门内容
谷歌Pixel 11系列手机灯效新功能HiLight亮相,来电及AI聊天时悄然提醒
IT之家 8 月 5 日消息,科技媒体 9to5Google 昨日(8 月 4 日)发布博文,报道称在 Pixel 11 Pro系列手机上,此前曝光的 RGB 灯效功能 Pixel Glow 上线后名为 H…

2026-08-06

谷歌8月12日发布会前瞻:Pixel 11系列领衔 多款新品蓄势待发
届时,谷歌预计将发布新一代Pixel 11系列智能手机、Pixel Watch 5智能手表,以及传闻中的PixelTag。谷歌还可能更新Android XR眼镜的进展,并在发布会上确认Googlebook笔…

2026-08-06

微信鸿蒙版安装量冲破7000万次 鸿蒙生态发展再添强劲动力
【CNMO科技消息】8月5日,CNMO科技了解到,微信鸿蒙版迎来重要进展,华为应用市场显示,微信鸿蒙版安装量已正式突破7000万次大关,成为鸿蒙生态发展历程中的又一里程碑。 CNMO科技注意到,微信鸿蒙版从2…

2026-08-06