AI 【新芒xAI】京东开源JoyAI-Video-Edit,视频创作进入实时互动编辑

【新芒xAI】京东开源JoyAI-Video-Edit,视频创作进入实时互动编辑

新芒xAI 8月5日消息,京东宣布开源自研实时流式视频编辑模型JoyAI-Video-Edit。该模型主打“边看边改”的视频创作体验,用户可以在观看视频的同时修改人物与场景,让视频编辑从“先生成或拿到素材、再后期修改”,进一步走向实时互动式创作。

关键要点

  • JoyAI-Video-Edit定位为实时流式视频编辑模型,核心能力是面向正在播放或预览中的视频画面进行交互式调整,而不是只处理静态图片或完整视频文件。
  • 京东此前在WAIC期间已展示过JoyAI-Video-Edit相关能力,包括自定义画面、边预览边修改,以及通过自然语言对视频中的人物、物体、服装和场景进行调整。
  • 从JoyAI-Image-Edit、JoyAI-Echo、JoyAI-VL-Interaction到JoyAI-Video-Edit,京东正在把图像生成、长视频生成、实时视频理解和视频编辑能力串成更完整的多模态模型矩阵。
  • 目前公开信息主要强调模型开源和实时编辑方向,具体开源范围、许可协议、推理成本、硬件门槛和开发者实际部署体验,还需要结合后续代码、模型文档和社区反馈观察。

新芒xAI评论

JoyAI-Video-Edit值得关注的地方,不只是“又一个视频模型”发布,而是把视频创作的交互方式往前推了一步。过去不少AI视频工具仍接近离线工作流:输入提示词,等待生成,再对结果做二次修改。实时流式编辑如果能稳定落地,创作者将更像是在操控一个可持续响应的动态画布,而不是反复等待模型出片。

这也与多模态模型的发展方向相吻合。图像编辑解决的是单帧空间控制,长视频生成解决的是连续内容生产,实时视频理解解决的是模型能否持续观察,而实时视频编辑则试图把“看见、理解、生成、修改”合并到同一个创作闭环里。对电商、营销、短视频、直播和数字人内容生产来说,这类能力一旦工具化,可能直接改变素材生产和后期制作的成本结构。

不过,实时视频编辑的难点也会更集中地暴露在体验层。画面一致性、人物身份保持、指令响应延迟、长时间编辑的稳定性,以及高并发推理成本,都会决定它是演示级能力还是生产级工具。京东选择开源,有利于吸引开发者验证边界,但能否形成生态,还要看模型质量、部署门槛和商业场景是否足够匹配。

文章来源信息声明: 本文信息出自权威媒体、企业官方及网络,并经新芒X编辑,转载请注明源出处、作者和链接。 图片部分来源于网络,在此表示感谢,如有侵权请联系我方处理。 文章发布日期后方火形图标后的数字,为文章热度,谨代表受欢迎程度。 新芒X平台仅对用户提供信息及决策参考,本文不构成投资建议。

作者: 新芒Group

新芒出品,专注专业。兼具内容品质和传播影响力
关注微信
微信扫一扫关注我们

微信扫一扫关注我们

关注微博
返回顶部