8月5日,京东宣布开源自研实时流式视频编辑模型JoyAI-Video-Edit;7月31日,字节跳动发布新一代视频创作模型Seedance 2.5,徐工集团、小鹏汽车等多家企业已确认引入该模型。不到一周,两家北京龙头科技企业接连在视频生成与编辑领域发布新成果。从零售营销到工业仿真,从具身智能训练到自动驾驶测试,北京AI视频模型企业正加速从创意工具走向生产力工具。
直播间里,服饰主播试完白色上衣,观众又想马上看到蓝色款是什么效果,可蓝色款不在身边;视频聊天时,和朋友畅想穿越到古代当侠客,想让美好的想象瞬间变为精美视频……类似这样的问题,今后都能轻松解决。昨天京东开源的实时流式视频编辑模型JoyAI-Video-Edit,让用户可以一边观看视频,一边修改人物与场景,视频创作从“先有素材再修改”变为可实时互动编辑。
视频实时编辑首先要解决速度问题。技术人员表示,视频由一帧帧连续画面组成,如果模型处理速度跟不上播放速度,就会出现卡顿与延迟。JoyAI-Video-Edit基于全自研模型,在720P分辨率下实现每秒30帧的模型推理速度,能够在保持较高画面清晰度的同时,跟上常见影视视频的播放节奏。
视频长度也是流式编辑的一道门槛。此前的流式编辑模型最多只能处理分钟级片段,而JoyAI-Video-Edit支持任意时长的稳定流式编辑,可以随着视频持续播放、持续处理。用户不必等待整段视频生成完成,就能在播放过程中实时修改场景、替换物体、调整人物形象或改变画面风格,实现“边观看边创作”。
“边播边改”的视频编辑能力,究竟能在哪些场景派上用场?据了解,这种能力将为零售营销、家装设计、影视制作等大量真实场景带来新的技术支持:服装与商品展示视频可以快速更换人物穿搭、商品和背景;家装视频可以实时切换家具与装修风格;影视创作者也可以更快尝试人物造型、场景和视觉效果,减少重复拍摄与整段返工。
7月31日,字节跳动发布Seedance 2.5,单次生成视频时长提升至30秒,增加了视频局部编辑能力,并加强了复杂指令控制,能够适配多种语言、多版本的工业化生产需求。
随着模型能力的提升,Seedance 2.5也在更广泛的产业场景里得到应用。该模型发布当天,徐工集团、小鹏汽车、灵初智能、微分智飞、穹彻智能等多家企业就已确认与其合作,将率先引入Seedance 2.5。从工程机械到智能汽车,从具身智能到自动驾驶,视频生成大模型正从创意工具走向生产流程中的标准化工具。
例如在教育领域,模型可以帮助老师更高效地制作教学视频,将科学原理、历史事件、实验过程等抽象内容转化为动态演示,不仅降低教学物料的制作门槛,还支持灵活的内容定制。
在工业制造、具身智能和自动驾驶等产业中,Seedance 2.5也开始进入更具体的生产环节,它可以生成高质量合成视频数据,帮助训练机器人的感知和操作能力,也可以用于工业仿真、流程培训和设备演示。在自动驾驶场景中,模型还可以模拟极端天气、复杂路况等低频场景,为系统测试和训练提供更多样本。(记者 孙奇茹)
京产AI视频模型加速奔赴实体产业
日期:2026-08-06
来源:北京日报
【打印本页】
【关闭窗口】
