x

全部频道

娱乐> 正文

虚拟偶像Mae亮相大运河音乐节,Xmax AI实时走进大型音乐现场

2026-10-09 15:12 东方网

来源标题:虚拟偶像Mae亮相大运河音乐节,Xmax AI实时走进大型音乐现场

10月5日,北京大运河音乐节现场,一场由AI技术驱动的虚拟偶像表演成为开场舞台亮点。

此次演出中,Xmax.AI实时生成技术连接真实歌手(北京音乐广播电视台主持人麦麦)与虚拟偶像Mae:摄像机实时捕捉现场真实歌手的画面,并通过Xmax AI模型即时生成对应的虚拟偶像画面,让Mae能够随着真人歌手的表演同步呈现。也就是说,观众看到的并不是一段提前制作完成的虚拟偶像视频,而是真人歌手正在现场表演,AI同步将这一表演转化为虚拟偶像画面。这就是Xmax.AI实时视频模型的特色——让AI不仅能够生成视频,更能够理解现实世界中的动态,并将其即时转化成新的视觉内容。

真人在现场表演,虚拟偶像实时“接管”画面

虚拟偶像演出并不是新概念,但过去的数字人和虚拟角色表演,往往依赖提前制作好的动作、镜头和动画内容。这种方式能够实现高度完整的舞台编排,却也意味着虚拟角色与真实现场之间存在一条清晰的边界:真人在现场,虚拟内容则更多是预先设计好的“播放内容”。

而此次大运河音乐节现场采用了不同的技术思路,利用Xmax AI通用实时视频模型。在音乐节现场,真实歌手的表演成为AI实时生成的输入。随着歌手移动、舞动和完成舞台动作,Xmax.AI对现场动态进行实时捕捉和理解,并持续生成虚拟偶像Mae对应的画面。

真人的每一个动作,成为虚拟角色实时变化的驱动力。

这种方式改变了传统虚拟偶像内容的生产逻辑:虚拟角色不再需要完全依赖预先设定好的动作,而可以由真实世界中的人物实时驱动。从“提前制作一个虚拟偶像视频”,到“让真实人物实时驱动虚拟偶像”,AI开始成为连接现实表演与数字内容之间的实时引擎。

从“视频生成”到“视频实时转换”

这场演出背后,值得关注的不只是舞台呈现,还有Xmax AI所展示出的实时视频生成能力。

传统生成式视频通常遵循这样的流程:输入素材 → 模型生成 → 等待结果 → 播放视频。而在实时场景中,链路变成:实时输入 → AI理解动态 → 持续生成 → 画面即时反馈。

两者最大的区别,并不只是速度快慢,而是AI开始实时对现实进行渲染。

在此次音乐节的应用中,现场真实歌手并不是简单地提供一段原始素材,而是持续向模型输入画面信息。Xmax.AI需要在连续的视频流中理解人物动作,并不断生成与之对应的虚拟偶像画面。这意味着,模型不只是回答“这段视频应该长什么样”,还需要回答“这一刻正在发生什么,以及下一刻应该如何呈现”。这也是实时交互式AI视频与传统离线生成的重要区别。

为什么实时能力会成为AI视频的新方向?

生成式AI已经让图片和视频的制作门槛大幅降低,但真正进入直播、演出、电商等实时业务场景后,AI面对的是完全不同的问题。用户不会等待一个直播画面重新生成,也不会因为模型正在处理视频而暂停表演。这意味着模型必须同时具备三种能力:

看得懂。理解摄像头和实时视频中的人物、动作与环境。

跟得上。持续处理不断变化的视频输入,并保持输出的连贯性。

改得动。根据实时输入即时改变人物形象、服装、风格乃至整个视觉呈现。

此次联合舞台所展示的,正是实时视频生成走向真实业务场景的一次具体实践:让真人表演成为AI生成虚拟内容的实时输入。

而这套能力并不局限于虚拟偶像。

从音乐舞台到直播:让AI实时“变身”

在直播场景中,同样的技术逻辑可以产生更直接的应用。

想象一下,主播正在进行一场直播,Xmax AI可以实时捕捉主播的动作和表情,并将其转化为不同的虚拟角色。主播不需要提前录制视频,也不需要切换到完全不同的内容制作流程,AI可以直接参与正在进行的直播,让主播在画面中实时变身。

进一步地,主播还可以实现实时换装、实时换造型和整体视觉风格的实时变化。

这意味着,直播中的AI不再只是负责“生成素材”,而可以直接参与直播内容本身。

未来,观众甚至可以通过互动选择角色、服装或风格,由AI将这些输入实时反馈到直播画面中。直播由此可能从“单向观看”,变成“观众参与塑造画面”。

这也是实时生成技术与传统AIGC工具之间的重要差别:它不只是帮助创作者提高生产效率,而是在改变内容与用户发生关系的方式。

从虚拟偶像到虚拟试穿:同一套能力可以进入消费场景

实时理解和实时生成同样可以应用到电商和消费领域。比如虚拟试穿。用户打开手机摄像头后,AI实时理解人物的姿态、动作以及服装区域,并将不同款式的服装即时呈现在用户身上。当用户转身、移动甚至调整姿态时,画面也能够持续变化。

这与传统静态换装最大的不同在于:用户看到的不是一张“穿上之后的效果图”,而是自己正在运动时的动态效果。从现场歌手驱动虚拟偶像,到主播实时切换角色,再到消费者实时试穿服装,背后其实是同一套技术范式:

理解真实世界中的动态输入,并将其即时转化为新的视觉结果。

这也是Xmax AI实时视频生成技术希望覆盖的核心能力边界。

音乐节只是一个开始,实时模型有更多可能

从虚拟偶像与音乐现场,到直播、虚拟试穿以及更多数字娱乐与商业应用,Xmax AI正在将实时视频生成能力带入更广泛的真实场景。

当真人的动作可以被实时捕捉,并即时转化为虚拟角色;当用户的一次互动可以实时改变画面;当一件服装可以通过摄像头即时呈现上身效果——AI不再只是“生成一段视频”,而是开始实时理解、实时生成,并实时响应真实世界。

音乐节的现场应用只是这一能力的一次呈现。未来,Xmax AI将继续探索实时交互式视频在内容创作、直播、电商、数字娱乐等场景中的应用,让AI从内容生成工具,进一步成为连接现实与数字世界的实时引擎。更多实时交互视频模型能力,可以在Xmax.AI的官方平台进行体验。

(本文来源:东方网。本网转发此文章,旨在为读者提供更多信息资讯,所涉内容不构成投资、消费建议。对文章事实有疑问,请与有关方核实或与本网联系。文章观点非本网观点,仅供读者参考。)

责任编辑:王大治(QJ0026)

北京千龙新闻网络传播有限责任公司版权所有  未经千龙新闻网书面特别授权  请勿转载或建立镜像  违者依法必究

增值电信业务经营许可证(全国)B2-20100033&  增值电信业务经营许可证(北京)京B1.B2-20070037

信息网络传播视听节目许可证0104056号  互联网新闻信息服务许可证11120180003号  广播电视节目制作经营许可证18136号  网络出版服务许可证284号  新出网证(京)字013号

京公网安备 11010102007881号  京ICP备10003822号-1  京ICP证000032号

京ICP证000032号 北京互联网举报中心 不良信息举报中心 无障碍
分享到:
QQ空间 新浪微博 微信 腾讯微博 QQ好友 百度首页 腾讯朋友 有道云笔记