Token导航 LogoToken导航

造梦次元AI主播紫樱中秋直播首秀

更新时间 2026-09-30来源 游戏陀螺正文 3648字阅读约 12分钟13 张图片
图片

最强实时互动模型迎来了直播首秀。

中秋节期间,陀螺君偶然刷到一场直播。造梦次元的 AI 主播紫樱,正在挑战一项限时营业任务。她要在规定时间里完成目标,没完成就会再来一轮。

把AI主播放进直播间,在过去几年并不算稀奇,AI新闻主播,AI带货主播,市面上基本都有。

但这场直播有点不一样。紫樱没有一套能从头走到尾的固定流程。

观众可以点歌、投票选造型、送礼物,也能随时提新要求。紫樱得根据这些变化继续互动、换装和表演。中途被打断后,她还得把前面的内容接回来。

一开始,很多人就是来看热闹的。大家想试试AI 主播能不能接住弹幕,会不会卡住,营业任务到底能不能完成。

结果,一场直播下来,不少观众被紫樱圈了粉。当天,直播间一度涌进 2 万人。

 该图片疑似使用了AI生成技术,请谨慎甄别图片

这场直播的看点,除了看AI 主播能不能完成挑战之外,海量信息、场景变化和人物动作的同时涌入,更像一次针对背后 AI 能力的压力测试,考验紫樱背后的实时互动模型能不能撑住。

对不同领域的从业者来说,这场直播也提供了一个新方向。如果 AI 直播能处理这么多信息,并逐一应对,放到自己的业务里,又能解决哪些痛点,带来哪些新的想象空间?

第一次被AI主播圈粉

看完直播后,我最直接的感受是“AI 已经能做到如此地步了?”

这场直播最难的地方在于,没有固定流程,观众送什么礼物,都可能打断当下的互动。

这也让我感到震惊的点,就比如有人投喂后,她手里随即多出一个甜甜圈。她低头咬了一口,甜甜圈上也跟着少了一块,再抬头继续和弹幕说话,整个过程看着很自然。

图片

另一次互动里,屏幕落下烟花礼物特效,画面切进红色舞台,她开始跳舞。一段舞结束后,她又回到原来的直播间继续聊天。

 该图片疑似使用了AI生成技术,请谨慎甄别图片

之所以说紫樱像真人而不是AI,还有一个原因。在互动上,她的AI感也没有那么足,聊天有自己的节奏。

比如晚上 11 点多有观众进来,她甚至会调侃“大家一到中秋节放假,是真不睡啊。”

此外,尽管是营业挑战,但并不是我们想象中的直播PK那样,主播想方设法让观众刷礼物。有人送礼,她反而会劝对方别再送了,说“上班那么辛苦,对自己好一点”。

图片

能看到,包括聊天互动、切场景、礼物特效和唱歌这些都会同时发生,但AI主播能自己调整这些事情的先后顺序,让整个流程不会出现割裂感,看起来非常像是真人主播。

这让我开始好奇,紫樱背后的实时互动是怎么实现的。

支撑她这些表现的,是前不久发布的Vidu S2。简单来说,它支持数字人实时互动,也能在视频播放过程中,修改画面的风格、服装、人物和背景,为直播、虚拟演绎和互动内容提供了新的解法。

实际上,从 Vidu S2 问世后,市面上已经有了不少合作案例,除了造梦次元的紫樱,还有创梦天地的《地铁跑酷》闪闪直播,以及最让网友们喜爱的,Vidu S2模型助力360移动产品中心落地的H5《甄嬛360传》粉丝见面会。

我们从中也多少能窥见Vidu S2的逆天能力。

比如,你让大胖橘展示宝剑,他会给你进行展示,说话和气,却仍然带着几分威严;

再去和华妃互动,她也会答应你的要求,但言语和神态里仍有那股骄横劲儿。

其他角色也类似,动作自然、说话和反应都贴合各自的性格,真的有种让人和影视角色日常视频通话的感觉。

当有了实时回复和画面动态变化,观众所感受到的就是更深层次的互动,也更容易感受真人才具有的陪伴感。更重要的,观众参与的方式也被改写了,仿佛屏幕里的人物就是融合了智能的真人,时刻影响着我们的情绪。

这也让我更想知道,把它用到日常聊天、工作和内容创作里,体验到底怎么样。

和AI数字人聊天,也有了面对面的感觉

Vidu S2主要分为Avatar和Editing两块,目前都能体验。

在Avatar里,可以直接选用平台提供的角色,开启麦克风和摄像头权限后,就能开始对话。 

图片

目前,不少平台都结合Vidu S2的能力,就比如 AI 原生互动内容平台 ReelFork。用户可以进入角色和故事,通过互动改变内容发展,衍生出短剧、文游、游戏等不同形态。创建了可以互动的角色,玩起来也是相当有意思。

拿平台里的二次元虚拟偶像来说,看到角色嘴上傲娇、却还是照做的模样,互动时都忍不住咧嘴笑。 

还有,谁不想和外星人对谈,复刻一场《银翼杀手》那样的深度对话呢?

Avatar还有一种玩法,就是自己创建角色。用户可以上传真人照片、动漫图片或萌宠图片,再简单补充人物设定、行为特征等描述,这些内容都会体现在对话中。整个过程不需要自己预训练模型,就能快速生成一个专属数字人。

这次我选择创建的是《咒术回战》中的人气角色五条悟。

创建时,我先上传了一张五条悟的参考图,再补充他的性格、说话方式和《咒术回战》的背景设定。为了让声音也更接近角色,我还找了一段五条悟的音频,让模型学习他的声线。

我不想做出一个只是拥有五条悟外形的数字人,更想看到的是,他能带着五条悟的性格、说话方式和经历来回答问题,而不是一个只能笼统回答的普通的 AI 助手。

在聊天之前,我先和数字五条悟互动了一番,让他做出了双手合十、比心等动作。即使上传的参考图没有完整露出手部,模型也能补出双手,完成对应动作。 

 该图片疑似使用了AI生成技术,请谨慎甄别图片

实际聊下来,他的回应基本没有脱离原本的经历和设定,角色的身份感也保持得相当稳。

我问他:“怎么看待自己在新宿大战中输给宿傩。”

从回答来看,除了没用日语,其他表达都很接近动漫里的状态。尤其是那句“我可是最强的”,就很符合五条悟的人设。

这一套体验下来,确实有了几分“真实感”,恍惚间还真觉得自己在和动漫角色对话。

 该视频使用了AI生成技术

另外,我还尝试了一下 Editing。

以前录一段视频,想换件衣服、换个背景,通常得先录完,再去剪辑软件里抠图、调色、合成。在 Editing 里,摄像头开着,这些事就能直接做。简单来说,就是把一部分原本拍完才做的后期,挪到了拍摄过程中。

比如,打开摄像头后,可以用预设效果换人物、改画风或换背景,也可以自己上传参考图,换成想要的人物、画风和场景。

图片
图片来源:Vidu官网
图片

图片来源:Vidu官网

甚至,上传一张清晰的服装图,还能实现实时换装。 

图片

图片来源:Vidu官网

整个过程中,人物说话、转身时,脸部状态能保持住。衣服也会随着抬手、转身等动作改变褶皱和轮廓,和人物的动作能对上。

图片

图片来源:Vidu官网

把这些功能放到日常生活里,也有不少有趣的玩法。

比如录一段生日祝福,给自己换身装扮,配上相应的背景;拍视频时拿不准哪种画风合适,也可以边拍边换,直接看效果。

再加上前面体验的Avatar,能想到的场景就更多了。加班时找个数字角色陪自己聊几句,休息时聊聊八卦,或者共享屏幕,一边看剧一边讨论剧情。对我来说,这些随时能用上的小事,也挺有吸引力。

最直观的作用,自然是直播间这样的场景。以前做特效背景,要准备素材、抠图和后期合成,画面还容易显得不在一个图层。实时换装这些技术要求则更高。Editing把这些调整放到了直播过程中,用更低的成本实现了这些可能,并且做的更好。

它让我看到的,是 AI 视频向前发展的另一个方向。把原本留到后期的视频调整提前到拍摄过程中,从源头解决创作中的实际问题,也给直播和内容创作带来了更多想象空间。

AI数字人,走入更多场景

看这场直播期间我就想,如果放到游戏或别的场景中,会改变什么。

不难想象,Vidu S2的技术对不同行业都可能是一次冲击。无论是直播、电商、虚拟偶像、AI 陪伴产品还是互动短剧,都需要角色根据现场变化调整对话和状态。

作为最强实时互动模型驱动的首个AI美女主播紫樱,让这次的直播成为了一个可以观察的样本。虚拟主播和 AI 陪伴产品,可以通过记住前面的互动、不断调整互动方式,实现用户想要的陪伴;电商带货能依托 Editing 的能力快速换装,更快展示商品,及时接住用户的提问。

那么在游戏领域呢?

从 AI 出来以后,游戏行业聊得最多的就是 NPC。我们以前见到那些有活人感的 NPC,背后其实都堆了大量文本。AI NPC 则预设了更多行动模式,能处理更多互动,只是玩下来,总觉得还差一点。

看完这场直播,至少可以往两个方向想。NPC 可以回答玩家不同的对话和提问。面对玩家不同的状态和聊天次数,NPC 也可以记住,再根据玩家的状态调整自己的回答方式。

图片

Vidu S2 的 Avatar 本身也把游戏 NPC 列为应用场景,支持角色图、人设和用户音视频等输入,再输出实时音视频流。NPC 听懂玩家以后,反应也能落到表情和动作上。游戏角色从固定台词走向实时互动,已经有了更具体的做法。

图片

角色养成和互动陪伴也是这样。角色有自己的性格,和不同玩家聊出来的内容也会不同。她记得你前面说过什么,记得你在剧情里做过什么选择,玩家也会得到更多独属于自己的情感体验。

再如,现在不少游戏都在尝试角色IP化,先通过视频、剧集丰富角色形象,等时机成熟,再做一场线上直播,让角色近距离与玩家互动。这些想法已经有了实现的可能,也值得尝试一番。

对观众和体验者来说,这是一段专属的互动。对行业来说,紫樱这场直播给了从业者一个具体的参考,也能据此判断,自己的哪些想法可以实现。

文章标签AI产品
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多