Token导航 LogoToken导航TokenDH.com

AI 视频最难控制的站位镜头,这次终于有解了

更新时间 2026-06-02来源 AIGC新知正文 3735字阅读约 12分钟20 张图片
 该图片疑似使用了AI生成技术,请谨慎甄别图片

hi,大家好我是绛烨。

大家还记得之前全网爆火的短剧《Enemy》嘛?

包括我在内,身边很多朋友都沉浸在它的枪战、无限流规则和宿敌 CP 的宿命感里。最让我印象深的,其实不只是剧情反转,而是它的镜头调度。

我后来刷到过导演的分镜手稿,请看VCR。

画面看起来很潦草,人物只是几个简单线条,场景也没有精细到哪里去。但真正厉害的地方在于,导演已经把角色站位、镜头角度、人物关系和情绪方向都提前想清楚了。

如果放到真实拍摄里很好理解,一场两个人的对手戏,其实还是在一个场景里面拍摄的,演员站位以及拍摄角度,这些都不是临场瞎拍出来的。

具体来说,专业导演们想的是整个空间里面怎么把他们的能力发挥好。

专业执行导演想的是更加全局的拍摄,比如场景、角色等等,角色在哪,机位在哪,运动方向在哪,视觉重心在哪,情绪压力从哪里来。

因为不同站位会改变关系,不同运镜会改变情绪,高级拍摄手法往往决定了这部作品的观看舒适度。

比如下面这些,一个看似简单的镜头,背后其实都是执行导演的调度在发挥作用。

图片

回到主题,如果让现在的AI来生成这样一个视频,一句提示词我觉得完全不能够描述清楚这种复杂场景,这种抽卡形式的内容,耗费的还是算力和时间。

这类问题,靠文字真的很难讲清楚。

因为空间关系、人物站位、镜头角度,本来就不是一句提示词能稳定表达的东西。导演脑子里有画面,AI 却只能根据文字去猜,猜对可能一两次,猜错了就得重新抽卡。

所以这次 LibTV ( http://www.liblib.tv/ )新上线的导演台,帮助导演们解决了这样一个难题。

这也是我这次体验 LibTV 导演台之后,感受最明显的一点:

AI 视频创作终于可以从提示词抽卡走向专业创作了。

关于导演台怎么操作,可以看我录制的演示视频,覆盖路径:

导演台怎么用?

简单理解,它是 LibTV 画布里的一个轻量级 3D 构图节点。

不要求你会 Blender,也不要求你会专业三维软件,更不需要你从零建模。

你只需要像摆积木一样,把角色、基础模型、群众阵列、场景元素放进 3D 空间里,然后调整位置、角度和大小。

它解决的是 AI 视频里最难稳定的三个问题:空间关系、人物站位、镜头角度。

具体操作如下,

首先在libtv里面新建一个画布,双击画布,可以看到有一个「导演台」的按钮,选择它。

图片

然后会有一个节点弹出来,选择「打开导演台」。

图片

可以看到我们加入到了接下来会经常使用的3d导演台,包含了导演视角和机位视角,可以切换,以「导演视角」为例,可以看到这个角色目前的站位。

导演视角更像你站在片场看全局,可以看到角色、场景、机位之间的位置关系。机位视角更像摄像机看到的画面,可以用来确认最终生成时的构图。

在机位视角下,架设好固定机位之后,就可以调整角色的动作。

左侧栏是当前 3D 空间里所有元素的清单,可以删除、重命名、打组、隐藏。右侧栏是对象属性,可以管理角色、基础模型、摄像机等内容。

图片

导演视角下,会从多个机位来看角色的站位,当然可以不断调整不同机位的角度。

图片

在导演台里,你可以添加人体素模、基础几何模型、群众阵列,也可以上传本地模型或素材。添加之后,支持移动、旋转、缩放三种基础操作。移动负责站位,旋转负责朝向,缩放负责体积和空间比例。

在选中角色之后,可以自定义设置角色的姿势,

比如站姿、半蹲、对峙、回头、行进、观察等动作,都可以先在 3D 空间里定下来。

在短剧、仙侠、游戏 PV、二次元分镜、广告片都很有用。因为很多时候,AI 生成视频翻车并不是画风问题,而是人物动作和人物关系错了。

图片

你可以在导演视角里自由调整观察角度,也可以切到机位视角看最终画面。

位设好之后,直接截图,截图会回到 LibTV 画布,作为 AI 图像或视频生成的参考图。

如下图,就可以根据角色站位图和参考图,生成角色在不同机位下面不同姿势的图片。

图片

这套流程的核心,是先把内容创作者所构想的空间立体站位固定住,再让 AI 按照这个参考去生成,从而避免了AI去瞎猜。

使用场景

我这次重点从我现在看到的一些视频里面,试了几个场景。

第一个场景,是两个人的对手戏。

这是 现在AI 视频里最常见的镜头,但是做好也不容易。

比如《Enemy》里面宿敌 CP 的高光场面,年轻女性站在前景左侧,中年男性站在中景右侧,两人面对面交谈。镜头从女性肩后拍过去,男性处在半身近景,背景是有光源的室内空间。

图片

如果只靠提示词,模型很容易把两个人的站位搞乱,而且很难确定究竟从哪个角度去拍摄更好,真的一两句话说不清楚。肩后视角、前景遮挡、对视关系,这些都是文字里很难稳定传达的东西。

用导演台之后,确实顺畅了很多。

我先添加两个人体素模,一个放在前景左侧,一个放在中景右侧。然后调整角色朝向,让两个人真正面对面。接着把摄像机放到女性肩后的位置,

图片

切到导演视角看预览,确认构图没问题之后截图,发送到画布生成。

图片

到这一步,AI 现在不需要凭空猜具体的这个怎么描述,也不用重新理解两个人的关系。它直接通过参考图就可以看到了人物关系和机位关系。

第二个场景,科幻战术小队突入。

这个场景适合测试队形、遮挡和镜头运动感。

设定可以是四名特种兵在走廊里行动,前方一人半蹲持枪,后方两人贴墙掩护,最后一人站在队尾观察后方。镜头从走廊低角度拍过去,前景有墙体遮挡,整体是一段科幻动作片的典型战术走位。

图片

如果靠提示词的话,我很难描述这个四个人的位置是怎么样的,无法非常精确,对于我来说,画图最直接明确,AI也是一样。

在导演台里,我先用几何模型搭出背景墙。然后放四个人体素模,分别设置不同位置和朝向。前方角色靠近画面中心,后方角色贴近墙面,队尾角色稍微回头。

图片

这个机位镜头搞定之后,会比纯文字提示更有现场感,模型看到在走廊空间里每个素模都有个自己的站位姿势。

这里我还用了一个更细的方式:

先给每个角色一个单独的标准设定图,再用导演台站位图告诉模型每个人该出现在哪里。

扁平插画,特种部队士兵,站姿,战术服+头盔+战术背心,手持步枪举至肩侧待命,表情严肃,背景透明,无阴影,军事教学风格。

整体画面的提示词:

    参考图片1的人物站位和姿势,生成分镜图,其中图片2是每个角色的标准建模,图片3是背景,图1其中蓝色人偶角色a是待命 / 换弹匣姿势,特种部队士兵,站姿,战术服+头盔+战术背心,手持步枪举至肩侧待命,表情严肃,教学风格;角色b是掩护推进姿势,行进站姿,战术服+头盔+战术背心,手持步枪,一只手搭在前方队友肩上传递掩护信号;角色c是点射姿势,站姿射击,战术服+头盔+战术背心,双手持枪瞄准前方,处于点射状态;角色d是跪姿全自动射击姿势,特种部队士兵,单膝跪地射击姿势,战术服+头盔+战术背心,双手持枪瞄准前方,处于全自动射击状态。
    图片

    这个 case 适合导演台对多角色、复杂站位这种动作戏的帮助。

    图片

    导演台里面先把这种多个角色的站位固定住,后面生成的东西就会更可控。

    第三个场景,是武侠镜头多机位分镜。

    我经常会看一些动漫,里面其实有各种场景下的戏份,比如什么时候应该机位切到主角,什么时候又应该切到其他配角甚至全景这块,对场景一致性和角色一致性要求非常高,所以现在很多高精度的视频还是需要专业的制作软件。

    但是我觉得导演台的思路现在简单很多,我只需要先把场景搭好,这里用到libtv的多机位分镜和720全景图功能。

    然后根据不同机位来生成参考图,就可以非常快速解决这个问题。

    场景提示词:

      国风武侠场景,深山幽谷中的林间古道,苍劲古松林立,青石板路蜿蜒向前,旁有石亭、断剑、老旧木剑架,山间云雾缭绕,飞檐古亭隐于林木之间,晨光穿透林间形成柔光,溪水潺潺,山石错落,中式山水意境,氛围清幽肃静,江湖气韵,8K,超高细节,电影级光影,纯场景无人物,横版游戏背景,古风原画。

      然后把这张场景图结合 720° 全景能力处理成可多角度预览的空间背景,再放进导演台里作为场景参考。

      图片

      这两个仙侠角色对峙,一个站在前景,

      图片

      一个站在中景,其他背景的位置也先摆好。然后在同一个 3D 空间里设置不同机位。

      图片

      这样一来,人物位置和空间关系都不用反复解释,你只是换了摄像机角度。

      这就很像真实拍摄,演员和场景不变,导演只是在调换机位、换拍摄手法,也就是执行导演的活了。

      这也是我觉得多机位最有价值的地方,它让 AI 视频不再是一张张孤立的画面,而是开始有了连续镜头的基础。

      成片展示如下:

      除了导演台,这次我也顺手体验了 LibTV 画布里的其他能力。
      真正做 AI 视频时,流程往往不是生成一张图就结束,而是要继续做场景、分镜、合成和素材处理。
      比如武侠多机位场景里,我先用 720° 全景把普通场景图变成可多角度预览的空间背景,再放进导演台里摆人物、设机位。这样远景、近景、侧面、俯视这些镜头都能围绕同一个空间展开,画面统一性会更好。
      图片
      多机位截图出来后,还可以放进分镜组里自动排列成宫格,一键导出带序号的 4K 分镜图。镜头多的时候,这个功能很实用,既方便自己理清顺序,也方便团队沟通。
      到了视频阶段,LibTV 画布里还能继续做多轨道合成和变速,比如把远景、近景、侧面镜头拼成一段完整节奏,或者做画中画、三分屏对比。如果素材里有不想要的字幕,也可以继续用字幕擦除处理。
      图片
      导演台负责构图和机位,720° 全景负责空间背景,分镜组负责整理镜头,多轨道、变速和字幕擦除负责后期处理。连起来看,它更像一条完整的 AI 视频创作工作流。
      文章标签AI资讯
      资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

      继续浏览更多资讯

      返回资讯目录

      相关资讯

      更多