
hi,大家好我是绛烨。
大家还记得之前全网爆火的短剧《Enemy》嘛?
包括我在内,身边很多朋友都沉浸在它的枪战、无限流规则和宿敌 CP 的宿命感里。最让我印象深的,其实不只是剧情反转,而是它的镜头调度。
我后来刷到过导演的分镜手稿,请看VCR。
画面看起来很潦草,人物只是几个简单线条,场景也没有精细到哪里去。但真正厉害的地方在于,导演已经把角色站位、镜头角度、人物关系和情绪方向都提前想清楚了。
如果放到真实拍摄里很好理解,一场两个人的对手戏,其实还是在一个场景里面拍摄的,演员站位以及拍摄角度,这些都不是临场瞎拍出来的。
具体来说,专业导演们想的是整个空间里面怎么把他们的能力发挥好。
专业执行导演想的是更加全局的拍摄,比如场景、角色等等,角色在哪,机位在哪,运动方向在哪,视觉重心在哪,情绪压力从哪里来。
因为不同站位会改变关系,不同运镜会改变情绪,高级拍摄手法往往决定了这部作品的观看舒适度。
比如下面这些,一个看似简单的镜头,背后其实都是执行导演的调度在发挥作用。

回到主题,如果让现在的AI来生成这样一个视频,一句提示词我觉得完全不能够描述清楚这种复杂场景,这种抽卡形式的内容,耗费的还是算力和时间。
这类问题,靠文字真的很难讲清楚。
因为空间关系、人物站位、镜头角度,本来就不是一句提示词能稳定表达的东西。导演脑子里有画面,AI 却只能根据文字去猜,猜对可能一两次,猜错了就得重新抽卡。
所以这次 LibTV ( http://www.liblib.tv/ )新上线的导演台,帮助导演们解决了这样一个难题。
这也是我这次体验 LibTV 导演台之后,感受最明显的一点:
AI 视频创作终于可以从提示词抽卡走向专业创作了。
关于导演台怎么操作,可以看我录制的演示视频,覆盖路径:
导演台怎么用?
简单理解,它是 LibTV 画布里的一个轻量级 3D 构图节点。
不要求你会 Blender,也不要求你会专业三维软件,更不需要你从零建模。
你只需要像摆积木一样,把角色、基础模型、群众阵列、场景元素放进 3D 空间里,然后调整位置、角度和大小。
它解决的是 AI 视频里最难稳定的三个问题:空间关系、人物站位、镜头角度。
具体操作如下,
首先在libtv里面新建一个画布,双击画布,可以看到有一个「导演台」的按钮,选择它。

然后会有一个节点弹出来,选择「打开导演台」。

可以看到我们加入到了接下来会经常使用的3d导演台,包含了导演视角和机位视角,可以切换,以「导演视角」为例,可以看到这个角色目前的站位。
导演视角更像你站在片场看全局,可以看到角色、场景、机位之间的位置关系。机位视角更像摄像机看到的画面,可以用来确认最终生成时的构图。
在机位视角下,架设好固定机位之后,就可以调整角色的动作。
左侧栏是当前 3D 空间里所有元素的清单,可以删除、重命名、打组、隐藏。右侧栏是对象属性,可以管理角色、基础模型、摄像机等内容。

导演视角下,会从多个机位来看角色的站位,当然可以不断调整不同机位的角度。

在导演台里,你可以添加人体素模、基础几何模型、群众阵列,也可以上传本地模型或素材。添加之后,支持移动、旋转、缩放三种基础操作。移动负责站位,旋转负责朝向,缩放负责体积和空间比例。
在选中角色之后,可以自定义设置角色的姿势,
比如站姿、半蹲、对峙、回头、行进、观察等动作,都可以先在 3D 空间里定下来。
在短剧、仙侠、游戏 PV、二次元分镜、广告片都很有用。因为很多时候,AI 生成视频翻车并不是画风问题,而是人物动作和人物关系错了。

你可以在导演视角里自由调整观察角度,也可以切到机位视角看最终画面。
位设好之后,直接截图,截图会回到 LibTV 画布,作为 AI 图像或视频生成的参考图。
如下图,就可以根据角色站位图和参考图,生成角色在不同机位下面不同姿势的图片。

这套流程的核心,是先把内容创作者所构想的空间立体站位固定住,再让 AI 按照这个参考去生成,从而避免了AI去瞎猜。
使用场景
我这次重点从我现在看到的一些视频里面,试了几个场景。
第一个场景,是两个人的对手戏。
这是 现在AI 视频里最常见的镜头,但是做好也不容易。
比如《Enemy》里面宿敌 CP 的高光场面,年轻女性站在前景左侧,中年男性站在中景右侧,两人面对面交谈。镜头从女性肩后拍过去,男性处在半身近景,背景是有光源的室内空间。

如果只靠提示词,模型很容易把两个人的站位搞乱,而且很难确定究竟从哪个角度去拍摄更好,真的一两句话说不清楚。肩后视角、前景遮挡、对视关系,这些都是文字里很难稳定传达的东西。
用导演台之后,确实顺畅了很多。
我先添加两个人体素模,一个放在前景左侧,一个放在中景右侧。然后调整角色朝向,让两个人真正面对面。接着把摄像机放到女性肩后的位置,

切到导演视角看预览,确认构图没问题之后截图,发送到画布生成。

到这一步,AI 现在不需要凭空猜具体的这个怎么描述,也不用重新理解两个人的关系。它直接通过参考图就可以看到了人物关系和机位关系。
第二个场景,科幻战术小队突入。
这个场景适合测试队形、遮挡和镜头运动感。
设定可以是四名特种兵在走廊里行动,前方一人半蹲持枪,后方两人贴墙掩护,最后一人站在队尾观察后方。镜头从走廊低角度拍过去,前景有墙体遮挡,整体是一段科幻动作片的典型战术走位。

如果靠提示词的话,我很难描述这个四个人的位置是怎么样的,无法非常精确,对于我来说,画图最直接明确,AI也是一样。
在导演台里,我先用几何模型搭出背景墙。然后放四个人体素模,分别设置不同位置和朝向。前方角色靠近画面中心,后方角色贴近墙面,队尾角色稍微回头。

这个机位镜头搞定之后,会比纯文字提示更有现场感,模型看到在走廊空间里每个素模都有个自己的站位姿势。
这里我还用了一个更细的方式:
先给每个角色一个单独的标准设定图,再用导演台站位图告诉模型每个人该出现在哪里。
扁平插画,特种部队士兵,站姿,战术服+头盔+战术背心,手持步枪举至肩侧待命,表情严肃,背景透明,无阴影,军事教学风格。
整体画面的提示词:
参考图片1的人物站位和姿势,生成分镜图,其中图片2是每个角色的标准建模,图片3是背景,图1其中蓝色人偶角色a是待命 / 换弹匣姿势,特种部队士兵,站姿,战术服+头盔+战术背心,手持步枪举至肩侧待命,表情严肃,教学风格;角色b是掩护推进姿势,行进站姿,战术服+头盔+战术背心,手持步枪,一只手搭在前方队友肩上传递掩护信号;角色c是点射姿势,站姿射击,战术服+头盔+战术背心,双手持枪瞄准前方,处于点射状态;角色d是跪姿全自动射击姿势,特种部队士兵,单膝跪地射击姿势,战术服+头盔+战术背心,双手持枪瞄准前方,处于全自动射击状态。
这个 case 适合导演台对多角色、复杂站位这种动作戏的帮助。

导演台里面先把这种多个角色的站位固定住,后面生成的东西就会更可控。
第三个场景,是武侠镜头多机位分镜。
我经常会看一些动漫,里面其实有各种场景下的戏份,比如什么时候应该机位切到主角,什么时候又应该切到其他配角甚至全景这块,对场景一致性和角色一致性要求非常高,所以现在很多高精度的视频还是需要专业的制作软件。
但是我觉得导演台的思路现在简单很多,我只需要先把场景搭好,这里用到libtv的多机位分镜和720全景图功能。
然后根据不同机位来生成参考图,就可以非常快速解决这个问题。
场景提示词:
国风武侠场景,深山幽谷中的林间古道,苍劲古松林立,青石板路蜿蜒向前,旁有石亭、断剑、老旧木剑架,山间云雾缭绕,飞檐古亭隐于林木之间,晨光穿透林间形成柔光,溪水潺潺,山石错落,中式山水意境,氛围清幽肃静,江湖气韵,8K,超高细节,电影级光影,纯场景无人物,横版游戏背景,古风原画。然后把这张场景图结合 720° 全景能力处理成可多角度预览的空间背景,再放进导演台里作为场景参考。

这两个仙侠角色对峙,一个站在前景,

一个站在中景,其他背景的位置也先摆好。然后在同一个 3D 空间里设置不同机位。

这样一来,人物位置和空间关系都不用反复解释,你只是换了摄像机角度。
这就很像真实拍摄,演员和场景不变,导演只是在调换机位、换拍摄手法,也就是执行导演的活了。
这也是我觉得多机位最有价值的地方,它让 AI 视频不再是一张张孤立的画面,而是开始有了连续镜头的基础。
成片展示如下:









