大家好,我是冷逸。
AI 视频创作的门槛,真的要彻底降为 0 了。
给大家看一下我用 LibTV Agent + Skill,10分钟全自动生成的王家卫风格的电影短片。
不光是王家卫的电影风格,还有这个岩井俊二风格的校园 MV 也是被我轻松拿捏。
大家觉得,这两支短片的效果怎么样?
照以前的做法,这两段视频背后,至少得手动创建两套特别复杂的画布,才能把人物、场景、叙事控制好,就像这样。

但这次,画布里没有任何一个节点是我手动创建的。
我只进行了简单的对话,建节点、连线、填提示词、生成资产和最终合成,都由右侧的 Agent 在画布里继续往下跑。
这也是 LibTV 这次更新最让我兴奋的地方:Agent 终于进了视频画布。
下面拆开给大家看,它到底是怎么把片子做完的。

一手测评
1)Agent 进了画布,MV 是这么跑出来的
这次 LibTV 更新了之后,新建一个空白画布,右侧直接就是 Agent。以前要在画布里完成的所有操作,现在可以直接在这里完成。

输入框下方有一个 Skill 入口。打开 Skill ,我们可以看到各种官方已经准备好的 Skill 列表,点击右上角“全部”。

然后,你就会发现打开了一个新世界的大门。

这是官方提供的 Skill 广场,专业影视、商业广告、短剧漫剧、动漫游戏等,都已经帮你做好了分类。
从此以后你想做任何类型的视频,都可以在这里直接找到对应的 Skill 了。
比如,我们随便打开一个 Skill。

你会发现,详情页里会展示这个 Skill 的成品视频样片。并且会写清楚这个 Skill 适合拍什么、需要哪些素材,以及最后会交付什么。
更实用的是,有的 Skill 左上角还会有一个“创作详情”的按钮。

点进去以后,官方样片背后的角色图、场景、分段视频、BGM、字幕和合成节点,全都能看到。

所以今后,在这里调用任何一个 Skill 之前,都可以先看看它究竟打算怎么拍。
以这个夏日MV为例,我选的是“岩井俊二电影美学” Skill。

我在Agent对话框内,选择了这个Skill,然后上传了一首我用 AI 生成的《夏日课桌》的音乐。没有给他非常详细的描述和限制,直接一句话让他帮我生成一个MV,看看会发生什么。

任务提交后,它并没有急着直接生视频。而是把他不确定的信息向我进行了提问。

问题包括时长、执行模式、画幅、语言字幕、核心元素、故事大纲等等他的不确定因素。

依次回复之后。接下来,它就开启了全自动模式。
它先分析音频,再生成故事大纲、moodboard、男女主角模卡、教室与走廊场景图,最后写入锚点清单和分镜表。
这些都准备好以后,Agent 就开始自动生成视频了。

也就刷会儿短视频的功夫,画布上已经创建了非常丰富的节点和元素了。
等到所有的视频片段生成完毕。接着,Agent 就会自己生成一个合成节点,把所有生成好的视频素材自动剪辑合成好,发布到画布上,得到最终文章开头的那个 MV。

这么一通操作下来,最省心的地方,是我完全不需要再去画布里逐个创建和连接节点、添加素材、编写提示词等等了。审美预设、资产准备、视频生成和最终合成,都由 Agent 自己接着往下做。
2)一个 Skill,背后是一套完整的拍法
如果说《夏日课桌》的任务相对简单。那接下来,我给 LibTV Agent 上了一个更有挑战的任务,看看它能不能独立完成专业影视级别的电影片段。
大家在文章开头看到的那个,王家卫风格的电影,就是这个 Skill 做的。

点击右上角的按钮:添加 Skill ,就可以直接使用了。
我依然只输入了一句话:
请帮我制作一部王家卫风格的电影。
Skill 加载完成后,依然是先通过问题向我把需求补齐。
剧本从哪里来、有没有角色参考、要不要内心独白、字幕用什么语言、分辨率、画幅、成片时长,一项一项跟我确认。

我选的是:让 Agent 根据一句话扩写故事、没有人脸参考、内心独白跟随剧本、简体中文字幕、720P、16:9、45 秒,分成 3 段。
然后,它又继续追问了故事想法和主角设定。我只确定了亚洲男性,故事仍然让它自己写。
最后,Agent 给出了一版名为《过期》的故事概念,并且把故事分成了3段15s的剧情:深夜便利店、雨夜街巷电话亭、逼仄公寓楼梯间。

然后向我确认,觉得如何?
我是觉得挺不错,就这个了,开拍吧!
接着,Agent 自己创作并保存了锚点清单和分镜表。


角色也不是随便抽一张。它先给了 4 套男主造型,我选了“皮夹克、乱发、墨镜”的这个。

然后他再自己生成了男主的三视图。

三视图的锚点确认了之后,又同时生成了 3 个场景的影调图。每个各出了 4 张,并让我逐一选择确认。

所有的场景锚点确认后,agent又继续帮我生成了完整的3段分镜表。

所有资产确认后,就开始自动生成每一段视频了,别看那么多步骤,其实整个过程执行的非常快。
只有在有需要你抉择的地方,它才会停下来等你确认。

三段全部确认后,Agent 又自己生成了 BGM,分别给 3 段加上简体中文字幕,最后合成为一支 45 秒、1280×720、16:9 的电影成片。

项目跑完以后,我又切了一遍“故事板”和“工作流”。

《过期》故事板视图
故事板会把文本、图片和视频分区摆好,锚点、分镜、角色参考和最终成片可以集中查看。

《过期》工作流视图
工作流更适合回到具体节点,定位是哪一段、哪张图出了问题。
从一句话到剧本、角色、场景、三段视频、BGM、字幕和成片,这些任务都由 Agent 在同一条工作流里继续往下调度。
再看一遍最终效果吧。
说实话,我挺满意的。冷暖撞色、雨夜霓虹、逼仄空间和人物状态,都真正落到了成片里,王家卫的味道很明显。
45 秒电影可以靠 Agent 自己执行全流程到这个程序,我已经觉得很不错了。
3)自己的方法,也能装进 Agent
官方 Skill 是别人整理好的拍法。那自己的方法,能不能也放进去呢?
lengyi-shotlist 是我之前在 GitHub 上开源的一套分镜 Skill。
而这次 LibTV 不仅支持把对话过程直接转为 Skill ,还支持创建自定义 Skill,我试着把这套分镜方法装了进去。
只需要在 Agent 对话窗口点击 Skill。

再点击右上角的创建按钮,创建自定义 Skill。

在创建页,填好必要的名称、简介和使用场景等,再把 SKILL.md 放进去就行。

点击保存后,它会出现在“我的 Skill”里。
这里有个小细节:在 LibTV Agent 里,创建的 Skill 名称是有长度 12 个字限制的,所以像我的 lengyi-shotlist 这种偏长的英文名字,就会写不下。建议大家直接写上中文名称就行,也更方便后续在库里调用和查找。

回到项目画布,点开 Agent 右下角的 Skill,在“我的”里就能找到它。

到这里,只是装好了。它能不能真按这套方法出片呢,要看下面的实测。
这次我选了一个很小的亲情故事。
《未接来电》
深夜办公室,一个 28 岁的女策划在赶方案。妈妈连续打来两次电话,她都按掉了。凌晨下班后,她站在公司门口回拨,没人接。过了一会儿,手机收到一条语音:“没事,就是想听听你的声音。”
我选中刚建好的 Skill,把剧情、比例、时长和风格一次写清楚。

Agent 先提取了 6 个叙事节拍,然后把剧情拆成了 9 个分镜。接着建立了 4 个锚点:女主、深夜办公室、凌晨公司走廊,以及手机来电界面。
它同时生成了两份文件。一份是锚点清单,记录每个主体对应的资产节点;另一份是分镜表,写清楚 9 个镜头的时间、内容、景别和引用资产。


《未接来电》9镜分镜表
这一步我觉得很重要。
Agent 没有急着给我一张看起来很厉害的图。它先把后面容易漂的东西钉住了。女主固定成齐耳短发、灰色针织毛衣、黑色长裤;办公室固定冷白荧光灯和屏幕蓝光;走廊则换成凌晨的昏黄灯光。
接下来,它把 9 镜分成两批。先并行生成 S1 到 S5,前 5 镜全部完成后,又自动接着生成 S6 到 S9。

前 5 镜成功后自动生成后 4 镜
4)做完以后,继续用嘴改
9 个分镜一次性跑通了,但因为我在skill里设定了时间只有 8-15s,所以在实际的剧情里,有的台词和过渡被 Agent 自动帮我剪辑掉了。
于是,我又根据叙事节奏,让 Agent 帮我重新调整了每个片段的时长。

最终得到了一支 40 秒版本的短片。成片如下:







