Token导航 LogoToken导航TokenDH.com

终于有连载的AI短剧工具!Flova agent+资产库,一集封神

更新时间 2026-07-17来源 AIGC新知正文 5333字阅读约 17分钟14 张图片

"

Flova 想做的不是替你抽一次卡, 而是陪你把一个项目继续做下去 。

—— 绛烨

Hi,大家好我是绛烨。

最近 AI 短剧越来越卷了。

画面越来越精致,动作也越来越自然,但真让你做一个「第二集」,问题马上就来了。

女主换脸了。制服变色了。上一集还是冷白灯的地铁站,下一集突然像换了一个摄影棚。

第一集靠抽卡还能撞到几个好镜头,想连续做下去,光靠运气肯定不行。

所以这次我没有只测试「一句话能不能生成视频」。

我给自己出了一个更麻烦的题:做一部可以继续连载的 30 秒 AI 短剧。

第一集叫《凌晨两点的失物招领处》。

女主林夏是夜班地铁工作人员。她在一个没有登记记录的黑色书包里,发现了一台旧随身听。耳机里传出小女孩的声音:

「姐姐,如果你听见了,千万不要坐最后一班车。」

结果下一秒,已经停运的站台真的响起了列车进站提示音。

后来我还看到一张第三方的六月 AI 视频产品评分图,Flova AI 拿到了 8.9 分。图里给它提炼的关键词,正好也是「导演风格打包成 Skill,和 AI 对话就能出片」。榜单当然不能替代自己的实测,但至少说明,大家开始关注的已经不只是单次生成效果,而是创作方法能不能真正复用。

图片

— 第三方六月 AI 视频产品评分图

这条片子是我用 Flova AI 的「AI 短剧一站式生成」Skill做的。

说实话,第一集的镜头整体比我预期自然。

但更让我在意的,不是它生成了几个好看的镜头,而是它把角色、场景、道具、分镜、配音和修改过程,都留在了同一个项目里。

这才是短剧能不能继续做第二集的关键。

📌 本文看点

01

项目级 Agent:先搭项目再生成

02

资产库与 Skill:让创作方法可复用

03

连载验证:同一项目继续拍第二集

01

WORKFLOW

我只讲了一个故事,它先搭了一个项目

我在 Flova 首页选中「AI 短剧一站式生成」,然后把系列设定一次性交给 Agent。

提示词大概是这样的:

PROMPT

请帮我制作一部可以持续连载的竖屏都市奇幻短剧。系列名称:《凌晨两点的失物招领处》。本次先制作第一集,时长约 30 秒,画幅 9:16,中文语境,都市奇幻风格,氛围温暖、神秘,带一点电影感。固定主角是 25 岁左右的夜班地铁工作人员林夏,黑色齐肩短发,穿深蓝色地铁制服。固定核心场景是末班车后的地铁失物招领处。后续镜头和下一集必须保持她的脸型、发型、年龄、服装和整体气质一致。

 该图片疑似使用了AI生成技术,请谨慎甄别图片

— 首页 Skill 与完整提示词

Agent 没有上来就直接抽一条成片。

它先加载短剧制作流程,把需求写进视频规格,然后告诉我接下来会依次完成:系列设定与分镜、角色和场景设定图、镜头制作、配音、音乐与成片组装。

而且每到关键阶段,它都会停下来让我确认。

这个顺序挺重要。

因为做短剧最怕的就是前面人物都没定准,后面已经稀里哗啦生成了十几个镜头。到时候不是改一个画面,而是整条推倒重来。

Flova 先帮我搭出了 5 个关键元素:

角色女主林夏

场景地铁失物招领处

道具银灰色旧随身听

场景凌晨两点的黑暗站台

线索没有登记记录的黑色书包

角色不是一张随手生成的照片。

林夏有正面、侧面和背面设定,黑色齐肩短发、深蓝制服和胸前工牌都固定下来。场景和两个关键道具也分别生成了设定图。

图片

— 林夏角色设定图

图片

— 失物招领处场景设定

图片

— 随身听道具设定

接下来,Agent 把第一集拆成6 个 Shot:发现书包、随身听特写、女孩警告、时钟与列车、无编号列车、结尾悬念。

总时长约 30 秒。

每个 Shot 里不只有一段提示词,还写了人物当前状态、场景锚点、镜头时长、景别和运镜。

比如开场先用中景建立失物招领处,再推进到林夏拉开黑色书包;结尾先看到车厢里的儿童发卡,再切回随身听疯狂闪烁的红灯。

看到这里,我第一次觉得它不是在「猜我想要什么」。

它是在按一个短剧项目的方式往下做。

而「AI 短剧一站式生成」也只是 Skill 里的一个选项。

Flova 的 Skill 页面已经按新手必用、大师美学、剧情短片、商业广告、动漫游戏、短剧/微短剧、音乐/MV、产品展示等方向做了分类。里面既有故事驱动型视频、古风甜宠短剧和商品宣传短片,也有视频拉片复刻、剧情短片等更具体的方法。

图片

— Flova Skill 合集

这里的 Skill 不是换一段 prompt 的模板。它更像把「一个会做视频的人通常怎么拆题、怎么定风格、怎么推进流程」打包成一套可复用的方法。你可以直接把成熟 Skill 设为默认,也可以新建自己的 Skill。官网还把热门 Skill、创作者方法和 FlovaTV 放到一起,创作不再只剩一个结果,也开始沉淀「这条片子是怎么做出来的」。

💡 Skill 的本质不是 prompt 模板,而是把一套成熟创作方法打包成可复用的流程。

02

CANVAS

画布看全局,故事板盯具体镜头

Flova 里有两种看项目的方式。

列表模式比较像线性的故事板。角色、场景、道具和 6 个镜头从上往下排,点开图片就能预览设定图或者运镜方案。

画布模式更像把整个项目摊在桌上。

上面一排是林夏、失物招领处、随身听、黑暗站台和儿童发卡,下面是 6 个 Shot,再往下还有小女孩语音和背景音乐。谁被哪个镜头引用,一眼就能看明白。

图片

— Agent 画布模式全景

这个体验和普通生成器差别挺大。

普通工具里,图片是一张图,视频是一段视频,下载之后就散在文件夹里了。

在这里,它们是项目对象。

生成出来的设定图和镜头素材还可以直接存进资产库。保存时不只是给图片起个名字,还能连同它关联的故事板信息一起带进去,保留角色、镜头和音频描述的上下文。

图片

— 资产库保存故事板上下文

这意味着这次确认过的林夏、随身听或者场景,不必每次重新上传、重新解释。它们可以作为项目资产继续被后面的镜头引用,也能在下一集甚至后续项目中复用。资产库保存「已经确认的东西」,Agent 则负责在新的剧情里继续调用它们,这才是标题里「集集统一」真正落地的地方。

林夏不是「某张参考图」,而是后续镜头会持续调用的角色 Element。随身听也不是一个临时附件,它有自己的外观设定,还承担了整部短剧的剧情线索。

说白了就是:AI 终于知道这条片子里有什么,而不只是知道你刚刚输入了什么。

「资产库保存「这部剧里有什么」,Skill 保存「这部剧应该怎么做」。」

03

TIMELINE

六个镜头、配音和音乐,自动进了时间线

设定与分镜确认后,Agent 开始生成 6 个镜头。

完成后,它又生成了小女孩的警告台词和悬疑背景音乐,最后自动组装到一条约 30 秒的竖屏时间线上。

图片

— 第一集完整时间线

到这里已经不是「给我六段素材」了。

中间可以直接预览完整成片,下面能看到视频轨、配音轨和音乐轨。哪里不对,可以继续让 Agent 改,也可以自己拖动时间线。

第一版出来后,我还真发现了问题。

小女孩的声音进得不太对,悬念被提前泄掉了一点。

这个问题不用把 6 个镜头重新生成。我直接在时间线上移动配音片段,把「千万不要坐最后一班车」放回更合适的剧情节点。

自动完成初版,人再做最后的节奏判断。

我觉得这才是比较合理的人机协作。Agent 可以帮我把活干到时间线上,但哪一秒该出声音、哪个停顿更吓人,最后还是我说了算。

💡 人机协作的合理分工:Agent 把活干到时间线,人做最后的节奏判断。

04

REVISION

只改一个镜头,前后剧情也能接得上

第一集还有一个小穿帮。

在「发现书包」这个开场 Shot 里,随身听提前出现在了桌面上。可按照剧情,它应该在下一个镜头才被林夏从书包里拿出来。

于是我直接在这个 Shot 下面输入局部修改要求:

REVISION

开场时桌面上不能出现银灰色随身听。前 3 秒,林夏只是在整理普通失物,黑色书包保持关闭;后 2 秒,她注意到这个没有登记记录的黑色书包,拉开拉链并向里面查看,表情从平静变成轻微疑惑。镜头结束时不要拿出或展示随身听,把真正发现随身听留给下一个 Shot。请生成一个新版本并保留当前旧版本,方便对比。

图片

— Shot01 局部修改

这里我特意强调了「只改当前 Shot」。

其他五个镜头、林夏的角色设定、制服和失物招领处都不动。

新版本很快挂到了同一个 Shot 下面,旧版也还在。

对比之后,新版的剧情明显更连贯。

开场桌面上不再提前出现随身听。前 3 秒,林夏只是在整理普通失物;后 2 秒才注意到那个没有登记记录的黑色书包。镜头结束在她拉开书包、向里面查看的瞬间,下一镜再接她拿出随身听,前后顺了很多。

这个过程我挺喜欢的。

我只改了一个 Shot,其他五个镜头和已经确认的角色、场景都没有被打乱。新生成的结果也不会覆盖旧版,两个版本都留在同一个镜头下面,随时可以比较。

哪里不对就改哪里,不用为了一个穿帮把整条片子推倒重来。

「局部修改 + 版本保留,是 Flova 区别于单次生成器的关键体验。」

05

WHY

为什么现在的视频 Agent,越来越像 Flova 这套思路?

最近你会发现,视频产品越来越集中地在讲 Agent、Skill、画布和项目工作台。

这不是大家突然同时想到几个新名词。

更值得关注的是,Flova 最早把这些东西组织成了一套完整的视频 Agent 产品形态,也由此定义了后来行业集体跟进的创作方式:右侧项目级 Agent 推进整个作品,左侧镜头级 Agent 可以逐个修改 Storyboard;角色、场景、道具、音频、文档和素材版本都属于同一个项目;Skill 再把一套创作方法保存下来。

用品牌方的话说,全能六边形战士的 Agent 来了。

我原本觉得这句话有点夸张。

但完整跑完第一集之后,我大概明白它说的「六边形」是什么了。

它不是多放几个生成按钮,而是试着把写故事、定角色、拆分镜、做镜头、配声音、改版本和组时间线接到一起。

而且它已经不只停在第一版 Agent 上。画布把项目上下文全部摊开,Skill 社区让创作方法可以被添加和复用,首页还提供 Flova CLI 入口。如果你平时习惯在「龙虾」这类支持调用 CLI 的 Agent 平台里工作,也可以直接接入 Flova:外部 AI 负责理解需求、组织想法,Flova 再把它继续推进成带有故事板、素材和时间线的视频项目。从产品结构上看,它正在把「会生成视频」往「能接管完整视频项目」推进。

行业现在开始集体走向类似的产品方向,至少说明一件事:视频生成的下一阶段,拼的不只是某一次能不能出神图,也包括一个作品能不能被持续推进。

这也是 Flova 和普通视频生成器最不一样的地方。

它想做的不是替你抽一次卡,而是陪你把一个项目继续做下去。

💡 视频生成的下一阶段,拼的是「一个作品能不能被持续推进」。

06

SEQUEL

第一集做完,我直接让它往下连载

第一集完成后,我没有新建项目,也没有重新上传林夏的角色图。

我直接在原项目里告诉 Agent:再做一集,每集约 30 秒,剧情要接着「无编号列车」继续。

Agent 先把 Final_Video_Spec 改成了前三集连续剧情验证。林夏的脸型、短发、制服、工牌,失物招领处的空间布局,以及旧随身听的划痕和红色指示灯,全部留在连续性要求里。

图片

— 三集连续性规格

然后它没有复刻第一集,而是沿着已有线索继续加剧情。

第二集里,林夏踏进无编号列车,列车突然关门启动。随身听传来一个男人的警告,最后从车窗倒影里看到一名根本不存在的黑影乘客。

紧接着这个镜头。林夏回头时座位空无一人,但黑影仍留在玻璃倒影里。她按下随身听,黑影开始显形,列车也在一段冰冷广播中抵达「亡者招领处」。

这两集一共新增了 4 项关键设定:无编号列车内部、黑影乘客和异空间站台。

Agent 接着拆出 8 个正式镜头:第二集 4 个,第三集 4 个。

第二集是踏入列车、车厢异动、陈旧车票、背后倒影;第三集是回头空座、随身听显影、终点站播报、异样站台。

我很喜欢第二集这组 Storyboard 的处理。它不是只给四张气氛图,而是直接把跟随、固定、缓推和主观推进画在图上:先跟着林夏踏入车厢,再用固定全景把门关死;随后从人物反应切到随身听和旧车票特写,最后借车窗反光做一次主观推进,让黑影乘客在她背后显形。连每个镜头为什么这样动、悬念在哪里升级,都变成了可以直接审核的镜头语言。

图片

— 第二集:踏入列车 storyboard

图片

— 第二集:背后倒影 storyboard

这一次最直观的变化是,我不需要重新解释「林夏是谁」。

后续镜头继续引用第一集已经确认的林夏和随身听,同时在项目里增加新的场景与道具。资产库保存的是「这部剧里有什么」,Skill 和项目文档保存的是「这部剧应该怎么做」。

说白了,第二集不再是重新开一局,而是在同一套世界观里继续往前拍。

「第二集不是重新开一局,而是在同一套世界观里继续往前拍。」

07

EXPORT

两集合在一条时间线里,最后直接导出

8 个镜头生成完成后,Agent 又补上了男人警告语音、终点站广播,以及两版后续悬疑配乐。

我确认镜头和声音方案后,它把第二集接到第一集后面,自动组装成一条连续时间线。

从第一集发现随身听,到第二集踏进列车,再到抵达异空间站台,两个 30 秒故事就这样连在了一起。

最后我点击右上角「导出」,Flova 完成了整条成片输出。

图片

— 导出成片

两集跑完之后,再回头看标题里的「集集统一」,我觉得重点不是每个镜头都长得一模一样。

真正有用的是:角色设定没有丢,关键道具一直在,上一集留下的悬念能进入下一集,后续修改也不会把前面的版本冲掉。

它已经不只是生成两条视频,而是在维护同一个短剧项目。

💡 「集集统一」不是每帧都一样,而是角色、道具、悬念和版本都在项目里被持续维护。

THE END

文章标签智能体
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多