你好,我是蔚公子,毕业ALL in AI,专注于 AI 提效/教育
一、最近我被两条视频砸到了
第一条叫《脚步》。
讲的是山西吕梁深山里一对相依为命的祖孙。孙子要参加长跑比赛,鞋底磨穿了,靠 502 胶水反反复复粘。爷爷一句话没说,背起竹篓翻山越岭采药材,攒钱给孙子买了一双崭新的白跑鞋。
故事看着浅显,但是呈现出来的感觉却非常的感人,我跟你说,我看完那句旁白:
“我跑的时候只觉得轻快,后来才知道,是爷把那座山背在了自己身上。”
那一刻鼻子确实有点酸。
不仅感人的故事打动人,而且数据更夸张:单平台破亿播放,200 万+ 点赞,评论区一水的“猛男落泪”。
一个商业广告,做出了比几亿成本电影还感人的效果,给品牌一口气涨粉 4 万+。
而达成这一切的,是一支AI视频。它没有用“AI”标榜自己,却让所有观众忘了技术的存在🤔。
第二条叫《牡丹记》。
东方水墨意境,画面美到能截下来当壁纸。拿到了北影节 AIGC 最佳影片——这是国内 AIGC 领域专业评审能给到的最高规格之一。
一个下沉国民爆款,一个专业评审天花板。理论上是两条完全不同路线的片子。
但有意思的是,它们是同一个工具做的。
那个工具,是我们的老朋友——LibTV,来自AI视频大厂哩布哩布。
官网入口:https://www.liblib.tv/
Skill GitHub:https://github.com/libtv-labs/libtv-skills

二、AI 视频赛道已经变天
国内 AI 视频这件事,2026 年的格局已经发生改变了。
我自己做了两年多的 AI,每天的工作之一就是看大量 AI 视频内容、研究每一个新工具。最直观的感受是:
我抖音上现在每刷三个视频,差不多就有一个是 AI 做的。而且不是两年前那种“塑料感”的 AI,是真的能让你看完想转发、想保存、想发给朋友的那种。
而这些破百万播放的 AI 作品,很多都来自一个平台——LibTV,厂家是哩布哩布。
哩布哩布这家公司,2024 年是国内 AI 图片赛道的应用独角兽。26年则切到视频领域,打造了LibTV,不少短剧公司都在用,上线一个月,单日收入破百万美金。
我之前对哩布的印象一直停留在“图片做得不错”,虽然已经出了几期关于libTV的文章了,但对他们达到这个成绩还是比较惊讶的。
这意味着他们在视频赛道上,已经做到了“短剧、广告、独立创作者通吃”的程度——是国内 AI 视频制作事实上的优质选择之一。
行,行业判断说到这。我知道你们不是来听数据的,是来看这玩意儿到底好不好用。
所以我花了一个早上,用 LibTV 做了三个完整 case:一个公益 TVC、一个甜宠短剧、一个赛博修仙 IP。下面我把每个 case 拆给你看,让你也能轻松上手~
老规矩,我们,直接上实测!
三、公益 TVC《我们都曾年轻过》
我先做了一条公益 TVC。
灵感来自一个我观察很久的现象,也是最近很火的一个议题,叫做“为什么每代人都在重复指责上一代"没抓住红利”?
相信很多70、80后小时候听爸妈说“好好读书,别下海做生意,万一亏了怎么办”,长大后回头骂“我爸当年要是让我下海,我早财富自由了”。
到了 2026 年的今天,新一代的父母又开始跟自己的孩子说“好好读书,别整天搞什么 AI 创业”。等孩子长大,或许也会回头骂:“我爸当年要是让我搞 AI,我早财富自由了。”
叛逆是会循环的。代际焦虑是会复制粘贴的。
这个题材我憋了很久,但传统的拍法做不了——你不可能用真人演员同时演 15 岁、40 岁、65 岁三个版本,时间跨度跨不过去。请三个演员吧,又没有传承感。
诶,但是,但是AI 视频可以。
首先我用最新的GPT image2.0生成一个人15岁四十岁和65岁三个版本的人像,然后进入libTV,直接开始创作 。
故事一句话可以说明:
用同一张脸的不同年龄版本,演完三代人的叛逆循环——从 1995 到 2025 到 2045。45 秒的片子。
关键分镜:
【0-8 秒|1995 年家庭饭桌】
暖黄白炽灯,搪瓷杯,老式电视机声音。父亲(40 岁,蓝色工装外套)用筷子指着对面 15 岁的儿子:“好好读书,别想着下海做生意,万一亏了怎么办?”
儿子低头扒饭,眼神向上一翻,戴上 walkman 头戴式耳机,摔门进卧室。
【8-20 秒|2025 年的咖啡馆 + 家】
镜头一切:现代咖啡馆,LED 冷光。同一张脸的 45 岁版本穿深灰针织衫,跟朋友抱怨:“我爸当年要是让我下海,我早财富自由了。”
下一个镜头,切到他家饭桌。他对着自己 15 岁的儿子说:“好好读书,别整天搞什么 AI 创业,万一失败了怎么办?”
儿子低头扒饭,眼神向上一翻——和镜头 1 的少年姿势完全一致,戴上 AirPods,摔门进卧室。
【20-33 秒|2045 年】
未来感空中咖啡馆,全息广告漂浮。同一张脸的 65 岁版本和他的儿子(35 岁)坐在一起。儿子说:“我爸当年要是让我搞 AI,我早财富自由了。”
切到他家。他对自己的 15 岁儿子:“好好读书,别整天搞什么脑机接口……”
儿子低头扒饭,眼神向上一翻,第三次重复同一姿,戴上骨传导隐形耳机,摔门。
【33-45 秒|结尾】
三个画面同时呈现:左屏 1995 的父亲、中屏 2025 的父亲、右屏 2045 的父亲,同时站在自己孩子的房门外,疲惫沉默。
镜头慢慢拉远,三扇门同时合拢。文字浮现:
“每一代人都会错过一些红利,但叛逆从来不是错过的原因。我们都曾年轻过。”
做完这条片子,我有一个非常深的体感:
未来,AI 视频的真正壁垒不是模型多强,是创作者愿不愿意把一个“结构性的情感钩子”设计出来。
同一张脸的不同年龄版本,模型能做。
但用这个能力去讲“叛逆代际循环”这件事,是人的判断。是我基于最近一段时间看到的关于时代红利这一热点,反推出来的社会焦虑新问题,所以才能让你感觉共鸣。
你看,《脚步》之所以能让无数人破防,不是因为 AI 把祖孙俩画得多逼真。
而是因为创作者把一个看似普通的故事用一种平行时间线的表述方式,展示了出来,观众不仅为孙子喝彩,也为爷爷的付出而感动。
四、甜宠短剧《我的小妖怪》
第二个 case 我做了一条 60 秒的甜宠短剧。
为什么选这个方向?因为这是个很考验工具的题材。
女频甜宠对画面美感、角色一致性、氛围塑造要求都极高,做不好就是“塑料感”,做得好才能让观众停下来反复看。
故事和关键分镜如下:
故事梗概:
绣坊少女苏念三百年前救过一只小白狐,今世狐妖化作清冷男子回来还债。她不知道他是谁,他知道一切。
关键分镜:
【0-8 秒|雨夜江南】
大远景慢推,江南水乡雨夜,青石板桥。少女苏念撑着油纸伞走过桥面,浅青色绣娘服。桥头一只受伤的白色小狐狸蜷缩着,她蹲下身,把伞倾向小狐:"你受伤了吗……"
【8-13 秒|回忆滤镜】
暖橙色光晕。8 岁的苏念蹲在山林边,把一块米糕递给一只更小的白狐。小狐的金色瞳孔里映出小苏念的笑脸。
【13-24 秒|白衣男子登场】
绣坊内,光线柔和。门帘被一只白皙修长的手掀起。白衍走进来——淡蓝色长发垂在肩前,淡青色长袍,气质清冷。苏念抬眼,两人对视,时间凝固一瞬。
镜头给到白衍的特写——他的金色瞳孔在阳光下一闪,和回忆中的小狐眼神完全一致。
【24-48 秒|守护 + 危机】
街市上几个混混挡住苏念。一阵风过,混混莫名跌倒——苏念抬头,屋顶上一道淡蓝色身影一闪而过。
深夜,苏念被两个黑衣人拖向枯井。白衍从天而降,落地无声,长发飞扬。袖中飞出一道金色光线,将黑衣人击退。
他一个旋身接住苏念,凑近她耳边:“别怕,是我。”
苏念抬眼——他耳后,一对淡蓝色的狐耳缓缓显现,微微颤动。
【48-60 秒|真相揭示】
白衍低头看她,金色瞳孔有光闪烁:
“我等你,等了三百年,就为了在你面前,说一声谢谢。”
苏念缓缓伸出手,指尖轻轻触碰他的狐耳。白衍闭眼,狐耳颤动。画面定格:
《我的小妖怪》第一集——三百年前你救过我,今生换我守你。
这条片子我没调用任何特殊功能,就是 LibTV 平台最基础的视频生成流程做的,这一点反而是让我觉得最值得说的。
因为正常做这种古风甜宠,最大的痛点是角色脸漂。比如白衍上一个镜头清冷俊美,下一个镜头变成大妈,整片直接报废。
但 LibTV 的基础生成已经把“角色一致性”做得相当稳了,整条 60 秒短片下来,白衍的脸基本没飘,连他耳后那对淡蓝色狐耳的形状、位置都是基本一致的。
这意味着,用平台最基础的能力,独立创作者已经能做出短剧公司基础水准的女频甜宠了。这是一个很关键的门槛降低。
做完《我的小妖怪》,我最大的感受是,视频质量已经不是问题了,问题是审美。
工具把“拍出来”这件事的门槛降到几乎为零。剩下能拉开差距的,是你对剧本、节奏、人物动机的判断力。
说白了,是选题和审美。
什么镜头要克制、什么台词要降到生活语境、什么时候情绪要往回收一点这些都是模型不会告诉你的,是创作者的活儿。
或许,AI 工具进步到这个阶段,做内容的护城河已经从会用工具切换到有判断力了。
五、赛博修仙 IP《蔚公子修士》
第三个 case 我做了一件我自己最想做的事,用我自己的动漫头像做了个 IP故事。
关键分镜如下:
【0-10 秒|开篇钩子】
赛博东京夜景。雨。霓虹招牌密布,全息广告漂浮。蔚公子站在 100 层摩天楼顶。雨水从墨镜上滑落,镜片闪过滚动的数据流和坐标。
他低声说:"开始狩猎。"
耳机里 AI 道侣(女声):"目标,第七层数据神兽。它吃了三千个新人修士的算力。"
【10-22 秒|入场】
蔚公子纵身从 100 层楼顶跃下。下坠中,他从夹克内层抽出一支细长发光的笔,在空中划出几个金色字符——"剑"字成形。
落地瞬间,地面碎裂成数据点。他面前升起巨型妖兽——半饕餮半机械,高 12 米,金紫色数据流构成。
【22-45 秒|打斗】
镜头切换:
- 蔚公子一剑斩出,剑光是金色代码瀑布
- 妖兽吐出数据流巨爪扑过来
- 蔚公子翻上招牌闪避,火花四溅
- 他甩出脖子上的"A"字项链,项链化作护盾挡下数据爪
- AI 道侣:"算力剩余 23%。"蔚公子笑了:"够了。"
【高潮镜头】 蔚公子双手合十。他头发里的"AI"两个字浮现金光,从头顶飞出,悬浮在身后约 1 米处。他双手分开,"AI"二字之间拉出一柄数米长的发光法器——"A"字和"I"字组成的双刃剑,金紫色,半东方半数据流。
一剑下去,剑光劈开妖兽,妖兽从中线裂开,碎成漫天数据,散入雨夜。
【45-60 秒|反差结尾】
蔚公子收剑。雨突然停了。法器化回头发里的"AI"光纹。他抬头看夜空——那不是真星空,是密密麻麻的数据点像星图。
AI 道侣:"任务完成。下一个目标是——"
蔚公子打断她,朝镜头露出一个反差感的笑容:
"明天再说。今天我想去吃烧烤。"
画面定格。文字浮现:
> 《蔚公子修士》第一集 完
> 下集:会做梦的 AI
这条片子是三个 case 里最考验模型能力的,动作打斗对视频模型的物理真实感要求最高,普通模型生成出来的打斗动作会“飘”,人就像踩在棉花上。
我同样没做什么特别的设置,就是用平台最常规的生成方式。
但 LibTV 最近上线了 Seedance 2.0 满血版,这是目前业内公认最强的视频模型之一,特别适合做动作戏。
出片之后,整段打斗的肢体力量感是真的撑住的,我的IP形象的下坠、闪避、斩击的动作都是实的,没有很重的漂浮感。
而且整部片里蔚公子的形象稳定性很高,蓝发、墨镜、“AI”光纹、“A”字项链,每个镜头都是一致的,基本没出戏。
我做这个 case 不是因为我“决定要做 IP”,而是想验证一件事。AI 视频时代,独立创作者到底能不能做出有辨识度的 IP?
做完之后我的判断是,能。而且门槛比想象中低很多。
我接下来可能会出一些自己IP形象的内容,但还没决定具体怎么做。看看大家反馈再说。
六、LibTV 还有哪些我没用到、但你可能用得上的功能
写到这里 5000 多字了。但其实 LibTV 的能力远不止我上面三个 case 用到的那些基础功能,我这次做的事还挺简单的,就用了平台最基础的视频生成。
真正发挥 LibTV 价值的,是它一堆“独家功能”和“行业首发能力”。这一节我把没用上但你可能用得上的,给你过一遍。
1. 视频创作全闭环:一块装得下整个项目的无限画布
LibTV 不是一个简易的输出工具,它是一块无限放大的画布。

你可以在上面同时摆放 5 种节点:文本节点、图片节点、视频节点、音频节点、脚本节点。

2.可复用的工作流
LibTV 真正的威力不在于能生成,而在于能重复。所有节点之间都可以用连线搭建工作流,让一整条链路变成可以一键重跑的创作配方。
最基础的例子:
参考生图 → 图转视频
文本分镜 → 批量生成分镜图 → 拼成故事板
场景草图 → 光影矫正 → 视频化 → 高清增强

一旦你调出了一条顺手的流程,可以直接打包为资产或工作流模板,以后做类似项目时,打开画布、换一批输入,就能复用整套流程,不用每次从零搭建。
比如你做 Vlog 系列栏目:固定开头 3 秒风格、固定镜头节奏、固定字幕样式。
你可以在 LibTV 里把这套节点连起来,存成自己的栏目工作流,以后每一期只要扔进新素材,稍微调整文案和封面,整条视频就能按既定风格生产出来。
3. 全面的工具箱
LibTV 这次最戳我的,不仅是是它把所有工具和模型全砸在了一块画布上,还有全面的工具箱🧰。

以前搞个剧情推演或者角色三视图,光搭工作流就能把人折腾疯。
现在敲个 Slash 快捷指令,九宫格、连贯分镜这些预设魔法一键触发,直接把成型的结构拍你脸上。

平时那些修修补补的碎活儿也终于不用切软件了。图片扩图抠图打光、视频高清放大加剪辑,全在这一个界面里包圆。
它解决了一个最致命的痛点,就是把那些看着挺炫但没法发的半成品,在当前工作流里直接打磨到能交付的状态。

我现在都是前期切极速模型疯狂跑草稿找灵感,定调了再换最强模型出最终素材。
告别以前开着十几个网页来回横跳的割裂感,在一块画布上直接锁死风格和质量👌
4. ALL-in-one 模型 hub
LibTV 的模型集成是目前全网最全的一档,视频模型和图片模型,都涵盖的很全:


5. Creator + Agent 双入口
这是 LibTV 一个别家工具基本没有的设计,同一个平台,既给人类创作者用,也给 Agent 用。
人类入口就是你打开 LibTV 网页,在无限画布上搭节点、写剧本、生成视频,就是我前面三个 case 用的方式。
Agent 入口则是LibTV 把核心创作能力打包成了 Skill,可以被你的 Agent调用。

比如:
一句话生成 5 分钟短剧(在 IM 里输入一句创意,Agent 自动完成剧本、分镜、视频、剪辑)
一段视频 URL 复刻同款 TVC
一首音乐生成一支 MV
一个产品官网 URL 生成产品展示片
这次三个 case 我都是亲自操作的,没用 Agent。但我看过 LibTV 官方放出来的 Agent 录屏 demo。
一句 prompt 让小龙虾自动在 LibTV 画布上搭节点出片,全程不用碰鼠标,看完我的判断是:
AI 视频的下一步,不是替代创作者,而是把创作者的工时杠杆放大几倍。人负责选择和审美,Agent 负责执行和扩展。
这是 LibTV 在产品方向上一个挺前瞻的判断,下次我会专门找时间再试一下 Agent 这条路径。
Skill 的开源入口:
https://github.com/libtv-labs/libtv-skills
七、蔚公子的洞察
跑完这几个实测,跟各位聊几句最底层的判断。
到了今天,AI视频其实早就告别了“能不能用”的炫技期,接下来的核心命题只剩下一个,就是谁能率先把它固化成真实的生产力。
高浓度的AI内容渗透已经是个不可逆的进程,这时候再去纠结要不要入场毫无意义,真正决定胜负的是你选择握着什么武器下场。

这也是为什么我认为,哩布哩布这次从图像独角兽跨界强切视频赛道,是今年国内AI应用层极其凶悍的一次跃迁。
单日流水破百万美金的势能,这种级别的通吃局面在目前的国内跑道上确实很难找到第二家。
当然,我更看重的,是它 Creator 结合 Agent 的双入口逻辑。
这完全契合效率提升的本质,人去卡住审美和决策的上限,让 Agent 去完成底层的执行和拓展。AI从来不是为了干掉创作者而存在的,它是我们放大自身产能、拉高工时产出的终极杠杆。

自己亲手搭完这几个工作流后你会发现,算力和画质早就不是AI视频的壁垒了。
哪怕只跑基础功能,质感也足够平推一众流水线内容。当技术门槛被彻底抹平,以后真正能让你甩开同行的,可能只有你的审美护城河,以及你想讲一个什么样的故事。
如果各位想实际上手跑一跑,官方网站是留给咱们创作者的入口:
https://www.liblib.tv/
想直接调用底层能力的可以去 GitHub 看看它的 Agent Skill:
https://github.com/libtv-labs/libtv-skills。
遇到卡点或者想搭特定的场景工作流,随时在评论区找我盘一盘。

底层的工具更迭会越来越快,但大众对好内容的本质诉求永远没变。
愿每一个手握前沿利器,却依然愿意死磕真诚故事的人,都能在这个时代拿到属于自己的结果🔥







