Token导航 LogoToken导航TokenDH.com

OiiOii 分镜 Agent:AI 视频进入导演模式

更新时间 2026-05-27来源 草堂AI正文 3767字阅读约 12分钟20 张图片

若文章对你有帮助,欢迎点赞、关注,你的认可就是最好的鼓励。

嗨,大家好,我是草堂大师兄。

做 AI 视频最崩溃的瞬间是什么?

不是没灵感。

而是抽卡。

明明脑子里想的是电影级武侠对决:雨夜竹林、长剑出鞘、刀光剑影。结果人物忽然变脸,镜头节奏突然失控,原本脑补的大片,最后只剩下支离破碎的画面。

最近 GPT Image 2 爆火之后,AI 视频圈也流行起一种新玩法:

GPT Image 2 + Seedance 2.0 工作流。

先用 GPT Image 2 生成分镜图,再交给 Seedance 生成视频。

图片

但最近重新深度体验 OiiOii 时,我突然有一种感觉:

AI 视频开始从“抽卡模式”,进入“导演模式”了。

熟悉 OiiOii 的朋友应该不陌生。

作为全球首个专注动画创作的 AI Agent,它之前主打的一直是“故事流”:

输入一句想法 → Agent 自动拆剧情 → 自动设计角色 → 自动生成分镜 → 自动完成视频。

一句话,就能拉起一整个 AI 创作团队。

但真正让我觉得有意思的,不是模型变强了。

而是:

OiiOii 在替你做导演该做的事情。

废话不多说,先看效果。

为了让大家感受到分镜对视频的控制能力,我把生成的分镜图也放出来了,你可以对照视频看。

① 武侠《剑客对决》

图片

② 灾难《城市末日》

图片

③ 悬疑《侦探破案》

图片

④ 古风《月夜舞影》

图片

⑤ 治愈《海边女孩》

图片

是不是感觉整个视频开始变得可控了很多?

以前 AI 更像随机发挥。

现在更像有人在背后安排镜头。

文章比较长,我分成 4 部分:

  • OiiOii 的懒人玩法 
  • OiiOii 分镜 Agent 
  • OiiOii 自由画布 
  • GPT Image 2 + Seedance 提示词技巧

OiiOii 的懒人玩法:一句话生成视频

先说最简单的。

打开 OiiOii,选择:

剧情故事短片

在输入框里直接输入一句话剧情描述即可。

图片

风格有 150+ 种可选。

图片

比如:

“创作一部吉卜力风格短片,讲述一个女孩在乡下祖母家度过最后一个暑假时,遇见一个住在巨大蒲公英里的夏日精灵……”

剩下的交给 Agent。

它会自动完成:剧情拆分、角色设计、分镜设计、镜头安排、视频生成。

属于真正的“懒人模式”。

角色图生成剧情

如果你更关心角色一致性,还可以创建角色生成剧情。

点击【角色设计】,输入角色描述:

“3D 动画电影角色设计,一只拟人化的公橘猫,直立站立,体型健壮圆润,身穿一件亮黄色 Polo 衫和休闲牛仔短裤,头戴一顶棒球帽,蓬松的橘色毛发带有白色条纹,绿色大眼睛,表情憨厚亲切,纯色浅灰色背景,风格可爱活泼,适合动画制作。”

图片
图片

角色创建完成后,上传角色图,输入剧情,生成动画。

图片

之前我已经专门写过教程:

《靠 AI 当导演,爽!我能拍 60 集动画片了!》

上传剧本生成

OiiOii 还支持上传剧本,最多支持 5000 字。

例如:

“请根据我上传的《伏天氏》拍摄脚本,生成真人实拍风格短视频。”

对于短剧、自媒体剧情号非常方便。

图片

详细的教程,可以翻看往期文章:

【OiiOii 开放注册!接入 Seedance 2.0,真人短剧教程来了】

OiiOii 分镜 Agent:真正的提效点

我觉得 OiiOii 最容易被忽略的,其实是它的分镜 Agent。

以前做 AI 视频,我有个很头疼的问题:

提示词经常要自己到处找、到处抄,然后再手动拆镜头。

比如一个武侠视频:

先想剧情;

再想镜头顺序;

再写每个镜头提示词;

然后调整镜头节奏;

最后重新生成。

一套下来,时间全耗在前期。

而 OiiOii 直接把最麻烦的一步自动化了:

自动拆分剧本 → 自动生成分镜 → 自动撰写每个分镜提示词。

以前是自己做导演。

现在是 Agent 帮你一起做导演。

图片
图片

多宫格分镜

开始生成分镜视频之前,会先让你选择分镜方案:

多图参考:直接生成视频,更快、更便宜、更流畅。

宫格图:从分镜图开始,更可控、更专业。

进入【宫格图】后,系统会根据镜头复杂程度自动生成:

  • 四宫格 
  • 九宫格 

方便快速预览整个剧情节奏。

如果某些镜头不满意:

点击右上角【展开】即可修改。

图片

画布 + Agent:电影级画面的密码

我测试的时候发现一个很有意思的地方:

点开任意分镜,它会直接显示当前镜头对应的分段式提示词。

相当于 OiiOii 把 Agent 的“思考过程”直接露出来了。

图片

很多 AI 产品:

你只能看到结果。

不知道它为什么这么生成。

但在 OiiOii:

你不仅能看到结果,还能看到:

它怎么拆镜头;

为什么这样安排镜头;

每个镜头用了什么提示词。

真正实现:

Agent 自动生成 + 手动精修结合。

甚至可以精确控制视频每一秒发生什么。

OiiOii 的画布流玩法

如果说故事流是:一句话生成动画。

那么自由画布更像:导演模式。

比如我想做一个猫咪街舞视频。

先使用 Oii Image 2 生成分镜图,然后交给 Seedance 2.0 生成动态视频。

登录首页,在工作台点击「自由画布」。

图片

输入提示词,选择“Oii Image 2”模型,画面比例,点击生成。

图片

当然,你可以你也可以先在 ChatGPT 使用 GPT Image 2 生成图片,然后上传到自由画布。

右键图片,点击「生视频」。

图片

输入提示词,选择生成视频的模型 seedance 2.0 pro 模型,选择时长和画质清晰度,点击生成。

图片

GPT Image 2 + Seedance 2.0 提示词技巧

你有没有发现,同样都是 AI 视频,有的人做出来像电影:人物稳定;镜头有节奏;动作流畅;情绪层层递进。

而有的人做出来会有一种明显的割裂感:人物形象前后不统一;镜头切换没有逻辑;动作衔接生硬;情绪和节奏无法建立。看起来像一堆片段拼在一起,而不是一个完整的故事。

问题其实不在模型,而在于:

你缺少导演思维。

我测试了很多案例之后发现,无论是武侠、悬疑、古风、灾难还是治愈,本质上都在遵循同一套电影镜头逻辑:

先建立世界观,再让人物登场;接着转移视觉焦点、推动镜头运动;最后把情绪推向高潮,给观众一个记得住的英雄镜头。

拆开来看就是:

统一角色 → 场景建立 → 焦点传递 → 前景遮挡 → 动机式运镜 → 情绪升级 → 英雄镜头

所以 GPT Image 2 和 Seedance 最重要的不是堆关键词,而是:

先告诉 AI 怎么拍。

下面把我实测后总结的两个模板分享给大家。

GPT Image 2 分镜图模板

创建一张电影级【主题】短片分镜故事板。

整体画面应像专业电影前期制作 Storyboard,共 12 个分镜格,每个分镜包含镜头说明、焦段标注、运动箭头以及电影化调度信息。

人物设定(所有镜头必须统一):

主角:【角色外观】【服装】【人物气质】【动作特点】

配角(可选):【人物描述】

视觉风格:【电影类型】【色彩风格】【整体氛围】【参考电影】

场景元素:【场景 1】【场景 2】【场景 3】【动态元素】【环境细节】

整体节奏:

镜头从【起始状态】开始,逐渐升级至【情绪高潮】。

镜头通过【前景元素】【动作元素】【环境元素】【光影元素】不断重新引导视觉焦点,形成自然电影式转场。

分镜结构如下:

空镜建立镜头,50mm —— 缓慢推近(建立世界)

中景镜头,50mm —— 缓慢滑动(人物登场)

特写镜头,85mm —— 微推近(关键细节)

焦点交接镜头,85mm —— focus handoff(焦点转移)

前景打断镜头,35mm —— foreground interruption(前景遮挡)

中景跟拍,35mm —— tracking(开始运动)

低机位镜头,28mm —— tracking(强化速度/动作)

环绕镜头,35mm —— circular tracking(情绪升级)

动态镜头,28mm —— impact / emotion(高潮动作)

转移镜头,35mm —— redirect(视觉引导)

焦点交接镜头,50mm —— focus handoff(回收情绪)

最终揭示镜头,35mm —— push-in(最终英雄镜头)

整体电影语言参考【参考电影类型】。

每个分镜顶部加入:手写技术注释、镜头焦段、运动方向箭头。

摄影术语:tracking、push-in、focus handoff、foreground interruption、redirect、circular tracking。

整体必须保持松散、富有表现力的电影草图感,而不是精致插画风格。

Seedance 2.0 视频提示词模板

电影式连续镜头 / 动机式运镜 / 15 秒

场景:【整体场景描述】

人物:【完整人物设定】

人物外观在所有镜头中必须保持完全一致。

摄像机概念:

连续动机式运镜。镜头通过【动作元素】【环境元素】【光影元素】【运动主体】不断重新传递视觉焦点,每次运动都自然过渡至下一个主体。

镜头序列:

0:00–0:03

建立环境;摄像机焦点:【主体出现】

0:03–0:05

细节动作;摄像机转移:【A → B】

0:05–0:07

前景遮挡;摄像机重新获得主体

0:07–0:10

动作升级;运动速度增加

0:10–0:13

高潮动作;人物情绪爆发

0:13–0:15

镜头缓慢推进;最终焦点:【最终英雄镜头】

风格:【电影类型】【情绪】【镜头风格】

灯光:【主光】【轮廓光】【环境光】

品质要求:照片级真实、电影级光影、高细节、高动态范围、真实物理运动、沉浸式氛围。

写在最后

测下来最大的感受,其实不是画质提升了多少。

而是以前做 AI 视频,很多时候更像碰运气:

人物会变、镜头会乱、情绪也很难接住。

现在有了分镜之后,整个创作过程开始变得可控。

从一句话灵感,到角色、分镜、视频,AI 正在慢慢从“帮你生成内容”,变成“帮你组织镜头”。

以前靠抽卡,现在更像当导演。

如果你也想试试,可以自己去体验一下:

OiiOii 官网:https://www.oiioii.tv/

如果你也做出了有意思的视频,欢迎来评论区晒作品,我也去围观学习。

文章标签智能体
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多