Token导航 LogoToken导航TokenDH.com

自从用了这个方法,AI视频抽卡成本少了一大半

更新时间 2026-05-23来源 AI设计小华正文 6835字阅读约 22分钟24 张图片
不知道大家有没有这种感觉。。
我最近在做AI视频的时候,感觉花费在抽卡的消耗量有点大,以至于我总觉得token不够用。
但在昨天在X无意中刷到,
一位叫Koda的博主大神,ta分享了一个能让主体角色保持一致性并且具有极强可控性的视频创作方法。
博主开始是生成了一张人物主体图,然后再用第一套提示词将角色故事板生成出来,
图片
接着继续用第二套提示词,参考人物主体把分镜拆解成具有黑白效果同时还具备连续性的故事板,
图片
接着再用符合seedance2.0生成逻辑的,第三套提示词把生成好的角色故事板和剧情故事板放在一起,生成出最终的分镜效果。
以上就是这位博主的生成逻辑,想分享给大家,因为使用这一套打法能够极大地降低我们的抽卡成本。
在下文我也把该博主的提示词通过整理后还有ta的生成过程给大家详细展示出来,
那废话不多说,开工~
01创建角色板
大家需要预先生成一个角色,生成角色所用的铲子,这里我先用Loavrt
👉链接:https://www.lovart.ai/
图片
图像模型选择midjourney,提示词放在下面了。
大家有需要可以拿去反推。
    prompt:cinematic still of a muscular European minotaur warrior DJing in a dark medieval gothic cathedral, half human half bull, rugged horned head, wearing weathered black medieval warrior armor with white religious linen collar, large vintage over-ear headphones, heavy silver cross pendant necklace, eyes closed, calm brooding expression, hands on vintage turntable decks, background with tall gothic stained glass windows, moody low dramatic lighting, 70s film grain, vintage muted color grading, soft focus, dark gothic aesthetic, hyperrealistic, shot on 35mm film, cinematic composition  --exp 80 --sref 2578382792 --profile fbichjd --V7,画面比例16:9
    图片

    咱出完这张图之后,需要转战到TapNow,在里面使用image2根据这个角色生成出角色板。

    👉链接:https://app.tapnow.ai/

    图片

    创建画布,进入到页面,把我们的牛战士放进去,在旁边拉一个工作节点,图像生成。

    把这段提示词丢进去,并且把主体@到对应的位置。

      创建一张艺术性的16:9角色身份板。[主体]:@Minotaur DJ Gothic Cathedral纯白色/柔和的米白色背景。无环境、无道具、无标志、无水印。设计方向:不要创建标准的角色参考表。创建一张电影般的身份板,感觉像是高端动画工作室的角色研究与艺术书布局的结合。布局应不对称、优雅且视觉上令人难忘。使用大片留白、多样化的图像比例和有意的不平衡。避免网格、蓝图设计、目录布局和重复的转场展示。重要布局规则:不要重叠任何角色图像。每个视角必须有清晰的分离和呼吸空间。保持所有身体、肖像、轮廓和细节研究的视觉区分。无裁剪面部、无隐藏肢体、无堆叠人物、无合并姿势。主要构图:放置一个大型英雄全身视角,略微偏离中心作为视觉锚点。围绕它,以干净的间距排列较小的辅助研究:中性全身视角、背面视角、侧面视角、坐姿、倾斜姿势、蹲姿、俯视身体角度、仰视身体角度、富有表现力的肖像研究。每个视角应感觉像是一个独立的干净角色研究,而不是来自一个场景的帧。身份锁定:在所有视角中保持严格的身份一致性:相同面部、相同面部比例、相同发型、相同服装、相同身体比例、相同姿势语言、相同视觉个性。有用参考细节:使角色便于未来的图像和视频生成:清晰的面部形状、清晰的发型轮廓、清晰的服装轮廓、清晰的身体形状、清晰的手部、清晰的姿势、清晰的表情范围。艺术性部分:包含一个小轮廓研究区域,带有2-3个简化的黑色角色轮廓。包含一个小表情研究区域,带有细微的情感变化。包含一个小细节研究区域,展示面部、头发和服装的关键视觉特征。文本设计:添加一个时尚的角色ID块。保持简约、大胆且艺术导向。仅使用:名称角色核心情绪视觉标志仅在有帮助的地方使用小型手写风格标签。允许使用细微的编辑箭头和标注标记,但保持简约和优雅。风格:简约、电影感、高端、艺术书般、干净、富有表现力、适用于制作。最终图像应感觉像一张艺术性的角色身份板,旨在帮助AI模型理解角色的面部、轮廓、服装、姿势和情感范围。
      图片

      做到这一步,咱就把角色板搞定了。

      图片
      02创建故事板

      在牛头角色旁边再而建一个节点,节点选择文本。

      图片

      在文本里输入下面这一堆内容,记住是在这里,不是在下面的对话。

      图片

      这堆文本的内容在这:

        (图1)为故事板创建一个原始的D音乐仪式,专注于激烈的身体动作和现场混音。使用一位戴着重型D耳机的东亚修女(身穿黑色修女服,戴着十字架项链)作为角色。16:9故事板表格,12个电影风格面板。实际故事板绘图必须仅为黑白:粗糙的铅笔线条、最小细节、快速手势绘图能量、简单的解剖结构构建以及强烈的轮廓可读性。保持艺术作品轻量、动态且未完成,就像早期的动作分镜预览。一位孤独的修女在巨大的“新中式教堂”(融合了中式传统木制窗棂与高耸的哥特/野兽派空间)内进行一场狂热的D表演,仿佛在主持一场充满情感张力的神圣仪式。动作具有侵略性、节奏感且不断演变:猛烈地搓盘、夸张地扭转旋钮、身体随重低音极度前倾与后仰、双手向神圣光束伸展、剧烈的头部甩动、手臂的尖锐隔离动作、以及在混音台前的崩溃与爆发。 每个面板必须包含可见的运动和强烈的身体动量。避免静态站立姿势。表演者应感觉被困在宗教仪式、极度专注的疲惫和电子乐的情感释放之间。使用电影艺术风格的摄影技巧,带有手持能量、快速推拉、环绕混音台的运动、头顶俯视镜头、侧面轮廓、手部与打碟机的侵略性特写、长焦压缩以及极端的负空间。保持环境最小化:空旷的中殿空间、浓郁的香炉烟雾、背景中式木格栅的模糊剪影、刺眼的顶层神圣灯光束以及混音设备的局部金属反光,仅此而已。 标注颜色系统:红色箭头=身体运动蓝色箭头=摄影机运动绿色标记=取景/构图笔记橙色标记=灯光方向紫色标记=声音/情感强调黑色文本=简短镜头笔记和面板标签无时间戳。以一个压倒性的最终动作姿势结束,例如她精疲力蝎地弓起身子,双手紧紧撑在停止转动的唱片机 上,头颅低垂,处于一束刺眼的孤立聚光灯下。

        然后在生成牛头的故事板之前,我们还需要有对应这堆文字的角色的故事板用作参考,这样AI理解的会更加方便,准确性更高一些。

        这里大家直接拿,然后反推出自己喜欢的东西即可。

        这个模板我就放在下面了。

        参考模板:

        图片

        把这个剧情板拉进画布里,我们把参考故事板和文本还有牛头,三条工作线,都汇集在文本节点里。

        在文本节点的下方,我们在给它说出这个要求,

        prompt:@图片2是根据文本节点中的提示词生成出来的12宫格分镜,现在根据文本节点中的提示词结构,帮我重新编写一段生图提示词,这段提示词,主要内容是一个角色在教堂里面这个角色是@图片1的形象,要求生成出来的故事板的画风要与@图片2完全一致。

        图片

        这步的操作主要是为了直接把我给你们的文本还有参考故事板,让AI去理解,然后针对我们给它的牛头角色,它会给我们生成出,能够直接生成牛头故事板的提示词。

        这样就不用跳转到别的AI那里去反推出适合的提示词了,里面内置了gemini pro,直接操作即可。

        不一会儿,就会在这个小框里面,就会给到我们能够使用image2直出牛头故事板的提示词。

        图片

        接下来就简单了,只需要把牛头角色在旁边拉一条图像节点,

        把刚刚我们生成好的故事板prompt,直接丢进去,模型选择好,图像比例依旧是16:9生成即可。

        把我给大家的参考故事版也连进来,让它参照这样的表达方式去出。

        图片

        这样,我们就会得到具有12个连贯性画面的故事板,

        图片

        有的人可能会说,为什么一定要是这种黑白的,而且还要有很多颜色的箭头在画面乱涂乱画?

        图片

        后面seedance2.0生成视频的时候,它可以立下大功。

        前段时间我不是说,出视频脚本有两种写法嘛。夯爆了!用AI复刻喵咪演绎大话西游经典桥段(附全教程)

        一种是整段式的,一种是时间序列式的,而今天这种是新的方式。

        让AI参考连环故事板,我们不用描述太详细,也不用时间序列,直接让它出视频,它会按照12个分镜按顺序依次从左到右的制作好,

        可控性拉满,也不用多次的抽卡浪费钱。

        故事板需要尽量的使用黑白的效果,不要使用写实,立体和你原图角色相同效果的故事板,

        图片

        一般很多人生成分镜故事板,直接就生成了左边的分镜,然后按照这个分镜进行后续的创作,但是这样可能会让AI误认为你是想多镜头一起表达。

        创作出了12个分镜,之后还可以创作第二个连续的12个分镜故事板。

        在原先的故事板拉出一个图像节点,输入

        prompt:续写后面连续12个分镜,后续的剧情可以往月球和地球的元素去发展。

        图片

        这个提示词续写,可以根据你想要的剧本走向去写,不知道写什么也可以用gemini去扩写,

        这里我只是简单写了一下方向。

        图片

        第二个故事板就整出来了,以此类推~

        03生成对应故事板的提示词

        完成了故事板分镜之后,咱需要把对应的视频脚本整出来。

        方法依旧是给出一个类似的视频脚本,让AI去改写成符合我们想要出的视频脚本,

        具体的操作可以按照下面这样。

        新建立一个文本节点,

        图片

        要给它一个学习的文本,让它去反推出适合我们这个牛头角色的提示词,这个提示词文本放下面了。

          prompt:使用故事板参考@\[STORYBOARDREF\]作为15 秒视频的完整视觉和情感叙事来源。从左到右、从上到下依次遵循所有12个节拍。不要重新诠释动作、构图、镜头角度或从神圣肃穆到狂暴律动的极致氛围递进。保留故事板的镜头顺序、从静谧祈祷到低频轰炸的动静反差逻辑、从极简特写到上帝视角的构图多样性,以及最终的弥赛亚式高潮定格。 将完整的12节拍序列压缩到15秒内。每个节拍必须清晰呈现为充满节奏爆发力与掌控感的动作快照。使用极具视觉冲击力的硬切转场、凌厉的动作匹配剪辑与微颤推进(如从手指急速旋钮无缝衔接狂野的搓盘动作,再到猛烈推下推子引发的画面震颤)在最终节拍之前,保持修女极度冷酷的精准操控与身体随重低音狂暴摇摆的紧凑情绪交替。 保持与角色参考相同的绝对核心主体身份:**身穿传统黑白修女服、佩戴重型专业DJ耳机、眼神极具压迫感与狂热的修女**@\[CHARACTERREF\]。不要改变她的外貌与神圣特征。整个过程中持续展现极具律动感与视觉张力的动作流:布满浅景深的快速旋钮扭动、手臂大幅度横扫的搓盘残影、猛烈下压推子时的力量爆发、长发随着低频重击在低角度仰拍下狂野甩动,以及从克制的布道者到掌控全场的电音主宰的绝对精神压制。 环境:充满肃穆感的哥特式教堂内部、被雾气充斥的教堂中殿、交替出现的穿透玫瑰花窗的圣洁逆光与随着节拍爆发的动态脉冲光(神圣与赛博的碰撞)、充满神圣感与低频轰鸣的混合氛围。电影艺术风格镜头能量:极具张力的眼神凝视微距特写、充满力量感的低角度微颤仰拍、展现复杂操控的垂直俯视几何构图(上帝视角)、广角畸变带来的极限前倾压迫感,以及突显古典神圣与现代狂热的高级反差。 最终节拍(神圣升华与灵魂释放)在史诗般的低角度仰拍与极具爆发力的神圣背光下修女双手高举直指穹顶,呈现完美的弥赛亚式救世主姿态,如同神圣光环般的逆光在身后炸裂,画面保持静谧且充满张力的1秒,展现极致的信仰洗礼、终极DROP的余波与史诗般的绝对统治感

          然后把刚刚生成好的牛头故事板,和刚刚给大家的文本一起拉到一个文本节点里,模型选择gemini 3.1 pro,输入下方的提示词。

          prompt:现在根据文本节点中的提示词结构,需要严格按照文本节点提示词的写作形式和表述方式帮我重新编写一段视频提示词、围绕的@图1内容进行生成。

          图片

          然后,文本框里面就会反推出

          可以适用于Seedance2.0直出的视频提示词,

          图片

          现在故事板的提示词也生成好了,接下来万事俱备只欠东风。

          按照这样的方式,

          第二个故事板的提示词也这样操作,第三个也是一样.......

          04生成分镜

          从第一步生成好的角色板,第二步生成好的故事板,第三步生成好对应故事板适配seedance2.0的提示词。

          现在到了最后一步,出分镜。

          把角色板、故事板、主体角色都拉在一个视频节点里,并且使用Seedance2.0模型,选择全能参考,把提示词复制进去,

          将角色板、第一个分镜的故事板、主体角色在对应的提示词位置放好。

          图片

          第一个故事板的视频提示词如下:

            使用故事板参考{{Image 2}} 作为15秒视频的完整视觉和情感叙事来源。从左到右、从上到下依次遵循所有12个节拍。不要重新诠释动作、构图、镜头角度或从神圣肃穆到狂暴律动的极致氛围递进。保留故事板的镜头顺序、从寂静蛰伏到低频轰炸的动静反差逻辑、从极简特写到上帝视角的构图多样性,以及最终的极致爆发与崩塌谢幕定格。将完整的12节拍序列压缩到15秒内。每个节拍必须清晰呈现为充满节奏爆发力与野性掌控感的动作快照。使用极具视觉冲击力的硬切转场、凌厉的动作匹配剪辑与微颤推进(如从粗壮手指急速旋钮无缝衔接狂野的搓盘动作,再到猛烈推下推子引发的画面震颤)在最终节拍之前,保持牛头人极度充满力量感的精准操控与庞大身躯随重低音狂暴摇摆的紧凑情绪交替。保持与角色参考相同的绝对核心主体身份:身躯庞大且肌肉虬结的牛头人、佩戴重型专业DJ耳机、眼神极具压迫感与原始狂热的巨兽{{Image 3}} 。这个是角色板{{Image 1}} ,不要改变它的外貌与狂暴特征。整个过程中持续展现极具律动感与视觉张力的动作流:布满浅景深的快速旋钮扭动、粗壮手臂大幅度横扫的搓盘残影、猛烈下压推子时的野兽般力量爆发、巨大的牛角随着低频重击在低角度仰拍下狂野甩动,以及从寂静中的觉醒者到掌控全场的电音巨兽的绝对精神压制。环境:充满肃穆感的宏伟神殿或哥特式教堂内部、被雾气充斥的建筑中殿、交替出现的穿透高窗的神圣顶光与随着节拍爆发的动态脉冲光(神圣与狂暴的碰撞)、充满神圣感与低频轰鸣的混合氛围。电影艺术风格镜头能量:极具张力的野兽眼神凝视微距特写、充满力量感的低角度微颤仰拍、展现复杂操控的垂直俯视几何构图(上帝视角)、广角畸变带来的极限前倾压迫感,以及突显古典神圣与现代电音狂热的高级反差。最终节拍(力量爆发与灵魂释放)在史诗般的低角度仰拍与极具爆发力的神圣背光下,牛头人双臂高举直指穹顶,呈现极致张力的狂野姿态,如同神圣光环般的顶光在身后炸裂,随后迅速转入身体崩塌、头颅低垂的终章静默,画面在死寂与余韵中保持充满张力的1秒,展现极致的声压爆表、终极DROP的余波与史诗般的绝对统治感。

            出来的效果:

            接下来咱放上第二个分镜的故事板还有对应的生成提示词,

            图片

            第二个故事板的视频提示词如下:

              使用故事板参考@图片生成,作为15秒视频叙事源。依次遵循12节拍。勿改动作、构图或从破云升空到星际共鸣的氛围递进。保留镜头顺序、从原始野性到宏大宇宙的动静反差、多维视角构图,及最终的双星连约定格。将12节拍压缩至15秒。节拍须呈爆发力动作快照。使用硬切与动作匹配剪辑(如从音浪冲刺衔接月表重踏,到光束轰击地球的震颤),保持巨兽狂野与宇宙能量的情绪交替。核心身份:魁梧狂野、充满压迫感的牛头人巨兽@Minotaur DJ Gothic Cathedral,角色板为@图片生成勿改外貌特征。展现张力动作流:腾空破云、重踏扬尘引发冲击波、展臂建立月球据点与掌控星际音波的绝对压制力。环境:云层气流、荒芜月表、浩瀚星海与地球全景。镜头能量:极具力量的低角仰拍、太空跟随长镜头、上帝俯视角及跨星际的宏伟反差。最终节拍(月地共鸣)在居中对称构图下,地球与月球被可视化声波链路稳定连接,画面静息张力1秒,展现极致的万物共振与史诗级的宇宙主宰感。

              出来的效果:

              05后期处理

              根据分镜的一些特征,咱具体的做一些简单的剪辑处理,

              让整体的作品表现的更加好一些,BGM感觉直接生成的已经很带劲了,后期自己配上也可以,只需要卡上点就行。

              图片

              老样子,就把成品放在开头了。

              最后

              这篇文章,写的比较长,能耐心看完的各位也是人中龙凤了。

              有人问我,做AI视频最难的是什么。我以前会说是提示词。 后来我说是抽卡的运气。 

              现在我觉得,是那个"不知道从哪开始"的感觉。

              今天这套方法,解决的就是这个问题。 

              不是给你一张答案纸,是给你一张地图—— 角色在这,故事板在这,提示词在这,出口在这。

              剩下的,是你自己的故事。

              今天就说到这,

              辛苦大家看到最后,欢迎大家推荐、点赞、关注、点⭐推荐给更多人,在此感谢每一位读者!!!
              文章标签AI资讯
              资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

              继续浏览更多资讯

              返回资讯目录

              相关资讯

              更多