


https://app.tapnow.ai/event/35?tap_referral=aisjxh_gzh_20260604

https://app.tapnow.ai/home/challenge?tap_referral=aisjxh_gzh_20260604


我要参加一个MV比赛,比赛要求是xxxxxxx(这一块你直接把比赛要求复制进去)请你根据这个比赛的要求,帮我创作一个押韵,快节奏说唱,中国风旋律的歌词脚本。内容要包含xxxx。
内容这一块你就写上你想要的元素,越详细越好,因为这会直接体现出你歌词创作的内涵,歌词在MV的地位是很重要的。
我是结合我自己小时候的经历,在老家的稻田里被土狗追、趴在村里和小伙伴一起弹玻璃珠,看谁能把对方的玻璃珠子碰进洞里,那对方的玻璃珠就是你的。
然后也想起小学的时候在深圳的网吧里玩qq飞车、赛尔号,

在家里和小伙伴一起看果宝机甲,在学校走廊里和伙伴们嬉闹,在课室里昏昏欲睡的翻书,也去补习班进修过两个月的英语。

后面想一些升华天马行空的桥段加进去,例如在月球,在火星这些......
说这么多,要不说好的创作来源,离不开现实生活呢?尽管现在AI这么厉害,内核还是需要回归到现实与观众产生共鸣。


书包压弯我的腰考试排名像火苗老师说别输起跑我只想丢掉那套舞蹈钢琴补习班 周末排得高提高成绩的卷子 永远写不到
像我歌词的前面开头,是陈述以前经历去作为MV的开篇,里面有六句话,每一句话可以单独生成一个场景图。也可以两两组合生成一个场景图。
生成场景的时候,我给会先找一个对标的风格,类似下面这一张。

然后再右下角的Agent里面,把这张图丢上去,结合我们的歌词,第一个场景可以生成学校和补习班相关的画面。

给Agent一个参考,让它学习一下氛围和风格,然后再描述一下接下来主体需要做的动作,还有背景的内容,再一次的强调风格以及出图比例。
如果它生成的风格比较相似,但是主体发生变化了,可以继续在Agent的位置,把需要替换的主体,以及出镜的站位跟它说一下就完事了。

还有另一种方法,可以直接在画布的这个参考图旁边拉一根工作线出来,选择图像生成,采用同样的提示词,使用g-2模型,效果也是立竿见影。

出来的效果,

按照这样的思路,再出一个补习班背景的。
在刚刚直出的场景后面,紧接着在跟上图像生成的工作线,模型依旧g-2,接着提示词重点描述背景,保持风格和人物一致性即可。
别说太多,也别说太杂太乱,这样会得到不太好的效果,你用简简单单的口语表达,反而出来的更加准确。
prompt:(参考图)保持风格还有主体人物的一致性,背景换成空间更小的补习班,也要有剪影效果。

出来的效果,

这个图的场景明显更小,而且人数也更少,说明理解了我们表达的需求。
按照这样的方式,把每一段歌词所能提取的场景搭建好,然后出场景图即可。
接下来不出意外,大家会遇到下一个难题。
雕塑已经在石头里了,他只是把多余的部分凿掉,
一句歌词里,核心元素会很多都在,难的不是找到它,是有勇气把其他的舍掉。
《头脑特工队》里Joy抱着所有记忆不肯放手,反而什么都救不了。真正推动故事的,是Sadness抓住的那一个最重的情绪。

例如,骑上机器马,环形山兜风绕。星际飞船启动,月球基地搭好。




因为以往在视频模型中,你是需要先将图片拖到画布、连线到视频节点、然后才可以在输入框中 @ 这个节点。

很多人看到这个,又是拉线又是@的步骤老多了、操作很碎,尤其当素材在画布上找不到时更是难蹦。
如果你把图片已经丢进,素材库里的文件夹,那这个情况就解决了。
在调用视频模型的 Prompt 输入框中输入 "@" 符号,会弹出一个三区联动的素材面板。@ 之后有两种使用方式,

这两种方式,一是你知道素材在哪个文件夹放着,二是你知道这张图片的名称关键词是啥,直接在上面搜索就可以直接弹出了。
只要你上传过图像,单独的建立视频节点,不用在拉线搞这么复杂了。
这两种方式,从效率上有本质的区别,
在都上传好参考图的情况下,
对比旧版流程(拖拽→连线→@)

新版流程(直接 @)

经过以上的实操对比,我发现新版操作时间比旧版快两倍,当然如果你知道关键词,直接输入的话应该会更快。

prompt:红孩儿坐在椅子上随着韵律在摇头晃脑的快速狂暴的弹吉他,背景的学生们在低着头写作业。环绕运镜,灰蒙蒙的氛围感,暗黑电影高级质感,不要出现背景音乐,仅保留音效,不要出现字幕。


prompt:红孩儿站在走廊上,跳舞式的扭动身体,快速的弹奏吉他,随着韵律在点头摆头,衣服很飘逸。背景的学生们在嬉戏打闹。环绕运镜,灰蒙蒙的氛围感,暗黑电影高级质感,不要出现背景音乐,仅保留音效,不要出现字幕。

prompt:红孩儿,沉浸式的激烈的扭动着身体,快速的弹奏吉他,随着韵律在点头摆头,衣服很飘逸。创作的目的是做出时尚的音乐MV,以高速FPV镜头,环绕穿梭飞行镜头保持高速运动。让整个镜头具有忧虑的动态感,氛围感,高级感,镜头流畅电影质感。不要背景音乐,需要音效,不要字幕。

prompt:红孩儿沉浸式的激烈的扭动着身体,快速的弹奏吉他,随着韵律在点头摆头,衣服很飘逸。创作时尚音乐MV,高速FPV镜头,环绕穿梭飞行镜头保持高速运动。氛围感,高级感,镜头流畅电影质感。不要背景音乐,需要音效,不要字幕。

prompt:红孩儿抱起吉他,摇头晃脑的开始弹唱,背景的飞船也开始点火升空,创作的目的是做出时尚的音乐MV,以高速FPV镜头,环绕穿梭飞行镜头保持高速运动。让整个镜头具有忧虑的动态感,氛围感,高级感,镜头流畅电影质感。不要背景音乐,需要音效,不要字幕。





https://app.tapnow.ai/home/taptv/3/5c61b73f-ea90-48d8-987d-244e985e4edf?tap_referral=aisjxh_gzh_20260604
看到这,说明你已经具备了创作完整MV的基本认知。
说实话,我肝了9个小时做出来的东西,音乐还有提升空间,运镜衔接也略显生疏,但这不妨碍我把这套流程完整走了一遍。

就像第一次骑自行车,歪歪扭扭的,但确实是动起来了。

这是我做出的作品,还可以最大化利用。
放到 TapTV 竞技场,
如果被认定为优质,曝光、奖励、IP 孵化、创作者扶持计划全向你倾斜——变现,不止表层。
因为目前TapTV 不只是个 AI 社区。里面的「竞技场」是专门给创作者留的通道,

30+ 场全球赛事,阿里云、SXSW、罗马 AI 电影节、旧金山 48h 黑客松……每一场都是真刀真枪的全球舞台。
算力支持、后续开发机会、可持续内容形态——相信这套东西会推着你的作品走得更远。
我的《红孩儿》是我交出的第一份答卷,并且把但只是个开始。
你的第一个,什么时候开始?







