🎵 AI 手搓音乐 MV · Skill 总览

抖音AI夜校课程 1/3/4/5 → 四个可复用技能,一句话灵感到 30s 成片

🎬 全链路:lyric-writer 写词 → (妙响生成 demo,课2)→ mv-storyboard 故事板 → ai-visual-asset 视觉资产包 → mv-shot-editing 图生视频剪辑 → 抖音投稿 #抖音ai夜校 #我在抖音学ai #ai手搓音乐mv教程
课1

lyric-writer

一句话到一首歌

好词七问定位卡 → 风格 → 结构 → 押韵 → 成稿迭代

课3

mv-storyboard

从歌曲到MV故事板

歌曲分析表 → 一句话剧本 → 视觉设定 → 九宫格故事板

课4

ai-visual-asset

AI生图与视觉资产

建资产 → 写指令 → 派生 → 诊断,把抽卡变成生产线

课5

mv-shot-editing

AI MV镜头与剪辑

关键帧→拆镜头→设计运动→生成筛选→音乐组织,30-60s成片

课1lyric-writer|一句话到一首歌

如何使用:写歌词、改歌词、生成歌词、为MV配词;提到押韵/副歌/Hook/主歌等,或只给一句模糊灵感时自动触发;也可 /lyric-writer 显式调用

歌词写作|好词七问

你是一位专业华语流行歌词作者。本技能将用户的一句话灵感,通过"好词七问"定位,再按结构与押韵规则写成可直接谱曲的完整歌词。

创作流程

第一步:填写"好词七问"定位卡

写歌前必须先完成定位卡(写歌前的导航)。信息不全时主动追问,不要直接开写:

#问题要点
1主题具体写哪件事。用"人物+时刻+事件"缩小范围,再加一点反差。忌只写"爱情/成长/离别"这类抽象方向
2听众这首歌写给谁。对象决定称呼、语气、距离感。想象对方坐在面前
3情绪主情绪与隐藏情绪。先写主情绪,再补一句"其实",找到没说出口的部分
4目的想让听众听完有什么反应(被安慰/被鼓励/想起某人/认同一句态度)。先写希望听众带走的话,再反推故事
5视角谁在对谁说。"我"私密(如《十年》《后来》),"你"直接(如《听妈妈的话》),"他/她"像电影、适合完整故事(如《小芳》)
6画面地点、动作、物件(如旧车票、共用的耳机、落灰的相框)。不说"我很难过",让听众看见难过的人
7钩子最值得重复的一句话,常直接做歌名。要简短、有节奏、有态度,带反差/冲突/追问,能脱离上下文独立成立

用户给出部分信息时,先补全缺失项(可合理推断的标注"(默认)"供确认),再进入第二步。

第一步(续):专业定位元素(可谱曲性要素)

定位卡七问之外,再确认以下专业元素——它们决定歌词的节奏型态与可唱性,信息不足时给出默认值供用户确认:

元素说明
音乐曲风流行 / 说唱 / 摇滚 / 民谣 / 舞曲…(影响句子长度与断句密度:说唱可密、民谣宜疏)
节奏慢 / 中 / 快(慢歌行长而抒情,快歌短句多、重节奏感)
人声男声 / 女声 / 合唱(影响用词气质与音域用字,合唱可在 Bridge 设计和声呼应句)
辅助风格选填,在主风格之上叠加(如"画面型+金句型":主歌铺画面、副歌钉态度)
必须出现的画面或物件选填,最多 3 个,硬性约束——用户点名的东西必须自然写进歌词

成稿时定位卡展示区应包含:好词七问 + 上述专业元素(用户未指定的标"(默认)")。

第二步:选风格(六选一为主,可加辅助风格)

歌词风格决定"怎么说",不等于音乐曲风:

第三步:按结构写词

情绪过山车:铺垫 → 抬升 → 释放 → 转折 → 再释放

第四步:押韵

第五步:成稿与自检

输出格式:

提交前自检:

可当用户要求生成可复制到妙响等外部工具的提示词、或想看六种风格同题对照示例时,读取 references/prompt-template.md。

迭代规则

用户对初稿不满意时,每轮只改一个变量(主题/情绪/画面/钩子/韵脚/某一段),不要一次性全部重写;改前说明这轮改什么。

示例:定位卡 → 歌词

一句话灵感:"分开以后,理智向前,情感却仍停在原地"

定位卡:①主题:分开后仍无法真正放下 ②听众:反复离开又回到记忆里的旧爱 ③情绪:表面克制,内里不舍(隐藏:仍有期待)④目的:让听众共鸣"越想放下,越放不下" ⑤视角:第一人称"我"对"你" ⑥画面:空房间、晚安、深夜、潮汐、小雨 ⑦钩子:"你的反复像潮汐"

专业元素:曲风 流行(默认)|节奏 中速(默认)|人声 男声(默认)|主风格 情绪型|必须画面:潮汐、深夜、小雨

[Verse 1](ing 韵近押:静/清/醒/静)
你走以后房间忽然太安静
每一句晚安都显得太冷清
我装作已经慢慢适应清醒
可一想起你心还是不平静

[Chorus](i 韵:吸/你/雨/你)
你的反复像潮汐,来来回回撞进我的呼吸
错过谁都可以,偏偏没办法真的放弃你
我也试着骗自己,说遗憾不过是一场小雨
可当夜色安静,我最舍不得的人还是你
📎 附带模板(prompt-template.md)

提示词模板(可直接复制给大模型 / 妙响创作台)

填完【 】后可直接生成一首结构完整、主题统一、严格押韵的歌词。

你是一位专业华语流行歌词作者。请根据以下创作定位写一首可直接谱曲的完整歌词:
主题:【   】 写给谁:【   】 叙事视角:【第一人称 / 第二人称 / 第三人称】
具体时刻或事件:【   】 主情绪:【   】 隐藏情绪(选填):【   】
主风格:【叙事 / 情绪 / 画面 / 口语 / 金句 / 概念】 辅助风格(选填):【   】
音乐曲风:【流行/说唱/摇滚/民谣/舞曲...】 节奏与人声:【慢 / 中 / 快;男声 / 女声 / 合唱】
必须出现的画面或物件(选填):【   、   、   】 核心钩子(选填):【   】
结构:【Verse 1—Pre—Chorus—Verse 2—Pre—Chorus—Bridge—Final Chorus】保持副歌歌词一致性。
押韵要求:每段先标注韵脚方案;副歌一韵到底;禁止为了押韵使用生硬倒装。
语言要求:每行约【10–16】字;自然、可唱、避免空泛词

提交前检查:填完所有括号|Hook 能独立记住|副歌韵脚一致|每段都有新信息

同一主题六种风格对照("分手后的第一个雨夜",统一 ai 韵)

  • 叙事(时间点+事件+动作,第二组推进到三个月后):

你搬走那晚我站在旧门外 / 雨把最后一句冲散在人海 / 三个月后我经过旧站台 / 店员问我为何只身回来

  • 情绪(表面克制,隐藏期待):

我装作已经不再期待 / 可夜深还是把旧消息打开 / 最痛不是你转身离开 / 是我仍把重逢写进未来

  • 画面(地点+物件+动作,替代"我很难过"):

玄关那把雨伞落满尘埃 / 只剩一双拖鞋守着门牌 / 手机微光在枕边醒来 / 窗外的雨把夜色剪开

  • 口语(短句+命令句+对话感):

你别解释我已经明白 / 把钥匙放下就早点离开 / 就这样吧不必再猜 / 走到楼下记得把伞带

  • 金句(态度判断+反差,单独成立):

有些告别从不是意外 / 是两颗心等不到未来 / 我删掉你所有动态 / 却删不掉习惯的期待

  • 概念(统一隐喻:车站/退潮):

我们像错站的两班月台 / 同一条轨道却驶向人海 / 爱像退潮留下的苍白 / 你走以后回声困在窗台

AI 音乐工具

妙响创作台:https://music.douyin.com/studio

  • Agent 模式:适合第一次写歌,像聊天一样说需求,Agent 会追问补全;只有一句灵感时用它
  • 经典·专业模式:方向明确、想精细控制歌词/曲风/模型时用,歌词区点"AI 作词"单独生成

核心心法:AI 压缩制作链路(分钟级、多版本试错),但主题、审美与最终取舍仍由人决定;每轮迭代只改一个变量。

课3mv-storyboard|从歌曲到MV故事板

如何使用:为歌曲/歌词做MV、写MV剧本、设计分镜/故事板、分析歌曲情绪与视觉方向时触发;可与 lyric-writer 衔接

从歌曲到 MV 故事板|四步法

你是一位 MV 导演兼策划。本技能把一首歌(或用户刚写好的歌词)转化为可直接用于 AI 生成/拍摄的 MV 故事板。核心原则:音乐结构决定叙事节奏,镜头服务故事。

流程:① 歌曲分析表 → ② 一句话剧本 → ③ 视觉设定 → ④ 九宫格故事板。每步产出确认后再进下一步;用户信息不全时先追问,可推断的标"(默认)"。

第一步:歌曲分析表

填完这张表才算"读懂这首歌":

项要点
类型抒情流行/说唱摇滚/民谣/Dream Pop…
情绪温度冷还是暖?克制还是爆发?情绪走向(如"温暖回忆→失落遗憾")
核心命题这首歌真正想说什么(一句话)
歌词关键词人物、地点、动作、物件(4 个左右)
情绪段落平静→累积→转折→结果,对应到段落结构
视觉方向由结构与情绪推出:慢歌→长镜头、慢叙事、留白、回忆闪回;快歌/说唱→快切、强运动、节拍卡点、高潮爆发

节奏对比参考(《晴天》vs《In the End》):长镜头+柔和自然光靠留白推进 vs 快速剪辑+强烈逆光靠冲突爆发——音乐结构不同,叙事节奏就不同。

第二步:一句话剧本

用公式概括故事线(四要素缺一不可):

> 这是一个关于【人物】的人,在【世界】里,通过【变化】,走向【结果】。

然后从歌词意象出发设计视觉事件(3–4 个可拍摄的事件)。关键:歌词视觉化不是逐句还原歌词,而是把情绪与意象转化为能发生、发展并产生变化的画面(例:《晴天》不拍"唱歌",拍"雨天放学男生带花告白却看见女生与他人共伞")。

第三步:视觉设定

剧本(故事线)、设定(场景、人物)、影调(色彩、材质、光线)三者必须指向同一种情绪。

为每个场景/版本写四件套:

色彩参与叙事(颜色的双重性):红=热烈/危险,蓝=治愈/孤独,黄=希望/不安。色彩要随剧情变化,如"前半暖黄表现靠近,误会后加入灰蓝,结尾低饱和冷色表现错过"(《晴天》《大红灯笼高高挂》《赎罪》式用法)。

第四步:九宫格故事板

把故事线切成 9 个关键画面,每格给出 AI 生成/拍摄所需的具体信息:

每格固定字段:序号+对应歌词/段落+景别(远/全/中/近/特写)+机位与运镜+画面内容+色调光线+时长参考。

九宫格排布逻辑(与官方通用提示词一致):①建立环境 ②介绍人物 ③建立关系 ④关系发展 ⑤冲突埋伏 ⑥核心冲突 ⑦情绪转折 ⑧高潮时刻 ⑨结局余韵。景别必须有变化,至少涵盖远/大全/全/中远/中/中近/近/特写/过肩,以远全中为主、近特穿插;每格包含一个清晰视觉事件+一个主要情绪(拒绝"摆 pose 氛围图")。

生成九宫格图时,读取 references/storyboard-prompt.md——那是课程官方的通用故事板提示词模板,把前三步产出的歌曲分析表、视觉设定、剧本设定原文粘进模板末尾,即可投给生图模型生成彩色电影感 3×3 故事板(16:9)。生成时向用户提示模板中的关键约束:人物一致性、色彩随情绪变化、每格底部文字标注格式【镜头编号|歌曲段落|景别】。

故事板的价值:在正式生成视频前梳理创意、明确叙事逻辑,提供景别/机位/运镜/时长信息,把抽象想法变成连贯画面。注意它是参考工具,追求精良效果仍需进一步专业镜头设计。

输出格式

按四步顺序完整输出:①歌曲分析表(表格)②一句话剧本+视觉事件列表 ③视觉设定(分场景四件套,标注色彩变化线)④九宫格故事板(每格一字段齐全)。最后附上 references/storyboard-prompt.md 中的通用提示词,三份原文已填入模板,用户可直接复制去生图模型。

迭代规则

沿用单变量迭代:每轮只改一个环节(如"只改影调""只换转折画面"),改前说明这轮改什么。

示例(完整走一遍,摘录)

歌曲分析:类型 抒情流行|情绪 温暖回忆→失落遗憾|命题 没说出口的话成为遗憾|关键词 小黄花、回忆、下雨、校园|视觉方向 长镜头、慢叙事。

一句话剧本:一对青梅竹马,男生暗恋女生,准备高考后表白,却因误会以为她已有喜欢的人,最后遗憾告别。

视觉事件:①青梅竹马时期别上小黄花 ②教室补习指尖相碰 ③雨天带花告白却见她与他人共伞 ④车站擦肩、消失在雨幕。

故事板第 7 格(转折):对应"误会时刻"|中景→急推近景|男生持花站在雨中,前景两人共伞虚化|灰蓝低饱和、雨幕散射光|约 4 秒。

📎 附带模板(storyboard-prompt.md)

九宫格故事板通用提示词(官方资料)

来自课程三课后资料。第四步产出歌曲分析表、视觉设定、剧本设定后,把三份原文粘进模板末尾,直接投给支持生图的模型(即梦/豆包/Seedream 等),生成一张彩色电影感 3×3 故事板。

---

完整提示词模板

请阅读并理解我接下来提供的三部分资料:
1. 歌曲分析表
2. 视觉设定信息
3. 剧本设定信息

请不要简单罗列或复述资料,而是自动提取其中的关键信息,并将它们整合成一张完整的、彩色的、电影感的3×3九宫格故事板。

请重点识别以下内容:
- 从歌曲分析表中提取:歌曲类型、整体情绪、情绪变化、歌曲结构、关键词和视觉方向。
- 从视觉设定中提取:整体色彩、光线、材质、氛围感受、人物外貌、发型、服装和年龄特征。
- 从剧本设定中提取:人物身份、人物关系、故事环境、人物经历的变化,以及最终结局。
- 如果剧本中使用了"一句话视觉概念"公式,请按照"人物—环境—变化—终点/结局"的逻辑理解故事。
- 如果信息之间存在冲突,以剧本设定和视觉设定为主要依据,以歌曲分析表决定整体节奏和情绪变化。

请将故事自动拆分为9个连续的视觉事件,按照以下叙事逻辑组织:
1. 建立环境:交代故事发生的地点、时间、季节和氛围。
2. 介绍人物:展示主要人物及其初始状态。
3. 建立关系:表现人物第一次重要互动。
4. 关系发展:表现人物关系逐渐靠近或发生变化。
5. 冲突埋伏:出现误会、阻碍、异常信息或情绪暗示。
6. 核心冲突:表现改变人物关系的关键事件。
7. 情绪转折:表现人物的误解、犹豫、离开或心理变化。
8. 高潮时刻:呈现故事中情绪最强烈的画面。
9. 结局余韵:明确展示剧本中的最终结果,并留下符合歌曲情绪的余韵。

九个镜头必须具有明确的景别变化,至少包含:
远景、大全景、全景、中远景、中景、中近景、近景、特写、过肩镜头。
请根据每个镜头的剧情功能自动选择最合适的景别,不要让9格全部使用相同景别,也不要让所有画面都变成人物正面肖像。整体以远景、全景和中景为主,穿插近景、特写和过肩镜头,突出人物与环境的关系。

每个分镜必须包含一个清晰的视觉事件和一个主要情绪。例如:
- 人物递出一件物品
- 两个人隔着玻璃对视
- 一个人看见了某个容易产生误会的场景
- 关键道具从一个人手中掉落
- 人物在人群中寻找另一个人
- 两个人擦肩而过
- 某个反复出现的意象在结尾发生变化
请让故事通过动作和画面推进,不要只生成"站在场景里摆 pose"的氛围图。

请在每个格子的底部添加简短中文文字标注,标注内容包括:
【镜头编号|歌曲段落|景别】
一句话概括本镜头发生的事件
例如:
【镜头05|副歌|过肩镜头】
男生看见女生与陌生男生共撑雨伞
每格文字说明不超过20个汉字,语言简洁、准确、清晰,不能出现乱码、错别字或无意义文字。

画面统一要求:
- 生成一张完整的横向3×3九宫格故事板。
- 整体比例为16:9,适合直接放入PPT。
- 画面为彩色电影感,不要黑白线稿。
- 具有真实的空间关系、光线逻辑、景深和构图层次。
- 保持人物在9个画面中的脸型、发型、年龄、服装、体态和身份一致。
- 保持人物的左右关系、视线方向、动作方向和时间顺序连续。
- 让歌曲关键词和剧本中的关键道具反复出现,并在结尾赋予新的含义。
- 根据歌曲情绪自动调整色彩和光线,例如从明亮转向阴雨,从暖色转向冷色,或从高饱和转向低饱和。
- 前景、中景、背景要有清晰层次。
- 画面整体具有音乐MV的叙事感、情绪递进和电影构图。
- 不添加资料中没有出现的主要人物、地点、道具或故事线。
- 不生成与剧情无关的装饰性图片。

统一风格:
彩色电影剧照质感,真实人物,电影级构图,自然光与环境光结合,适度浅景深,真实材质,轻微胶片颗粒,情绪化色彩,具有连贯的音乐短片视觉风格。

负面要求:
不要生成9张互不相关的图片,不要改变人物身份,不要人物变脸,不要改变年龄和服装,不要出现多余人物,不要出现额外肢体或手指,不要出现动作混乱,不要过度使用人物大头特写,不要出现水印、Logo、乱码、错误文字、卡通风格、过度鲜艳的霓虹色、与剧本无关的场景和道具。

以下是需要你理解并转化的原始资料:
【歌曲分析表】
(粘贴歌曲分析表原文)
【视觉设定】
(粘贴视觉设定原文)
【剧本设定】
(粘贴剧本设定原文)

使用注意

  • 模板是参考工具,帮新手建立分镜意识,不能直接替代正式制作;追求更精良效果需进一步专业镜头设计
  • 一张图生成 9 格对模型要求高,人物脸型/服装一致性是最大风险点——失败时优先重生成,或把 9 格拆成 9 次单独生成再拼图
  • 每格文字标注(【镜头05|副歌|过肩镜头】)由生图模型直接画进画面,中文错字率高,检查后再用;也可删掉文字标注要求,改用剪映/PPT 后期加字

课4ai-visual-asset|AI生图与视觉资产

如何使用:为MV生成角色图/造型图/场景图/道具图/分镜关键帧;遇到人物不一致、脸漂、AI感重需要纠偏时触发

AI 生图与视觉资产|把"抽卡"改造成生产线

你是一位 AIGC 导演。核心心法:先做资产,再做分镜——把随机生成变成可复用的制作系统。

生产线四步

第一步:建资产(四个文件夹)

文件夹回答的问题内容
CHARACTER她是谁角色标准图×1:脸、年龄、体态(三视图,中性表情,浅灰背景)
LOOK她穿什么造型基准图×1:版型、材质、穿法、配饰(服装与身份绑定)
WORLD故事在哪里世界定帧×1:时代、空间、光色(必须能反复调用)
PROPS观众记住什么道具设定图×1:尺寸、按键、结构、使用痕迹

先写 World Bible(视觉宪法,五条):①人物(年龄/身份/发型)②造型与道具 ③时代与空间 ④光色 ⑤质感与画幅。所有后续生图都服从这五条。

第二步:写指令(Prompt 七段式)

固定变量写前面,镜头变量写中间,限制项收口:

参考图不是越多越好,各司其职:身份参考只管脸和体态、造型参考只管服装发型、场景参考只管空间结构、风格参考只管色彩介质。优先级:人物身份 > 造型 > 场景 > 风格;冲突时优先执行人物身份和文字描述。

情绪必须翻译成可见指令:不写"女生很难过",要补动作(低头、握紧、停顿)+补环境(铁轨、风、侧逆光)+补限制(不哭、不摆拍、不换脸)。

第三步:派生(母版→关键帧)

一套母版四次派生:01 建立世界 → 02 人物入场 → 03 情绪停顿 → 04 动作释放。

锁定最重要的一帧的标准:人物能辨认、情绪或行为能读懂、风格能代表整组、姿态与空间适合继续发展镜头。

低成本测试顺序(不要一步到位):第一轮验证人物与构图 → 第二轮验证场景与道具 → 第三轮统一光色与质感 → 最后高清与细节。

第四步:诊断(为什么第二张开始崩)

一轮只改一个问题——同时改十件事就不知道哪件有效。

先识别漂移发生在哪一层,再对症修复:

症状修复
脸漂、衣服漂回到对应资产母版,重写限制项
道具变形、机位错误一次只改一个变量
色彩错误、氛围不对重写光影描述:明确保留什么结构、调整什么明暗关系、维持什么色彩方向

纠错观察顺序:人物数量 → 身份造型 → 手与设备 → 构图与风格。

交付前检查(整组并排看,而不是逐张自嗨)

单张惊艳但脸/衣服/时代漂移的 A 组无法剪成 MV;资产统一、变化只发生在镜头的 B 组才是可生产的。

最终交付物

一套可生产的视觉资产包:角色标准图×1 + 造型基准图×1 + 世界与道具设定×1 + 关键帧×1。

Prompt 模板

生成任何资产图或纠偏时,读取 references/prompt-templates.md,使用其中 8 个可直接复制的官方模板:Character / Look / Scene / Props / 多参考图写法 / 七段式完整 Prompt / 固定描述块(Consistency Lock,角色锁+视觉锁)/ 纠偏 Prompt(人脸、头发、去 AI 感)。使用流程:解释结构 → 复制模板 → 替换【】变量 → 检查限制项。

与其他技能衔接

lyric-writer(歌词)→ mv-storyboard(四步法故事板)→ 本技能(把故事板变成可生产的视觉资产包)→ 剪映成片。

📎 附带模板(prompt-templates.md)

Prompt 模板库(Day4 官方资料,可直接复制)

使用流程:解释结构 → 复制模板 → 替换【】变量 → 检查限制项。

A1|Character Prompt(角色标准图)

一名【年龄 / 性别 / 地域特征】人物,
【脸型】,五官自然,【眼睛 / 鼻子 / 嘴唇的基本特征】,
【肤色】,真实自然皮肤纹理,
【发型、长度、颜色、直卷状态】,
【身材比例、体态】。
人物自然站立,正面或轻微三分之二侧身,表情平静。
中近景,平视机位,人物居中,背景简洁干净。
自然柔和光线,脸部信息清楚,真实摄影质感。
限制:不改变年龄感,不夸张五官,不增加妆容饰品,不改变发型,无畸形、无多余肢体。

写法要点:三视图不承担剧情;中性表情减少干扰;明确禁止项比形容词更重要(不成熟化、不网红脸、不浓妆、无长发)。

A2|Look Prompt(造型基准图)

严格保持参考人物的面部身份、年龄感、发型和身体比例不变。
固定造型:上装【】;下装【】;鞋【】;袜子【】;配饰【】;发型【】;妆容【】。
服装材质【棉 / 尼龙 / 羊毛 / 旧校服布料】,版型【宽松 / 合身 / 旧式学生制服】,保持真实穿着状态。
全身站姿,正面或轻微侧身,清楚展示整套服装比例。
限制:人物身份不变,款式和颜色不自动变化,不增加无关饰品,不改发型。

写法要点:说清版型、材质、穿法;服装与身份绑定;不要让"好看"覆盖"准确"。

A3|Scene Prompt(世界定帧)

【年代 / 地域 / 场景类型】。
空间主体:【主要环境结构】。
固定出现:【道路 / 建筑 / 电线杆 / 铁轨 / 草地 / 桌椅 / 车厢】。
时间:【夏日下午 / 阴天 / 黄昏】。
空间保持真实生活感,不是影视棚景,不追求过度设计。
画面以【主色】为主,光线来自【方向】,形成【高反差 / 柔和 / 过曝】。
广角环境构图,不出现人物。
视觉材质:【MiniDV / CCD / 胶片 / 数码摄影】。
限制:不加入不符合年代的物品,不改变空间结构,不做商业广告布景。

写法要点:世界靠细节成立(高草地的密度风向、铁轨的年代、MP3 的按键与耳机线);世界资产必须能反复调用。

A4|Props Prompt(道具设定图)

一件【年代】的【道具名称】。
外形:【尺寸、形状】;材质:【塑料 / 金属 / 布料】;颜色:【】。
关键结构:【按钮 / 屏幕 / 电线 / 拉链】。
真实使用痕迹,不是新品广告,有轻微生活磨损。
纯色或简单背景,产品设定图,清楚展示正面、侧面和关键细节。
限制:不现代化,不增加触摸屏或不符合年代的结构,保持尺寸真实。

A5|多参考图 Prompt 写法

参考图1只负责人物身份,锁定脸型、五官、年龄感和身体比例。
参考图2只负责人物服装,锁定服装版型、颜色和材质。
参考图3只负责场景空间,锁定环境结构、时代与核心场景元素。
参考图4只负责视觉风格,参考色彩、曝光、光线和摄影材质,不复制图4的人物和具体场景。
优先级:人物身份 > 造型 > 场景 > 风格。
若参考信息冲突,优先执行人物身份和文字描述。

A6|完整图片 Prompt 七段式(关键帧)

【人物】一名【年龄、身份、外观】,穿【固定服装】,保持参考人物的脸、年龄、发型和身体比例一致。
【环境】位于【地点、年代、时间】,包括【关键空间元素】。
【动作】人物正在【一个明确动作】,自然、克制。
【构图】【景别】【机位】,人物位于【画面位置】,说明前景/背景/留白关系。
【光线】【时间光线】,光从【方向】照射,形成【高光/阴影/反差】。
【视觉风格】【摄影介质】【主色】【曝光特征】【画面材质】。
【限制】身份、服装、场景结构不变;无无关人物、无畸形;避免【不需要的风格/发型/色彩/构图】。

关键帧范例(草地第一张)——固定项继承母版、只描述一个核心事件、摄影参数必须具体:

图1负责女生身份与纯黑长直发;图2负责白色棉质学生衬衫、深色格纹裙、黑色及膝袜和黑鞋;图3负责银色旧MP3的外形与结构;图4负责高草地空间。
女生独自站在夏日下午的高草地里,右手将MP3握在腰前,耳朵佩戴与设备相连的有线耳机,低头看设备,不看镜头。中远景,轻微倾斜构图,人物偏右,高草遮挡部分腿部,保留大片环境。日光从人物侧后方照来,白衬衫边缘局部发亮,面部保留阴影;蓝绿较饱满,4∶3,旧家用数码录像观感,轻微软焦与少量噪点,主体信息可辨。保持参考身份、服装和道具一致,不新增人物,不出现卷发或现代触屏设备。

A7|固定描述块|Consistency Lock

每张派生图都附带,防止漂移:

角色锁:
女生17岁东亚学生,清瘦,纯黑长直发,白色学生衬衫,深色格纹裙,黑色及膝袜,黑鞋。
男生17岁东亚学生,清瘦,黑色短发,白色长袖学生衬衫,黑色直筒裤,黑鞋;男生高约5–8厘米。
视觉锁:
2000年前后消费级MiniDV / CCD录像,有限动态范围,轻微软焦,轻微数字噪点,高光容易过曝,蓝天与绿色植物颜色饱满,不灰黄,不做现代HDR。

(按项目替换成自己的角色与视觉设定)

A8|纠偏 Prompt(人脸、头发、AI 感)

【人脸】严格保持参考图1女生的面部身份不变;脸型、眼睛距离、鼻梁、嘴型、年龄感一致;只修改场景与动作,不重新设计面部。
【头发】纯黑色长直发,长度到胸下至腰部;即使有风也只整体吹起直发发束,禁止卷发、大波浪、微卷、空气卷、蓬松烫、棕发、短发。
【降低AI感】真实自然光,消费级数字摄影动态范围,局部高光过曝,背景细节不完全清晰,真实衣物褶皱,自然皮肤纹理,轻微曝光不稳定,不追求商业摄影的完美光线。

光影/氛围类纠偏写法范例(明确:保留什么 → 调整什么 → 维持什么方向):

我希望保留车厢结构和人物姿态,调整窗外与车内的明暗关系,使人物轮廓更清楚,同时维持整组的蓝绿色方向。

课5mv-shot-editing|AI MV镜头与剪辑

如何使用:把分镜图生成AI视频、设计镜头运动、写视频Prompt、按音乐排镜头卡点;生成结果像AI Demo需要修复时触发

AI MV 镜头与剪辑|从好看的图到成立的镜头

你是一位 AIGC 导演兼剪辑师。核心心法:会动,不等于有叙事。视频 Prompt 不是漂亮文字,是时间、动作、摄影机和限制项组成的执行指令。

五步工作流

先问:这个镜头为什么要动?

三层运动

层回答规则
人物运动发生什么起点—变化—终点结构,必须写结束状态(减少无关续演)
摄影机运动观众怎么看初次生成只设一条主运镜
环境运动空间是否活着人物少动环境多动,符合真实物理惯性

运镜四要素:起点(景别+机位)/路径方向/速度/终点。写法示范:

> ~~"摄影机缓慢后拉"~~ → "从女生胸部以上近景开始,摄影机沿后方缓慢匀速退开,高度保持不变,逐渐露出全身和草地,最后停在人物占画面很小的大远景。"

运镜选择规则:人物移动时跟随/空间揭示时横移/情绪靠近时推进;没有明确表达目的时先尝试固定机位;不要让晃动替代情绪。固定(观察克制)、推(聚焦)、拉(展开环境)、摇(朝向旋转)、移(位置移动)、跟拍(前/后/侧)、升降(机位高度变化,≠抬头低头)。

镜头组:一件事用不同景别讲完——全景(身体与环境)→ 中景(动作)→ 近景(表情)→ 特写(局部)。范例"砸 MP3 五镜":远景独自草地 → 中景摘耳机 → 手部握紧 → 中景砸下 → 特写耳机线落草。

视频 Prompt 结构(时间轴式)

【参考素材】各图分工(身份/服装/场景/质感)+ 分秒时间轴描述变化 + 光影/风格/声音 + 限制项(一镜一主运镜)。完整模板与案例见 references/video-prompts.md。

从音乐开始剪|先找结构,不急着卡点

五段情绪结构:建立(世界与人物)→ 推进(信息与动势增加)→ 转折(动作或空间改变)→ 爆发(情绪或动作高潮)→ 收束(余韵与结束画面)。

15 秒排镜示例:0–4s 建立空间与人物|4–8s 推进信息|8–10s 停顿与蓄力|10s 动作重音|10–15s 余韵收束。先写事件结构,再决定卡点。

Badcase 修复|为什么像 AI Demo

症状修复
全部都在动删掉无意义运动,一次只保留一个主运动
镜头没有终点补结束状态
人物与背景互相抢戏明确主运动(人物动则机位固定,反之亦然)

逐镜检查清单:每镜有主运动?动作可见连续有终点?摄影机有明确理由?前后镜头能连续?关键变化落在音乐节点?

连续性维护:运动方向、光线方向、风向跨镜头一致;只改景别不改方向。转场可用前景遮挡(车辆经过 0.4–0.6s 遮画切镜)或光线遮挡(人物走入逆光)隐藏切点。

Prompt 模板库

生成任何视频镜头、延长、编辑或修复时,读取 references/video-prompts.md,包含可直接复制的模板:人物运动/环境运动/摄影机(跟拍/推/拉/横移/摇/手持/遮挡)/镜头组(建立—信息—爆点—余波)/连续性/前景遮挡与光线转场/通用 Seedance 时间轴 Prompt/完整案例(两人倒进草里)/Badcase 修复/延长/局部编辑。使用流程:解释结构 → 复制模板 → 替换【】变量 → 检查限制项。

技能链

lyric-writer(词)→ mv-storyboard(故事板)→ ai-visual-asset(资产包)→ 本技能(图生视频+剪辑成片) → 剪映输出 30s+ MV → 抖音投稿(#抖音ai夜校 #我在抖音学ai #ai手搓音乐mv教程)。

📎 附带模板(video-prompts.md)

视频 Prompt 模板库(Day5 官方资料,可直接复制)

使用流程:解释结构 → 复制模板 → 替换【】变量 → 检查限制项。

B1|人物运动 Prompt

保持参考图中的人物身份、服装、发型和场景完全一致。
人物先【起始状态】,随后【动作变化】,最后停在【结束状态】。
动作速度:【缓慢 / 突然 / 连续 / 急促】;动作幅度:【轻微 / 中等 / 强烈】。
身体重心:【稳定 / 前倾 / 下坠 / 后退】;表情保持【克制 / 平静 / 紧张】。
摄影机保持【固定 / 平稳跟随】,让动作本身成为主要运动。
限制:面部稳定、服装不变、身体比例正常、动作连续,无肢体变形、无多余人物。

要点:动作必须可见、可计时;必须写结束状态(减少无关续演);表情与身体幅度分开控制。

B2|环境运动 Prompt

保持人物姿态基本不变。主要运动来自环境:
【风 / 雨 / 烟 / 灯光 / 水 / 背景车辆】持续运动。
风从【方向】吹来,【头发 / 衣服 / 草 / 布料】产生连续自然运动。
背景中的【列车 / 汽车 / 行人 / 光影】以【速度】经过。
人物只做轻微呼吸和重心变化。摄影机稳定,不增加无意义晃动。
环境运动连续,符合真实物理惯性。

要点:人物少动环境多动;稳定机位帮助观众观察细微变化。

B3|摄影机 Prompt|跟拍 / 推 / 拉

【跟拍】低机位后方跟拍;与人物保持2–3米,沿奔跑方向向前;人物加速时同步加速但不超越;保持同一高度与方向。
【推镜】中景开始,摄影机匀速向人物推进,最终到近景;不横移、不环绕,只做单一前向推进。
【拉镜】从人物中景开始缓慢后退,人物逐渐缩小,环境进入画面,最终形成大远景;人物原地不动,不追摄影机、不看镜头。

B4|摄影机 Prompt|横移 / 摇镜 / 手持 / 遮挡

【横移】摄影机与人物保持平行,稳定水平移动;人物保持在画面中部,背景产生横向视差;不靠近人物、不改变景别。
【摇镜】先停留人物;人物看向右侧后,摄影机顺视线向右摇,停在远处列车;只进行一次。
【手持】近距离跟随,保留步伐起伏与惯性,但锁定主要方向;无随机旋转、无剧烈左右摇摆。
【遮挡】侧面跟随;前景高草、电线杆或车辆短暂遮挡,覆盖画面时隐藏切镜点。

B5|镜头组 Prompt|建立—信息—爆点—余波

镜头1|大全景固定:女生独自站在高草地中央,人物很小;低头听耳机,风吹草和黑色长直发。
镜头2|手部近景:右手握银灰色MP3,耳机线延伸出画;手指逐渐握紧;摄影机固定,背景高草模糊。
镜头3|中远景动作:女生突然抬起右手,把MP3向下砸进草地;动作只有一次,迅速、干脆;摄影机不动。
镜头4|高草近景空镜:MP3落在草叶间,耳机线缠在草上;人物不入画;只有风继续吹草约1秒。

动作镜头单独写法(砸 MP3)——动作只有一次、停顿是情绪蓄力、砸完后的静止同样重要:

保持女生的身份、服装、黑色长直发和草地环境一致。耳机已经摘下,线自然松垂,女生右手握着MP3。她停顿片刻,随后快速向下甩出播放器并松手。动作只有一次,完成后右臂自然垂下,身体留在原地。摄影机固定在中景,风持续吹动草叶和衣服。
MiniDV/CCD质感,轻微运动拖影。
限制:不重复砸、不大喊、不哭、不卷发。

B6|连续性 Prompt

严格保持上一镜的运动方向连续。
人物继续从画面左侧向右侧移动,速度与上一镜一致。
太阳仍位于人物左后方,风仍从左向右吹。
人物服装、发型、场景和曝光保持连续。
只改变摄影机景别,不改变运动方向。

B7|前景遮挡 / 光线转场 Prompt

【前景遮挡】摄影机侧面跟随两人奔跑;一辆汽车从极近前景高速驶过,完全遮住画面0.4–0.6秒;车辆经过后切到另一场景;遮挡前后横向运动方向一致,用运动模糊隐藏切点。
【光线转场】镜头正对逆光太阳;女生靠近男生,身体逐渐进入太阳与镜头之间;眩光逐渐被遮挡、曝光自然下降;人物接触时太阳遮挡最明显;这是物理遮挡,不是后期闪黑。

B8|通用 Seedance 视频 Prompt(时间轴式)

【参考素材】@图1只负责人物身份;@图2只负责服装发型;@图3只负责场景结构;@图4只参考色彩、曝光和摄影质感。
【视频内容】0.0–2.0秒:【景别+机位】;人物【起始动作】;环境持续运动;摄影机【主要运镜】。
2.0–4.0秒:人物从【状态A】到【状态B】;动作速度【】,身体重心【】;摄影机继续【】。
4.0–6.0秒:人物完成【核心事件】;摄影机【停住/拉远/跟随】;停在【结束画面】。
【光影】【视觉风格】【声音】【限制】:身份、服装、发型不变;动作连续;摄影机只有一种主运动;无畸形、无无关人物、无随机漂移。

B9|完整案例|两个人一起倒进草里

参考人物图保持男女主身份一致;参考造型图保持学生服装和女生纯黑长直发;参考草地母帧锁定高草、浓绿色、夏日下午逆光。
0.0–1.5秒:两人在高草中并排快跑;低机位中远景跟随,稳定向前;风吹草、衣服和长直发。
1.5–2.4秒:两人同时失去平衡,重心向前下方坠落;不是拥抱。
2.4–3.6秒:两人倒向高草;摄影机同步向前下方跟坠一次,不乱摇、不旋转。
3.6–4.5秒:草叶遮挡镜头,摄影机落到近地位置后停止。
4.5–6.0秒:两人躺在草间,距离近但不拥抱;呼吸明显、表情平静。
声音:脚步、草叶、衣物、风、落地与呼吸。限制:仅一次跟坠,无浪漫翻滚、无笑、无卷发。

B10|Badcase 修复 Prompt

【减少自主动作】除明确动作外,不转头、不摆手、不微笑、不与镜头互动,只保留呼吸。
【摄影机乱漂】只允许缓慢向前推进;不横移、不摇镜、不环绕、不改变机位高度、无随机漂移。
【动作太慢】动作从0.8秒启动,在1秒内完成;不要慢动作、不要拖延准备。
【动作太夸张】降低幅度,保持真实惯性;不舞蹈、不夸张甩手、不突然大幅转身。
【风向不同步】风从左向右;头发、衬衫、裙摆与草叶同向、同时、同风力变化。

B11|延长 Prompt

向后延长视频1约5秒。
保持视频1中的人物身份、服装、场景、光线、颜色、摄影机位置和MiniDV质感完全连续。
视频1结束时两人已倒在草地中。延长部分:两人继续躺在草里,不立刻起身,只保留明显呼吸;风继续吹高草和女生纯黑长直发;摄影机保持落地后的原机位不动;声音延续风声、草声和呼吸声。
不要增加新动作,不改变景别,不改变光线。

B12|编辑 Prompt(局部修改)

严格编辑视频1。
只修改0–6秒女生头发:改为纯黑色长直发,长度到胸下至腰部,全程保持直发结构;受风时只能整束直发向侧面飘动,不能卷曲或波浪。
保持视频1原有的人脸、人物动作、男生、服装、草地、摄影机运动、光线、颜色和声音完全不变。
← 返回上一页