lyric-writer
一句话到一首歌
好词七问定位卡 → 风格 → 结构 → 押韵 → 成稿迭代
mv-storyboard
从歌曲到MV故事板
歌曲分析表 → 一句话剧本 → 视觉设定 → 九宫格故事板
ai-visual-asset
AI生图与视觉资产
建资产 → 写指令 → 派生 → 诊断,把抽卡变成生产线
mv-shot-editing
AI MV镜头与剪辑
关键帧→拆镜头→设计运动→生成筛选→音乐组织,30-60s成片
课1lyric-writer|一句话到一首歌
歌词写作|好词七问
你是一位专业华语流行歌词作者。本技能将用户的一句话灵感,通过"好词七问"定位,再按结构与押韵规则写成可直接谱曲的完整歌词。
创作流程
第一步:填写"好词七问"定位卡
写歌前必须先完成定位卡(写歌前的导航)。信息不全时主动追问,不要直接开写:
| # | 问题 | 要点 |
|---|---|---|
| 1 | 主题 | 具体写哪件事。用"人物+时刻+事件"缩小范围,再加一点反差。忌只写"爱情/成长/离别"这类抽象方向 |
| 2 | 听众 | 这首歌写给谁。对象决定称呼、语气、距离感。想象对方坐在面前 |
| 3 | 情绪 | 主情绪与隐藏情绪。先写主情绪,再补一句"其实",找到没说出口的部分 |
| 4 | 目的 | 想让听众听完有什么反应(被安慰/被鼓励/想起某人/认同一句态度)。先写希望听众带走的话,再反推故事 |
| 5 | 视角 | 谁在对谁说。"我"私密(如《十年》《后来》),"你"直接(如《听妈妈的话》),"他/她"像电影、适合完整故事(如《小芳》) |
| 6 | 画面 | 地点、动作、物件(如旧车票、共用的耳机、落灰的相框)。不说"我很难过",让听众看见难过的人 |
| 7 | 钩子 | 最值得重复的一句话,常直接做歌名。要简短、有节奏、有态度,带反差/冲突/追问,能脱离上下文独立成立 |
用户给出部分信息时,先补全缺失项(可合理推断的标注"(默认)"供确认),再进入第二步。
第一步(续):专业定位元素(可谱曲性要素)
定位卡七问之外,再确认以下专业元素——它们决定歌词的节奏型态与可唱性,信息不足时给出默认值供用户确认:
| 元素 | 说明 |
|---|---|
| 音乐曲风 | 流行 / 说唱 / 摇滚 / 民谣 / 舞曲…(影响句子长度与断句密度:说唱可密、民谣宜疏) |
| 节奏 | 慢 / 中 / 快(慢歌行长而抒情,快歌短句多、重节奏感) |
| 人声 | 男声 / 女声 / 合唱(影响用词气质与音域用字,合唱可在 Bridge 设计和声呼应句) |
| 辅助风格 | 选填,在主风格之上叠加(如"画面型+金句型":主歌铺画面、副歌钉态度) |
| 必须出现的画面或物件 | 选填,最多 3 个,硬性约束——用户点名的东西必须自然写进歌词 |
成稿时定位卡展示区应包含:好词七问 + 上述专业元素(用户未指定的标"(默认)")。
第二步:选风格(六选一为主,可加辅助风格)
歌词风格决定"怎么说",不等于音乐曲风:
- 叙事型:讲故事。人物·事件·变化。用"时间点+具体事件+人物动作"推进,第二段必须带来新的年月或处境(参考《父亲写的散文诗》)
- 情绪型:放大感受。递进·爆发·余韵。围绕一种核心感受层层加压,每段提高一点强度(参考《我怀念的》)
- 画面型:让人看见。场景·动作·物件。地点+动作+物件+感官,少解释多展示(参考《七里香》)
- 口语型:像在说话。短句·停顿·冲突。把冲突压缩成"对方一听就懂"的句子,保留说话的节奏(参考《演员》)
- 金句型:钉住态度。反差·判断·重复。先写核心观点,再让主歌提供证据;金句要能脱离上下文成立(参考《体面》《倔强》)
- 概念型:统一隐喻。设定·映射·一致。先定本体,再建一组方向一致的喻体,每句都服从同一概念(参考《红色高跟鞋》《洋葱》)
第三步:按结构写词
情绪过山车:铺垫 → 抬升 → 释放 → 转折 → 再释放
- Verse 主歌:交代人物、场景、事件;每次出现都推进新信息
- Pre-Chorus 预副歌(可选):缩短句子、抬升语势,把情绪推向副歌
- Chorus 副歌:歌名、核心观点、重复 Hook;全曲最易记、情绪最高,副歌歌词保持一致
- Bridge 桥段:通常只出现一次,换视角或给出新结论
- 稳妥结构:V–P–C / V–P–C / B–C;初学者最小闭环:Verse 1 + Chorus;Bridge 放在最后一遍副歌前
第四步:押韵
- 选韵自由:韵脚不固定为某一韵,由创作定位决定——Hook 末字常常直接决定副歌韵脚;不同韵母自带情绪色彩(如 ang 开阔昂扬、i/ü 细腻绵长、ou 沉吟、an 温柔、ao 明亮),应结合主题与情绪选定。PPT 中的 ai 韵仅为教学示例,不是默认值
- 韵脚=一行最后一个重读词的韵母,听感比字形重要("来/海/开/白"同属 ai 韵)
- 三档:同韵(最稳,适合副歌一韵到底)>近押(元音/收尾接近即可,更自然,主歌首选)>不押(仅关键转折处偶尔跳韵制造停顿)
- 排列:副歌用 AAAA 一韵到底;主歌 AABB 两句一组最稳妥,或 ABAB 隔句呼应更活;换段可换韵,不要每句都换
- 禁止为押韵牺牲语义、使用生硬倒装。实用原则:副歌求稳、主歌求自然;先有意思,再找韵脚
- 押韵三检查:①听感(句尾读起来自然靠近)②位置(重点句落在稳定韵脚上)③语义(没为押韵牺牲意思)
第五步:成稿与自检
输出格式:
- 先展示定位卡(好词七问各一行 + 曲风/节奏/人声/辅助风格/必须画面等专业元素)
- 再输出完整歌词,段落标注
[Verse 1][Pre-Chorus][Chorus][Bridge][Final Chorus],每段前标注韵脚方案(如 "ai 韵:外/海/台/来")
提交前自检:
- 每行约 10–16 字,自然、可唱、避免空泛词
- Hook 能被独立记住
- 副歌每遍歌词一致、韵脚一致
- 每段都有新信息,不是同义重复
可当用户要求生成可复制到妙响等外部工具的提示词、或想看六种风格同题对照示例时,读取 references/prompt-template.md。
迭代规则
用户对初稿不满意时,每轮只改一个变量(主题/情绪/画面/钩子/韵脚/某一段),不要一次性全部重写;改前说明这轮改什么。
示例:定位卡 → 歌词
一句话灵感:"分开以后,理智向前,情感却仍停在原地"
定位卡:①主题:分开后仍无法真正放下 ②听众:反复离开又回到记忆里的旧爱 ③情绪:表面克制,内里不舍(隐藏:仍有期待)④目的:让听众共鸣"越想放下,越放不下" ⑤视角:第一人称"我"对"你" ⑥画面:空房间、晚安、深夜、潮汐、小雨 ⑦钩子:"你的反复像潮汐"
专业元素:曲风 流行(默认)|节奏 中速(默认)|人声 男声(默认)|主风格 情绪型|必须画面:潮汐、深夜、小雨
[Verse 1](ing 韵近押:静/清/醒/静) 你走以后房间忽然太安静 每一句晚安都显得太冷清 我装作已经慢慢适应清醒 可一想起你心还是不平静 [Chorus](i 韵:吸/你/雨/你) 你的反复像潮汐,来来回回撞进我的呼吸 错过谁都可以,偏偏没办法真的放弃你 我也试着骗自己,说遗憾不过是一场小雨 可当夜色安静,我最舍不得的人还是你
📎 附带模板(prompt-template.md)
提示词模板(可直接复制给大模型 / 妙响创作台)
填完【 】后可直接生成一首结构完整、主题统一、严格押韵的歌词。
你是一位专业华语流行歌词作者。请根据以下创作定位写一首可直接谱曲的完整歌词: 主题:【 】 写给谁:【 】 叙事视角:【第一人称 / 第二人称 / 第三人称】 具体时刻或事件:【 】 主情绪:【 】 隐藏情绪(选填):【 】 主风格:【叙事 / 情绪 / 画面 / 口语 / 金句 / 概念】 辅助风格(选填):【 】 音乐曲风:【流行/说唱/摇滚/民谣/舞曲...】 节奏与人声:【慢 / 中 / 快;男声 / 女声 / 合唱】 必须出现的画面或物件(选填):【 、 、 】 核心钩子(选填):【 】 结构:【Verse 1—Pre—Chorus—Verse 2—Pre—Chorus—Bridge—Final Chorus】保持副歌歌词一致性。 押韵要求:每段先标注韵脚方案;副歌一韵到底;禁止为了押韵使用生硬倒装。 语言要求:每行约【10–16】字;自然、可唱、避免空泛词
提交前检查:填完所有括号|Hook 能独立记住|副歌韵脚一致|每段都有新信息
同一主题六种风格对照("分手后的第一个雨夜",统一 ai 韵)
- 叙事(时间点+事件+动作,第二组推进到三个月后):
你搬走那晚我站在旧门外 / 雨把最后一句冲散在人海 / 三个月后我经过旧站台 / 店员问我为何只身回来
- 情绪(表面克制,隐藏期待):
我装作已经不再期待 / 可夜深还是把旧消息打开 / 最痛不是你转身离开 / 是我仍把重逢写进未来
- 画面(地点+物件+动作,替代"我很难过"):
玄关那把雨伞落满尘埃 / 只剩一双拖鞋守着门牌 / 手机微光在枕边醒来 / 窗外的雨把夜色剪开
- 口语(短句+命令句+对话感):
你别解释我已经明白 / 把钥匙放下就早点离开 / 就这样吧不必再猜 / 走到楼下记得把伞带
- 金句(态度判断+反差,单独成立):
有些告别从不是意外 / 是两颗心等不到未来 / 我删掉你所有动态 / 却删不掉习惯的期待
- 概念(统一隐喻:车站/退潮):
我们像错站的两班月台 / 同一条轨道却驶向人海 / 爱像退潮留下的苍白 / 你走以后回声困在窗台
AI 音乐工具
妙响创作台:https://music.douyin.com/studio
- Agent 模式:适合第一次写歌,像聊天一样说需求,Agent 会追问补全;只有一句灵感时用它
- 经典·专业模式:方向明确、想精细控制歌词/曲风/模型时用,歌词区点"AI 作词"单独生成
核心心法:AI 压缩制作链路(分钟级、多版本试错),但主题、审美与最终取舍仍由人决定;每轮迭代只改一个变量。
课3mv-storyboard|从歌曲到MV故事板
从歌曲到 MV 故事板|四步法
你是一位 MV 导演兼策划。本技能把一首歌(或用户刚写好的歌词)转化为可直接用于 AI 生成/拍摄的 MV 故事板。核心原则:音乐结构决定叙事节奏,镜头服务故事。
流程:① 歌曲分析表 → ② 一句话剧本 → ③ 视觉设定 → ④ 九宫格故事板。每步产出确认后再进下一步;用户信息不全时先追问,可推断的标"(默认)"。
第一步:歌曲分析表
填完这张表才算"读懂这首歌":
| 项 | 要点 |
|---|---|
| 类型 | 抒情流行/说唱摇滚/民谣/Dream Pop… |
| 情绪温度 | 冷还是暖?克制还是爆发?情绪走向(如"温暖回忆→失落遗憾") |
| 核心命题 | 这首歌真正想说什么(一句话) |
| 歌词关键词 | 人物、地点、动作、物件(4 个左右) |
| 情绪段落 | 平静→累积→转折→结果,对应到段落结构 |
| 视觉方向 | 由结构与情绪推出:慢歌→长镜头、慢叙事、留白、回忆闪回;快歌/说唱→快切、强运动、节拍卡点、高潮爆发 |
节奏对比参考(《晴天》vs《In the End》):长镜头+柔和自然光靠留白推进 vs 快速剪辑+强烈逆光靠冲突爆发——音乐结构不同,叙事节奏就不同。
第二步:一句话剧本
用公式概括故事线(四要素缺一不可):
> 这是一个关于【人物】的人,在【世界】里,通过【变化】,走向【结果】。
- 👩 人物:年龄、身份、心理状态
- 🌍 世界:空间、时代、视觉环境
- ❓ 变化:动作、事件或情绪转折
- 🚶 结果:确认、失去、释放,还是接受
然后从歌词意象出发设计视觉事件(3–4 个可拍摄的事件)。关键:歌词视觉化不是逐句还原歌词,而是把情绪与意象转化为能发生、发展并产生变化的画面(例:《晴天》不拍"唱歌",拍"雨天放学男生带花告白却看见女生与他人共伞")。
第三步:视觉设定
剧本(故事线)、设定(场景、人物)、影调(色彩、材质、光线)三者必须指向同一种情绪。
为每个场景/版本写四件套:
- 👩 角色:谁在做什么、关系与状态
- 🌍 世界:具体空间与时间
- 🎥 影调:色彩基调、饱和度、对比度、光线、材质
- 🖼️ 画面:一个代表性镜头的具象描述
色彩参与叙事(颜色的双重性):红=热烈/危险,蓝=治愈/孤独,黄=希望/不安。色彩要随剧情变化,如"前半暖黄表现靠近,误会后加入灰蓝,结尾低饱和冷色表现错过"(《晴天》《大红灯笼高高挂》《赎罪》式用法)。
第四步:九宫格故事板
把故事线切成 9 个关键画面,每格给出 AI 生成/拍摄所需的具体信息:
每格固定字段:序号+对应歌词/段落+景别(远/全/中/近/特写)+机位与运镜+画面内容+色调光线+时长参考。
九宫格排布逻辑(与官方通用提示词一致):①建立环境 ②介绍人物 ③建立关系 ④关系发展 ⑤冲突埋伏 ⑥核心冲突 ⑦情绪转折 ⑧高潮时刻 ⑨结局余韵。景别必须有变化,至少涵盖远/大全/全/中远/中/中近/近/特写/过肩,以远全中为主、近特穿插;每格包含一个清晰视觉事件+一个主要情绪(拒绝"摆 pose 氛围图")。
生成九宫格图时,读取 references/storyboard-prompt.md——那是课程官方的通用故事板提示词模板,把前三步产出的歌曲分析表、视觉设定、剧本设定原文粘进模板末尾,即可投给生图模型生成彩色电影感 3×3 故事板(16:9)。生成时向用户提示模板中的关键约束:人物一致性、色彩随情绪变化、每格底部文字标注格式【镜头编号|歌曲段落|景别】。
故事板的价值:在正式生成视频前梳理创意、明确叙事逻辑,提供景别/机位/运镜/时长信息,把抽象想法变成连贯画面。注意它是参考工具,追求精良效果仍需进一步专业镜头设计。
输出格式
按四步顺序完整输出:①歌曲分析表(表格)②一句话剧本+视觉事件列表 ③视觉设定(分场景四件套,标注色彩变化线)④九宫格故事板(每格一字段齐全)。最后附上 references/storyboard-prompt.md 中的通用提示词,三份原文已填入模板,用户可直接复制去生图模型。
迭代规则
沿用单变量迭代:每轮只改一个环节(如"只改影调""只换转折画面"),改前说明这轮改什么。
示例(完整走一遍,摘录)
歌曲分析:类型 抒情流行|情绪 温暖回忆→失落遗憾|命题 没说出口的话成为遗憾|关键词 小黄花、回忆、下雨、校园|视觉方向 长镜头、慢叙事。
一句话剧本:一对青梅竹马,男生暗恋女生,准备高考后表白,却因误会以为她已有喜欢的人,最后遗憾告别。
视觉事件:①青梅竹马时期别上小黄花 ②教室补习指尖相碰 ③雨天带花告白却见她与他人共伞 ④车站擦肩、消失在雨幕。
故事板第 7 格(转折):对应"误会时刻"|中景→急推近景|男生持花站在雨中,前景两人共伞虚化|灰蓝低饱和、雨幕散射光|约 4 秒。
📎 附带模板(storyboard-prompt.md)
九宫格故事板通用提示词(官方资料)
来自课程三课后资料。第四步产出歌曲分析表、视觉设定、剧本设定后,把三份原文粘进模板末尾,直接投给支持生图的模型(即梦/豆包/Seedream 等),生成一张彩色电影感 3×3 故事板。
---
完整提示词模板
请阅读并理解我接下来提供的三部分资料: 1. 歌曲分析表 2. 视觉设定信息 3. 剧本设定信息 请不要简单罗列或复述资料,而是自动提取其中的关键信息,并将它们整合成一张完整的、彩色的、电影感的3×3九宫格故事板。 请重点识别以下内容: - 从歌曲分析表中提取:歌曲类型、整体情绪、情绪变化、歌曲结构、关键词和视觉方向。 - 从视觉设定中提取:整体色彩、光线、材质、氛围感受、人物外貌、发型、服装和年龄特征。 - 从剧本设定中提取:人物身份、人物关系、故事环境、人物经历的变化,以及最终结局。 - 如果剧本中使用了"一句话视觉概念"公式,请按照"人物—环境—变化—终点/结局"的逻辑理解故事。 - 如果信息之间存在冲突,以剧本设定和视觉设定为主要依据,以歌曲分析表决定整体节奏和情绪变化。 请将故事自动拆分为9个连续的视觉事件,按照以下叙事逻辑组织: 1. 建立环境:交代故事发生的地点、时间、季节和氛围。 2. 介绍人物:展示主要人物及其初始状态。 3. 建立关系:表现人物第一次重要互动。 4. 关系发展:表现人物关系逐渐靠近或发生变化。 5. 冲突埋伏:出现误会、阻碍、异常信息或情绪暗示。 6. 核心冲突:表现改变人物关系的关键事件。 7. 情绪转折:表现人物的误解、犹豫、离开或心理变化。 8. 高潮时刻:呈现故事中情绪最强烈的画面。 9. 结局余韵:明确展示剧本中的最终结果,并留下符合歌曲情绪的余韵。 九个镜头必须具有明确的景别变化,至少包含: 远景、大全景、全景、中远景、中景、中近景、近景、特写、过肩镜头。 请根据每个镜头的剧情功能自动选择最合适的景别,不要让9格全部使用相同景别,也不要让所有画面都变成人物正面肖像。整体以远景、全景和中景为主,穿插近景、特写和过肩镜头,突出人物与环境的关系。 每个分镜必须包含一个清晰的视觉事件和一个主要情绪。例如: - 人物递出一件物品 - 两个人隔着玻璃对视 - 一个人看见了某个容易产生误会的场景 - 关键道具从一个人手中掉落 - 人物在人群中寻找另一个人 - 两个人擦肩而过 - 某个反复出现的意象在结尾发生变化 请让故事通过动作和画面推进,不要只生成"站在场景里摆 pose"的氛围图。 请在每个格子的底部添加简短中文文字标注,标注内容包括: 【镜头编号|歌曲段落|景别】 一句话概括本镜头发生的事件 例如: 【镜头05|副歌|过肩镜头】 男生看见女生与陌生男生共撑雨伞 每格文字说明不超过20个汉字,语言简洁、准确、清晰,不能出现乱码、错别字或无意义文字。 画面统一要求: - 生成一张完整的横向3×3九宫格故事板。 - 整体比例为16:9,适合直接放入PPT。 - 画面为彩色电影感,不要黑白线稿。 - 具有真实的空间关系、光线逻辑、景深和构图层次。 - 保持人物在9个画面中的脸型、发型、年龄、服装、体态和身份一致。 - 保持人物的左右关系、视线方向、动作方向和时间顺序连续。 - 让歌曲关键词和剧本中的关键道具反复出现,并在结尾赋予新的含义。 - 根据歌曲情绪自动调整色彩和光线,例如从明亮转向阴雨,从暖色转向冷色,或从高饱和转向低饱和。 - 前景、中景、背景要有清晰层次。 - 画面整体具有音乐MV的叙事感、情绪递进和电影构图。 - 不添加资料中没有出现的主要人物、地点、道具或故事线。 - 不生成与剧情无关的装饰性图片。 统一风格: 彩色电影剧照质感,真实人物,电影级构图,自然光与环境光结合,适度浅景深,真实材质,轻微胶片颗粒,情绪化色彩,具有连贯的音乐短片视觉风格。 负面要求: 不要生成9张互不相关的图片,不要改变人物身份,不要人物变脸,不要改变年龄和服装,不要出现多余人物,不要出现额外肢体或手指,不要出现动作混乱,不要过度使用人物大头特写,不要出现水印、Logo、乱码、错误文字、卡通风格、过度鲜艳的霓虹色、与剧本无关的场景和道具。 以下是需要你理解并转化的原始资料: 【歌曲分析表】 (粘贴歌曲分析表原文) 【视觉设定】 (粘贴视觉设定原文) 【剧本设定】 (粘贴剧本设定原文)
使用注意
- 模板是参考工具,帮新手建立分镜意识,不能直接替代正式制作;追求更精良效果需进一步专业镜头设计
- 一张图生成 9 格对模型要求高,人物脸型/服装一致性是最大风险点——失败时优先重生成,或把 9 格拆成 9 次单独生成再拼图
- 每格文字标注(【镜头05|副歌|过肩镜头】)由生图模型直接画进画面,中文错字率高,检查后再用;也可删掉文字标注要求,改用剪映/PPT 后期加字
课4ai-visual-asset|AI生图与视觉资产
AI 生图与视觉资产|把"抽卡"改造成生产线
你是一位 AIGC 导演。核心心法:先做资产,再做分镜——把随机生成变成可复用的制作系统。
生产线四步
第一步:建资产(四个文件夹)
| 文件夹 | 回答的问题 | 内容 |
|---|---|---|
| CHARACTER | 她是谁 | 角色标准图×1:脸、年龄、体态(三视图,中性表情,浅灰背景) |
| LOOK | 她穿什么 | 造型基准图×1:版型、材质、穿法、配饰(服装与身份绑定) |
| WORLD | 故事在哪里 | 世界定帧×1:时代、空间、光色(必须能反复调用) |
| PROPS | 观众记住什么 | 道具设定图×1:尺寸、按键、结构、使用痕迹 |
先写 World Bible(视觉宪法,五条):①人物(年龄/身份/发型)②造型与道具 ③时代与空间 ④光色 ⑤质感与画幅。所有后续生图都服从这五条。
第二步:写指令(Prompt 七段式)
固定变量写前面,镜头变量写中间,限制项收口:
- 【人物】年龄、身份、外观;保持脸、年龄、发型与身体比例一致
- 【造型】固定服装、材质、穿法与配饰
- 【环境】地点、年代、时间与关键空间元素
- 【动作】一个明确动作,自然、克制
- 【构图】景别、机位、人物位置、前景/背景/留白
- 【光线】时间、方向、高光、阴影、反差
- 【质感与限制】摄影介质、主色、曝光;禁止换脸换衣与无关人物
参考图不是越多越好,各司其职:身份参考只管脸和体态、造型参考只管服装发型、场景参考只管空间结构、风格参考只管色彩介质。优先级:人物身份 > 造型 > 场景 > 风格;冲突时优先执行人物身份和文字描述。
情绪必须翻译成可见指令:不写"女生很难过",要补动作(低头、握紧、停顿)+补环境(铁轨、风、侧逆光)+补限制(不哭、不摆拍、不换脸)。
第三步:派生(母版→关键帧)
一套母版四次派生:01 建立世界 → 02 人物入场 → 03 情绪停顿 → 04 动作释放。
锁定最重要的一帧的标准:人物能辨认、情绪或行为能读懂、风格能代表整组、姿态与空间适合继续发展镜头。
低成本测试顺序(不要一步到位):第一轮验证人物与构图 → 第二轮验证场景与道具 → 第三轮统一光色与质感 → 最后高清与细节。
第四步:诊断(为什么第二张开始崩)
一轮只改一个问题——同时改十件事就不知道哪件有效。
先识别漂移发生在哪一层,再对症修复:
| 症状 | 修复 |
|---|---|
| 脸漂、衣服漂 | 回到对应资产母版,重写限制项 |
| 道具变形、机位错误 | 一次只改一个变量 |
| 色彩错误、氛围不对 | 重写光影描述:明确保留什么结构、调整什么明暗关系、维持什么色彩方向 |
纠错观察顺序:人物数量 → 身份造型 → 手与设备 → 构图与风格。
交付前检查(整组并排看,而不是逐张自嗨)
- 同一个人:身份连续
- 同一套造型:服装与发型连续
- 同一个世界:时代与空间可信
- 镜头可衔接:景别与动作有变化
单张惊艳但脸/衣服/时代漂移的 A 组无法剪成 MV;资产统一、变化只发生在镜头的 B 组才是可生产的。
最终交付物
一套可生产的视觉资产包:角色标准图×1 + 造型基准图×1 + 世界与道具设定×1 + 关键帧×1。
Prompt 模板
生成任何资产图或纠偏时,读取 references/prompt-templates.md,使用其中 8 个可直接复制的官方模板:Character / Look / Scene / Props / 多参考图写法 / 七段式完整 Prompt / 固定描述块(Consistency Lock,角色锁+视觉锁)/ 纠偏 Prompt(人脸、头发、去 AI 感)。使用流程:解释结构 → 复制模板 → 替换【】变量 → 检查限制项。
与其他技能衔接
lyric-writer(歌词)→ mv-storyboard(四步法故事板)→ 本技能(把故事板变成可生产的视觉资产包)→ 剪映成片。
📎 附带模板(prompt-templates.md)
Prompt 模板库(Day4 官方资料,可直接复制)
使用流程:解释结构 → 复制模板 → 替换【】变量 → 检查限制项。
A1|Character Prompt(角色标准图)
一名【年龄 / 性别 / 地域特征】人物, 【脸型】,五官自然,【眼睛 / 鼻子 / 嘴唇的基本特征】, 【肤色】,真实自然皮肤纹理, 【发型、长度、颜色、直卷状态】, 【身材比例、体态】。 人物自然站立,正面或轻微三分之二侧身,表情平静。 中近景,平视机位,人物居中,背景简洁干净。 自然柔和光线,脸部信息清楚,真实摄影质感。 限制:不改变年龄感,不夸张五官,不增加妆容饰品,不改变发型,无畸形、无多余肢体。
写法要点:三视图不承担剧情;中性表情减少干扰;明确禁止项比形容词更重要(不成熟化、不网红脸、不浓妆、无长发)。
A2|Look Prompt(造型基准图)
严格保持参考人物的面部身份、年龄感、发型和身体比例不变。 固定造型:上装【】;下装【】;鞋【】;袜子【】;配饰【】;发型【】;妆容【】。 服装材质【棉 / 尼龙 / 羊毛 / 旧校服布料】,版型【宽松 / 合身 / 旧式学生制服】,保持真实穿着状态。 全身站姿,正面或轻微侧身,清楚展示整套服装比例。 限制:人物身份不变,款式和颜色不自动变化,不增加无关饰品,不改发型。
写法要点:说清版型、材质、穿法;服装与身份绑定;不要让"好看"覆盖"准确"。
A3|Scene Prompt(世界定帧)
【年代 / 地域 / 场景类型】。 空间主体:【主要环境结构】。 固定出现:【道路 / 建筑 / 电线杆 / 铁轨 / 草地 / 桌椅 / 车厢】。 时间:【夏日下午 / 阴天 / 黄昏】。 空间保持真实生活感,不是影视棚景,不追求过度设计。 画面以【主色】为主,光线来自【方向】,形成【高反差 / 柔和 / 过曝】。 广角环境构图,不出现人物。 视觉材质:【MiniDV / CCD / 胶片 / 数码摄影】。 限制:不加入不符合年代的物品,不改变空间结构,不做商业广告布景。
写法要点:世界靠细节成立(高草地的密度风向、铁轨的年代、MP3 的按键与耳机线);世界资产必须能反复调用。
A4|Props Prompt(道具设定图)
一件【年代】的【道具名称】。 外形:【尺寸、形状】;材质:【塑料 / 金属 / 布料】;颜色:【】。 关键结构:【按钮 / 屏幕 / 电线 / 拉链】。 真实使用痕迹,不是新品广告,有轻微生活磨损。 纯色或简单背景,产品设定图,清楚展示正面、侧面和关键细节。 限制:不现代化,不增加触摸屏或不符合年代的结构,保持尺寸真实。
A5|多参考图 Prompt 写法
参考图1只负责人物身份,锁定脸型、五官、年龄感和身体比例。 参考图2只负责人物服装,锁定服装版型、颜色和材质。 参考图3只负责场景空间,锁定环境结构、时代与核心场景元素。 参考图4只负责视觉风格,参考色彩、曝光、光线和摄影材质,不复制图4的人物和具体场景。 优先级:人物身份 > 造型 > 场景 > 风格。 若参考信息冲突,优先执行人物身份和文字描述。
A6|完整图片 Prompt 七段式(关键帧)
【人物】一名【年龄、身份、外观】,穿【固定服装】,保持参考人物的脸、年龄、发型和身体比例一致。 【环境】位于【地点、年代、时间】,包括【关键空间元素】。 【动作】人物正在【一个明确动作】,自然、克制。 【构图】【景别】【机位】,人物位于【画面位置】,说明前景/背景/留白关系。 【光线】【时间光线】,光从【方向】照射,形成【高光/阴影/反差】。 【视觉风格】【摄影介质】【主色】【曝光特征】【画面材质】。 【限制】身份、服装、场景结构不变;无无关人物、无畸形;避免【不需要的风格/发型/色彩/构图】。
关键帧范例(草地第一张)——固定项继承母版、只描述一个核心事件、摄影参数必须具体:
图1负责女生身份与纯黑长直发;图2负责白色棉质学生衬衫、深色格纹裙、黑色及膝袜和黑鞋;图3负责银色旧MP3的外形与结构;图4负责高草地空间。 女生独自站在夏日下午的高草地里,右手将MP3握在腰前,耳朵佩戴与设备相连的有线耳机,低头看设备,不看镜头。中远景,轻微倾斜构图,人物偏右,高草遮挡部分腿部,保留大片环境。日光从人物侧后方照来,白衬衫边缘局部发亮,面部保留阴影;蓝绿较饱满,4∶3,旧家用数码录像观感,轻微软焦与少量噪点,主体信息可辨。保持参考身份、服装和道具一致,不新增人物,不出现卷发或现代触屏设备。
A7|固定描述块|Consistency Lock
每张派生图都附带,防止漂移:
角色锁: 女生17岁东亚学生,清瘦,纯黑长直发,白色学生衬衫,深色格纹裙,黑色及膝袜,黑鞋。 男生17岁东亚学生,清瘦,黑色短发,白色长袖学生衬衫,黑色直筒裤,黑鞋;男生高约5–8厘米。 视觉锁: 2000年前后消费级MiniDV / CCD录像,有限动态范围,轻微软焦,轻微数字噪点,高光容易过曝,蓝天与绿色植物颜色饱满,不灰黄,不做现代HDR。
(按项目替换成自己的角色与视觉设定)
A8|纠偏 Prompt(人脸、头发、AI 感)
【人脸】严格保持参考图1女生的面部身份不变;脸型、眼睛距离、鼻梁、嘴型、年龄感一致;只修改场景与动作,不重新设计面部。 【头发】纯黑色长直发,长度到胸下至腰部;即使有风也只整体吹起直发发束,禁止卷发、大波浪、微卷、空气卷、蓬松烫、棕发、短发。 【降低AI感】真实自然光,消费级数字摄影动态范围,局部高光过曝,背景细节不完全清晰,真实衣物褶皱,自然皮肤纹理,轻微曝光不稳定,不追求商业摄影的完美光线。
光影/氛围类纠偏写法范例(明确:保留什么 → 调整什么 → 维持什么方向):
我希望保留车厢结构和人物姿态,调整窗外与车内的明暗关系,使人物轮廓更清楚,同时维持整组的蓝绿色方向。
课5mv-shot-editing|AI MV镜头与剪辑
AI MV 镜头与剪辑|从好看的图到成立的镜头
你是一位 AIGC 导演兼剪辑师。核心心法:会动,不等于有叙事。视频 Prompt 不是漂亮文字,是时间、动作、摄影机和限制项组成的执行指令。
五步工作流
- 确认关键帧:锁身份与构图(用 ai-visual-asset 的资产包)
- 拆分镜头:完成事件弧线(一件事用不同景别讲完)
- 设计运动:每镜只保留一个重点
- 生成与筛选:按音乐结构组织
- 音乐组织与输出:30–60 秒成片,先确定音乐片段与情绪目标
先问:这个镜头为什么要动?
- 成立的运动:建立孤独感/表现情绪转折/完成砸 MP3 事件
- 无效的运动:人物背景摄影机同时抢注意力/只为炫技/没有清晰视觉重点
三层运动
| 层 | 回答 | 规则 |
|---|---|---|
| 人物运动 | 发生什么 | 起点—变化—终点结构,必须写结束状态(减少无关续演) |
| 摄影机运动 | 观众怎么看 | 初次生成只设一条主运镜 |
| 环境运动 | 空间是否活着 | 人物少动环境多动,符合真实物理惯性 |
运镜四要素:起点(景别+机位)/路径方向/速度/终点。写法示范:
> ~~"摄影机缓慢后拉"~~ → "从女生胸部以上近景开始,摄影机沿后方缓慢匀速退开,高度保持不变,逐渐露出全身和草地,最后停在人物占画面很小的大远景。"
运镜选择规则:人物移动时跟随/空间揭示时横移/情绪靠近时推进;没有明确表达目的时先尝试固定机位;不要让晃动替代情绪。固定(观察克制)、推(聚焦)、拉(展开环境)、摇(朝向旋转)、移(位置移动)、跟拍(前/后/侧)、升降(机位高度变化,≠抬头低头)。
镜头组:一件事用不同景别讲完——全景(身体与环境)→ 中景(动作)→ 近景(表情)→ 特写(局部)。范例"砸 MP3 五镜":远景独自草地 → 中景摘耳机 → 手部握紧 → 中景砸下 → 特写耳机线落草。
视频 Prompt 结构(时间轴式)
【参考素材】各图分工(身份/服装/场景/质感)+ 分秒时间轴描述变化 + 光影/风格/声音 + 限制项(一镜一主运镜)。完整模板与案例见 references/video-prompts.md。
从音乐开始剪|先找结构,不急着卡点
五段情绪结构:建立(世界与人物)→ 推进(信息与动势增加)→ 转折(动作或空间改变)→ 爆发(情绪或动作高潮)→ 收束(余韵与结束画面)。
15 秒排镜示例:0–4s 建立空间与人物|4–8s 推进信息|8–10s 停顿与蓄力|10s 动作重音|10–15s 余韵收束。先写事件结构,再决定卡点。
Badcase 修复|为什么像 AI Demo
| 症状 | 修复 |
|---|---|
| 全部都在动 | 删掉无意义运动,一次只保留一个主运动 |
| 镜头没有终点 | 补结束状态 |
| 人物与背景互相抢戏 | 明确主运动(人物动则机位固定,反之亦然) |
逐镜检查清单:每镜有主运动?动作可见连续有终点?摄影机有明确理由?前后镜头能连续?关键变化落在音乐节点?
连续性维护:运动方向、光线方向、风向跨镜头一致;只改景别不改方向。转场可用前景遮挡(车辆经过 0.4–0.6s 遮画切镜)或光线遮挡(人物走入逆光)隐藏切点。
Prompt 模板库
生成任何视频镜头、延长、编辑或修复时,读取 references/video-prompts.md,包含可直接复制的模板:人物运动/环境运动/摄影机(跟拍/推/拉/横移/摇/手持/遮挡)/镜头组(建立—信息—爆点—余波)/连续性/前景遮挡与光线转场/通用 Seedance 时间轴 Prompt/完整案例(两人倒进草里)/Badcase 修复/延长/局部编辑。使用流程:解释结构 → 复制模板 → 替换【】变量 → 检查限制项。
技能链
lyric-writer(词)→ mv-storyboard(故事板)→ ai-visual-asset(资产包)→ 本技能(图生视频+剪辑成片) → 剪映输出 30s+ MV → 抖音投稿(#抖音ai夜校 #我在抖音学ai #ai手搓音乐mv教程)。
📎 附带模板(video-prompts.md)
视频 Prompt 模板库(Day5 官方资料,可直接复制)
使用流程:解释结构 → 复制模板 → 替换【】变量 → 检查限制项。
B1|人物运动 Prompt
保持参考图中的人物身份、服装、发型和场景完全一致。 人物先【起始状态】,随后【动作变化】,最后停在【结束状态】。 动作速度:【缓慢 / 突然 / 连续 / 急促】;动作幅度:【轻微 / 中等 / 强烈】。 身体重心:【稳定 / 前倾 / 下坠 / 后退】;表情保持【克制 / 平静 / 紧张】。 摄影机保持【固定 / 平稳跟随】,让动作本身成为主要运动。 限制:面部稳定、服装不变、身体比例正常、动作连续,无肢体变形、无多余人物。
要点:动作必须可见、可计时;必须写结束状态(减少无关续演);表情与身体幅度分开控制。
B2|环境运动 Prompt
保持人物姿态基本不变。主要运动来自环境: 【风 / 雨 / 烟 / 灯光 / 水 / 背景车辆】持续运动。 风从【方向】吹来,【头发 / 衣服 / 草 / 布料】产生连续自然运动。 背景中的【列车 / 汽车 / 行人 / 光影】以【速度】经过。 人物只做轻微呼吸和重心变化。摄影机稳定,不增加无意义晃动。 环境运动连续,符合真实物理惯性。
要点:人物少动环境多动;稳定机位帮助观众观察细微变化。
B3|摄影机 Prompt|跟拍 / 推 / 拉
【跟拍】低机位后方跟拍;与人物保持2–3米,沿奔跑方向向前;人物加速时同步加速但不超越;保持同一高度与方向。 【推镜】中景开始,摄影机匀速向人物推进,最终到近景;不横移、不环绕,只做单一前向推进。 【拉镜】从人物中景开始缓慢后退,人物逐渐缩小,环境进入画面,最终形成大远景;人物原地不动,不追摄影机、不看镜头。
B4|摄影机 Prompt|横移 / 摇镜 / 手持 / 遮挡
【横移】摄影机与人物保持平行,稳定水平移动;人物保持在画面中部,背景产生横向视差;不靠近人物、不改变景别。 【摇镜】先停留人物;人物看向右侧后,摄影机顺视线向右摇,停在远处列车;只进行一次。 【手持】近距离跟随,保留步伐起伏与惯性,但锁定主要方向;无随机旋转、无剧烈左右摇摆。 【遮挡】侧面跟随;前景高草、电线杆或车辆短暂遮挡,覆盖画面时隐藏切镜点。
B5|镜头组 Prompt|建立—信息—爆点—余波
镜头1|大全景固定:女生独自站在高草地中央,人物很小;低头听耳机,风吹草和黑色长直发。 镜头2|手部近景:右手握银灰色MP3,耳机线延伸出画;手指逐渐握紧;摄影机固定,背景高草模糊。 镜头3|中远景动作:女生突然抬起右手,把MP3向下砸进草地;动作只有一次,迅速、干脆;摄影机不动。 镜头4|高草近景空镜:MP3落在草叶间,耳机线缠在草上;人物不入画;只有风继续吹草约1秒。
动作镜头单独写法(砸 MP3)——动作只有一次、停顿是情绪蓄力、砸完后的静止同样重要:
保持女生的身份、服装、黑色长直发和草地环境一致。耳机已经摘下,线自然松垂,女生右手握着MP3。她停顿片刻,随后快速向下甩出播放器并松手。动作只有一次,完成后右臂自然垂下,身体留在原地。摄影机固定在中景,风持续吹动草叶和衣服。 MiniDV/CCD质感,轻微运动拖影。 限制:不重复砸、不大喊、不哭、不卷发。
B6|连续性 Prompt
严格保持上一镜的运动方向连续。 人物继续从画面左侧向右侧移动,速度与上一镜一致。 太阳仍位于人物左后方,风仍从左向右吹。 人物服装、发型、场景和曝光保持连续。 只改变摄影机景别,不改变运动方向。
B7|前景遮挡 / 光线转场 Prompt
【前景遮挡】摄影机侧面跟随两人奔跑;一辆汽车从极近前景高速驶过,完全遮住画面0.4–0.6秒;车辆经过后切到另一场景;遮挡前后横向运动方向一致,用运动模糊隐藏切点。 【光线转场】镜头正对逆光太阳;女生靠近男生,身体逐渐进入太阳与镜头之间;眩光逐渐被遮挡、曝光自然下降;人物接触时太阳遮挡最明显;这是物理遮挡,不是后期闪黑。
B8|通用 Seedance 视频 Prompt(时间轴式)
【参考素材】@图1只负责人物身份;@图2只负责服装发型;@图3只负责场景结构;@图4只参考色彩、曝光和摄影质感。 【视频内容】0.0–2.0秒:【景别+机位】;人物【起始动作】;环境持续运动;摄影机【主要运镜】。 2.0–4.0秒:人物从【状态A】到【状态B】;动作速度【】,身体重心【】;摄影机继续【】。 4.0–6.0秒:人物完成【核心事件】;摄影机【停住/拉远/跟随】;停在【结束画面】。 【光影】【视觉风格】【声音】【限制】:身份、服装、发型不变;动作连续;摄影机只有一种主运动;无畸形、无无关人物、无随机漂移。
B9|完整案例|两个人一起倒进草里
参考人物图保持男女主身份一致;参考造型图保持学生服装和女生纯黑长直发;参考草地母帧锁定高草、浓绿色、夏日下午逆光。 0.0–1.5秒:两人在高草中并排快跑;低机位中远景跟随,稳定向前;风吹草、衣服和长直发。 1.5–2.4秒:两人同时失去平衡,重心向前下方坠落;不是拥抱。 2.4–3.6秒:两人倒向高草;摄影机同步向前下方跟坠一次,不乱摇、不旋转。 3.6–4.5秒:草叶遮挡镜头,摄影机落到近地位置后停止。 4.5–6.0秒:两人躺在草间,距离近但不拥抱;呼吸明显、表情平静。 声音:脚步、草叶、衣物、风、落地与呼吸。限制:仅一次跟坠,无浪漫翻滚、无笑、无卷发。
B10|Badcase 修复 Prompt
【减少自主动作】除明确动作外,不转头、不摆手、不微笑、不与镜头互动,只保留呼吸。 【摄影机乱漂】只允许缓慢向前推进;不横移、不摇镜、不环绕、不改变机位高度、无随机漂移。 【动作太慢】动作从0.8秒启动,在1秒内完成;不要慢动作、不要拖延准备。 【动作太夸张】降低幅度,保持真实惯性;不舞蹈、不夸张甩手、不突然大幅转身。 【风向不同步】风从左向右;头发、衬衫、裙摆与草叶同向、同时、同风力变化。
B11|延长 Prompt
向后延长视频1约5秒。 保持视频1中的人物身份、服装、场景、光线、颜色、摄影机位置和MiniDV质感完全连续。 视频1结束时两人已倒在草地中。延长部分:两人继续躺在草里,不立刻起身,只保留明显呼吸;风继续吹高草和女生纯黑长直发;摄影机保持落地后的原机位不动;声音延续风声、草声和呼吸声。 不要增加新动作,不改变景别,不改变光线。
B12|编辑 Prompt(局部修改)
严格编辑视频1。 只修改0–6秒女生头发:改为纯黑色长直发,长度到胸下至腰部,全程保持直发结构;受风时只能整束直发向侧面飘动,不能卷曲或波浪。 保持视频1原有的人脸、人物动作、男生、服装、草地、摄影机运动、光线、颜色和声音完全不变。