写出模型会照做的歌词。
方括号标签告诉模型每一块歌词的用途,风格框决定声音,标签之间只放能唱的词。本指南浓缩了最好的 Suno 与 AI 音乐教程的共识。
标签是用来读的,歌词是用来唱的。
在歌词框里,把 [Verse]、[Chorus] 这类结构标签单独占一行——模型把它们当作指令读取,而不是唱出来。没有方括号的每一行都是要照着唱的内容。而声音本身——流派、节奏、人声、情绪、乐器——属于风格框,不属于歌词。生成之后,只修出问题的那一段,不要重写整首歌。
LYRICS — 会被唱的内容
没有方括号的每一行都照原样演唱:你的词、你的韵、你的画面。
TAGS — 会被读的内容
带方括号的行给每一块定任务——结构、唱法、留白。模型把它们当作强提示,不是命令。
六步写一首歌
先定结构,再打标签,分好字段,然后一次只改一段。
- 1
先定结构,再写词
先定段落。一首典型的三分钟歌曲通常是 Intro → Verse 1 → Chorus → Verse 2 → Chorus → Bridge → Final Chorus → Outro。先有架构,再有词。方案在哪起草顺手就在哪起草——纸、备忘录或聊天 AI 都行——写好带标签的成品再贴进来。
- 2
给每个段落打上方括号标签
在歌词框里,把 [Intro]、[Verse 1]、[Pre-Chorus]、[Chorus]、[Bridge]、[Outro] 单独放一行,各自写在它管理的歌词行正上方——舞曲风格还可用 [Build]、[Drop]、[Breakdown]。一行一个标签;就算歌词是别的语言,标签也要用英文写。
- 3
标签之间只写能唱的词
没有方括号的每一行都会被唱出来,所以副歌句子要短、要重复,对应的主歌之间音节数要对齐,计划备注一律不要写进去——不带方括号的说明也会被当成歌词唱出来。
- 4
在风格框描述声音
在自定义模式的风格框里描述声音:先写流派,再写节奏、人声类型、情绪、乐器——最重要的词放最前面,用逗号分隔,这里不要用方括号。示例:dream pop, mid-tempo, airy female vocal, warm synth pads, bittersweet。
- 5
只在方案变化处加局部提示
标签里写一小段指令——[Bridge - drums fall away, close vocal]——只改一个段落,不动其他部分。圆括号提示单行的唱法:(whispered)、(spoken)、(harmony)。
- 6
生成、挑选、修段落
每次生成返回两个版本。留下更好的那个,然后用替换片段修单个段落,或用续写接着往下写——沿用完全相同的风格描述——而不是从头重新生成整首。
怎么写模型会照做的标签
标签是强提示,不是命令。简单、一致、重点前置的标签最容易被照做。
这样做
- 一行一个标签,单独占一行,放在它管理的段落正前方。
- 从头到尾用同一个名字——副歌叫 [Chorus],就别中途换成 [Hook]。
- 就算歌词是别的语言,标签也用英文写。
- 最重要的指令放最前面——越靠前的词权重越大。
- 给段落和重复编号:[Verse 2]、[Final Chorus]——结尾也给出提示:[Outro]、[Fade Out] 或 [End],歌才收得住,不会拖泥带水。
避免
- 在一个段落上堆互相打架的标签——[Chorus][Drop][Whispered] 彼此冲突。
- 在每个段落旁重复整套风格描述。全局声音只属于风格框。
- 在歌词行之间写大白话指示——「now make it sadder」会被唱出来。
- 指望 100% 服从。标签被无视时,把措辞简化,再生成一次。
- 因为一段不行就重新生成整首歌。
怎么写出唱起来好听的句子
模型照打进去的内容演唱。为耳朵写的句子唱得稳,为纸面写的句子会被赶着唱完。
这样做
- 副歌句子要短、要简单、要重复——重复才让副歌显得宏大。
- 平行句之间音节数对齐,两段主歌才能共用同一旋律。
- 想要每次副歌一模一样,就在每个 [Chorus] 标签下用同样的措辞把副歌完整写出来。
- 用具体的画面和朴素的词——「cold kitchen light」(冷冷的厨房灯光)唱起来比「ephemeral solitude」(虚幻的孤独)好听。
- 留出呼吸的空间:一行短句或一个 [Instrumental Break] 都能给编曲留白。
避免
- 密集的文学化长句——长词会被赶拍或含糊带过,硬塞进小节里。
- 副歌措辞每次重复都在漂移,结果每遍副歌都换了新旋律。
- 每一秒都塞满词。歌需要留白。
- 一整面没有标签的文字墙——模型只能猜结构,而且通常猜得偏短。
- 为了押韵牺牲自然的语句。近似韵也比破的语法唱得好。
风格提示词怎么写才好听
风格框是一段用逗号分隔的简短声音描述。顺序是有分量的——排在最前面的词,对整首歌的影响最大。
这样做
- 把流派和年代放在最前面——“late-90s alt rock”一个词组比十个形容词管用。
- 人声只写一次、写具体:“airy female vocal”“gravel male baritone”,而不是“唱功好”。
- 加上制作质感——“dry drums”“warm analog synths”影响的是混音,不只是音符。
- 控制在 5 到 8 个元素——每多一个词,前面词的分量就被稀释一分。
- 迭代时风格描述一个字都不要改——它是你的对照组。
避免
- 一次塞 20 个关键词——所有词互相抢戏,模型只能随机挑。
- 自相矛盾——“fast tempo, slow ballad”等于抛硬币。
- 空泛的夸奖词——“beautiful, amazing, emotional”对声音没有任何描述。
- 在风格框里写结构指令——“[Chorus]”和“第二段主歌要更伤感”是歌词框的事。
- 每次重写风格描述——你就再也说不清到底是哪个改动起了作用。
标签速查表
值得知道的标签都在这里,按用途分组。它们都单独占一行、用英文写,放在它管理的段落正上方。
结构——歌曲的骨架
[Intro]简短的开场。在第一段主歌之前定下情绪——常见的是纯器乐,或慢慢展开。
[Verse]讲故事的段落。记得编号——[Verse 1]、[Verse 2]——模型才会把它们当作一套。
[Pre-Chorus]主歌和副歌之间的一小段抬升。先把张力攒起来,副歌落地才更重。
[Chorus]这就是记忆点。最大声、最简单、重复最多的段落——每次回来,措辞都保持一模一样。
[Bridge]最后一遍副歌前刻意绕开一步。音乐走到新地方,歌词也换一个角度。
[Outro]收尾的段落。给出提示,歌才会按计划收尾,而不是话说到一半就停。
[Fade Out] / [End]结束指令。[Fade Out] 慢慢淡出;[End] 干净利落地停。
编曲与能量
[Build]张力上升:一层层乐器和能量往顶点堆。舞曲和流行里常用。
[Drop]蓄力之后的释放。所有东西一齐命中——节拍、贝斯、记忆点。
[Breakdown]把编曲拆到只剩几样元素。安静、留白,通常出现在最后一遍副歌之前。
[Instrumental Break]一段没有人声的伸展。让乐队或合成器来领奏。
[Guitar Solo] / [Piano Solo]突出一件乐器的独奏。风格需要什么乐器,就换成什么。
人声与演绎
[Whispered]唱得又轻又近。也能用在行内:在某一行前面写 (whispered)。
[Spoken]是说出来的,不是唱出来的。适合前奏、间奏和念白式的段落。
[Harmonies]在主旋律周围叠一层层的和声伴唱。
[Female Vocals] / [Male Vocals]给某个段落指定人声类型——或者干脆在风格框里一次性全局设定。
(whispered), (spoken), (harmony)圆括号提示只影响单独一行——而且权重比段落标签低。
只想临时改一处?把一句简短的指令直接写进标签里——[Bridge - drums fall away, close vocal]。一个段落一条指令,不动全局。
容易搞错的地方
不打标签的歌词等于把结构交给运气:模型自己决定段落长短,可能一段主歌后就结束。
不在方括号里的内容都会被唱。制作备注和计划——比如「verse 2 should be sadder」——都别放进歌词框。
风格框里用方括号是错误语法——风格字段就是逗号分隔的普通词。
圆括号用于单行的唱法提示——(whispered)、(spoken)、(harmony)——不是用来写背景说明的。
位置有分量:无论哪个框,写在字段顶部的词都比底部的更重要。
模型无视某个标签时,别再堆更多标签——简化措辞,再生成一次。
每次生成只改一处。新风格加新歌词加新结构,你根本不知道到底是哪个起了作用。
器乐段落也是标签:单独一行的 [Instrumental Break] 或 [Guitar Solo],或者标签下面留一个空段落。
带标签的歌词 vs 纯文本
同样的词、同样的风格提示——唯一的差别就是方括号标签。
| 如果你想… | 打了标签的歌词 | 纯文本 |
|---|---|---|
| 设定歌曲长度 | 增减或重复带标签的段落 | 长度不好预测 |
| 让副歌一模一样地回来 | 重复同一段标签副歌文本 | 重复容易漂移 |
| 之后修某一段 | 带标签的 [Verse 2] 用替换片段好定位 | 只能用耳朵找那一段 |
| 控制人声从哪进 | [Intro] 和 [Instrumental Break] 能压住人声 | 人声一上来就进 |
| 被编曲惊喜到 | 标签约束了结果 | 会有意外的惊喜 |
设定歌曲长度
- 打了标签的歌词:增减或重复带标签的段落
- 纯文本:长度不好预测
让副歌一模一样地回来
- 打了标签的歌词:重复同一段标签副歌文本
- 纯文本:重复容易漂移
之后修某一段
- 打了标签的歌词:带标签的 [Verse 2] 用替换片段好定位
- 纯文本:只能用耳朵找那一段
控制人声从哪进
- 打了标签的歌词:[Intro] 和 [Instrumental Break] 能压住人声
- 纯文本:人声一上来就进
被编曲惊喜到
- 打了标签的歌词:标签约束了结果
- 纯文本:会有意外的惊喜
写歌词常见问题
写在歌词框里、单独占一行的方括号行——[Verse]、[Chorus]、[Bridge]。它们告诉模型每一块歌词的用途。模型把它们当作指令读取,不会唱出来——但格式错误或生僻的标签偶尔会漏进人声里,这也是标签要保持简单的又一个理由。
必须。哪怕歌词是中文、日文或其他任何语言,标签也要用英文写——模型是用英文标签训练出来的。歌词本身可以用任何语言。
因为每一行不带方括号的内容都会被当作歌词。把结构放进方括号标签,计划备注则完全不要写进歌词框。
写在风格框,用逗号分隔的普通词——不要方括号。流派和节奏在前,人声类型、情绪、乐器在后,最重要的词放最前面。
能,但有个前提:圆括号提示比段落标签弱,有时会被无视。一行前面加圆括号提示唱法——(whispered)、(spoken)、(shouted)、(harmony)。要改整个段落,就把一小段指令写进段落标签里:[Bridge - stripped back, close vocal]。段落标签的分量更重。
一首典型的完整歌曲是两段主歌、两到三遍副歌,可能再加一个桥段——三分钟大约 30 到 60 行演唱行:疏朗的流行歌少些,说唱多些。带标签的段落越多歌会略长一点;要稳妥地加长,用续写在成曲上接着做。模型会拉伸或压缩演唱来适应内容,极端时还会重复或改写个别行。
如果副歌只写一次、后面的重复只标 [Chorus],模型可能会变旋律。最可靠的办法是在每个 [Chorus] 标签下粘贴同样的副歌文本——措辞一致,回归一致的可能性大大提高,但也不保证百分之百。
打标签。单独一行的 [Instrumental Break]、[Guitar Solo] 或 [Piano Solo] 能给编曲一段没有人声的伸展。标签下面留空段落也倾向于器乐。
标签是强提示,不是命令。简化措辞,把关键指令挪到前面,去掉堆叠的提示,再生成一次——更干净的提示通常会换来更好的版本。
续写在切点之后接着写:给新部分一个明确的标签,比如 [Final Chorus],并沿用原始的风格描述。替换片段重写一个区间,你歌词里已有的标签就是它编辑时依托的锚点。
相关指南
定方案。打标签。生成。
打开 Create,用方括号勾出段落,把声音写进风格框——结构会稳住。