全部指南

写出模型会照做的歌词。

方括号标签告诉模型每一块歌词的用途,风格框决定声音,标签之间只放能唱的词。本指南浓缩了最好的 Suno 与 AI 音乐教程的共识。

标签是用来读的,歌词是用来唱的。

在歌词框里,把 [Verse]、[Chorus] 这类结构标签单独占一行——模型把它们当作指令读取,而不是唱出来。没有方括号的每一行都是要照着唱的内容。而声音本身——流派、节奏、人声、情绪、乐器——属于风格框,不属于歌词。生成之后,只修出问题的那一段,不要重写整首歌。

LYRICS — 会被唱的内容

没有方括号的每一行都照原样演唱:你的词、你的韵、你的画面。

TAGS — 会被读的内容

带方括号的行给每一块定任务——结构、唱法、留白。模型把它们当作强提示,不是命令。

六步写一首歌

先定结构,再打标签,分好字段,然后一次只改一段。

  1. 1

    先定结构,再写词

    先定段落。一首典型的三分钟歌曲通常是 Intro → Verse 1 → Chorus → Verse 2 → Chorus → Bridge → Final Chorus → Outro。先有架构,再有词。方案在哪起草顺手就在哪起草——纸、备忘录或聊天 AI 都行——写好带标签的成品再贴进来。

  2. 2

    给每个段落打上方括号标签

    在歌词框里,把 [Intro]、[Verse 1]、[Pre-Chorus]、[Chorus]、[Bridge]、[Outro] 单独放一行,各自写在它管理的歌词行正上方——舞曲风格还可用 [Build]、[Drop]、[Breakdown]。一行一个标签;就算歌词是别的语言,标签也要用英文写。

  3. 3

    标签之间只写能唱的词

    没有方括号的每一行都会被唱出来,所以副歌句子要短、要重复,对应的主歌之间音节数要对齐,计划备注一律不要写进去——不带方括号的说明也会被当成歌词唱出来。

  4. 4

    在风格框描述声音

    在自定义模式的风格框里描述声音:先写流派,再写节奏、人声类型、情绪、乐器——最重要的词放最前面,用逗号分隔,这里不要用方括号。示例:dream pop, mid-tempo, airy female vocal, warm synth pads, bittersweet。

  5. 5

    只在方案变化处加局部提示

    标签里写一小段指令——[Bridge - drums fall away, close vocal]——只改一个段落,不动其他部分。圆括号提示单行的唱法:(whispered)、(spoken)、(harmony)。

  6. 6

    生成、挑选、修段落

    每次生成返回两个版本。留下更好的那个,然后用替换片段修单个段落,或用续写接着往下写——沿用完全相同的风格描述——而不是从头重新生成整首。

怎么写模型会照做的标签

标签是强提示,不是命令。简单、一致、重点前置的标签最容易被照做。

这样做

  • 一行一个标签,单独占一行,放在它管理的段落正前方。
  • 从头到尾用同一个名字——副歌叫 [Chorus],就别中途换成 [Hook]。
  • 就算歌词是别的语言,标签也用英文写。
  • 最重要的指令放最前面——越靠前的词权重越大。
  • 给段落和重复编号:[Verse 2]、[Final Chorus]——结尾也给出提示:[Outro]、[Fade Out] 或 [End],歌才收得住,不会拖泥带水。

避免

  • 在一个段落上堆互相打架的标签——[Chorus][Drop][Whispered] 彼此冲突。
  • 在每个段落旁重复整套风格描述。全局声音只属于风格框。
  • 在歌词行之间写大白话指示——「now make it sadder」会被唱出来。
  • 指望 100% 服从。标签被无视时,把措辞简化,再生成一次。
  • 因为一段不行就重新生成整首歌。

怎么写出唱起来好听的句子

模型照打进去的内容演唱。为耳朵写的句子唱得稳,为纸面写的句子会被赶着唱完。

这样做

  • 副歌句子要短、要简单、要重复——重复才让副歌显得宏大。
  • 平行句之间音节数对齐,两段主歌才能共用同一旋律。
  • 想要每次副歌一模一样,就在每个 [Chorus] 标签下用同样的措辞把副歌完整写出来。
  • 用具体的画面和朴素的词——「cold kitchen light」(冷冷的厨房灯光)唱起来比「ephemeral solitude」(虚幻的孤独)好听。
  • 留出呼吸的空间:一行短句或一个 [Instrumental Break] 都能给编曲留白。

避免

  • 密集的文学化长句——长词会被赶拍或含糊带过,硬塞进小节里。
  • 副歌措辞每次重复都在漂移,结果每遍副歌都换了新旋律。
  • 每一秒都塞满词。歌需要留白。
  • 一整面没有标签的文字墙——模型只能猜结构,而且通常猜得偏短。
  • 为了押韵牺牲自然的语句。近似韵也比破的语法唱得好。

风格提示词怎么写才好听

风格框是一段用逗号分隔的简短声音描述。顺序是有分量的——排在最前面的词,对整首歌的影响最大。

这样做

  • 把流派和年代放在最前面——“late-90s alt rock”一个词组比十个形容词管用。
  • 人声只写一次、写具体:“airy female vocal”“gravel male baritone”,而不是“唱功好”。
  • 加上制作质感——“dry drums”“warm analog synths”影响的是混音,不只是音符。
  • 控制在 5 到 8 个元素——每多一个词,前面词的分量就被稀释一分。
  • 迭代时风格描述一个字都不要改——它是你的对照组。

避免

  • 一次塞 20 个关键词——所有词互相抢戏,模型只能随机挑。
  • 自相矛盾——“fast tempo, slow ballad”等于抛硬币。
  • 空泛的夸奖词——“beautiful, amazing, emotional”对声音没有任何描述。
  • 在风格框里写结构指令——“[Chorus]”和“第二段主歌要更伤感”是歌词框的事。
  • 每次重写风格描述——你就再也说不清到底是哪个改动起了作用。

标签速查表

值得知道的标签都在这里,按用途分组。它们都单独占一行、用英文写,放在它管理的段落正上方。

结构——歌曲的骨架

  • [Intro]

    简短的开场。在第一段主歌之前定下情绪——常见的是纯器乐,或慢慢展开。

  • [Verse]

    讲故事的段落。记得编号——[Verse 1]、[Verse 2]——模型才会把它们当作一套。

  • [Pre-Chorus]

    主歌和副歌之间的一小段抬升。先把张力攒起来,副歌落地才更重。

  • [Chorus]

    这就是记忆点。最大声、最简单、重复最多的段落——每次回来,措辞都保持一模一样。

  • [Bridge]

    最后一遍副歌前刻意绕开一步。音乐走到新地方,歌词也换一个角度。

  • [Outro]

    收尾的段落。给出提示,歌才会按计划收尾,而不是话说到一半就停。

  • [Fade Out] / [End]

    结束指令。[Fade Out] 慢慢淡出;[End] 干净利落地停。

编曲与能量

  • [Build]

    张力上升:一层层乐器和能量往顶点堆。舞曲和流行里常用。

  • [Drop]

    蓄力之后的释放。所有东西一齐命中——节拍、贝斯、记忆点。

  • [Breakdown]

    把编曲拆到只剩几样元素。安静、留白,通常出现在最后一遍副歌之前。

  • [Instrumental Break]

    一段没有人声的伸展。让乐队或合成器来领奏。

  • [Guitar Solo] / [Piano Solo]

    突出一件乐器的独奏。风格需要什么乐器,就换成什么。

人声与演绎

  • [Whispered]

    唱得又轻又近。也能用在行内:在某一行前面写 (whispered)。

  • [Spoken]

    是说出来的,不是唱出来的。适合前奏、间奏和念白式的段落。

  • [Harmonies]

    在主旋律周围叠一层层的和声伴唱。

  • [Female Vocals] / [Male Vocals]

    给某个段落指定人声类型——或者干脆在风格框里一次性全局设定。

  • (whispered), (spoken), (harmony)

    圆括号提示只影响单独一行——而且权重比段落标签低。

只想临时改一处?把一句简短的指令直接写进标签里——[Bridge - drums fall away, close vocal]。一个段落一条指令,不动全局。

容易搞错的地方

不打标签的歌词等于把结构交给运气:模型自己决定段落长短,可能一段主歌后就结束。

不在方括号里的内容都会被唱。制作备注和计划——比如「verse 2 should be sadder」——都别放进歌词框。

风格框里用方括号是错误语法——风格字段就是逗号分隔的普通词。

圆括号用于单行的唱法提示——(whispered)、(spoken)、(harmony)——不是用来写背景说明的。

位置有分量:无论哪个框,写在字段顶部的词都比底部的更重要。

模型无视某个标签时,别再堆更多标签——简化措辞,再生成一次。

每次生成只改一处。新风格加新歌词加新结构,你根本不知道到底是哪个起了作用。

器乐段落也是标签:单独一行的 [Instrumental Break] 或 [Guitar Solo],或者标签下面留一个空段落。

带标签的歌词 vs 纯文本

同样的词、同样的风格提示——唯一的差别就是方括号标签。

  • 设定歌曲长度

    • 打了标签的歌词:增减或重复带标签的段落
    • 纯文本:长度不好预测
  • 让副歌一模一样地回来

    • 打了标签的歌词:重复同一段标签副歌文本
    • 纯文本:重复容易漂移
  • 之后修某一段

    • 打了标签的歌词:带标签的 [Verse 2] 用替换片段好定位
    • 纯文本:只能用耳朵找那一段
  • 控制人声从哪进

    • 打了标签的歌词:[Intro] 和 [Instrumental Break] 能压住人声
    • 纯文本:人声一上来就进
  • 被编曲惊喜到

    • 打了标签的歌词:标签约束了结果
    • 纯文本:会有意外的惊喜

写歌词常见问题

写在歌词框里、单独占一行的方括号行——[Verse]、[Chorus]、[Bridge]。它们告诉模型每一块歌词的用途。模型把它们当作指令读取,不会唱出来——但格式错误或生僻的标签偶尔会漏进人声里,这也是标签要保持简单的又一个理由。

必须。哪怕歌词是中文、日文或其他任何语言,标签也要用英文写——模型是用英文标签训练出来的。歌词本身可以用任何语言。

因为每一行不带方括号的内容都会被当作歌词。把结构放进方括号标签,计划备注则完全不要写进歌词框。

写在风格框,用逗号分隔的普通词——不要方括号。流派和节奏在前,人声类型、情绪、乐器在后,最重要的词放最前面。

能,但有个前提:圆括号提示比段落标签弱,有时会被无视。一行前面加圆括号提示唱法——(whispered)、(spoken)、(shouted)、(harmony)。要改整个段落,就把一小段指令写进段落标签里:[Bridge - stripped back, close vocal]。段落标签的分量更重。

一首典型的完整歌曲是两段主歌、两到三遍副歌,可能再加一个桥段——三分钟大约 30 到 60 行演唱行:疏朗的流行歌少些,说唱多些。带标签的段落越多歌会略长一点;要稳妥地加长,用续写在成曲上接着做。模型会拉伸或压缩演唱来适应内容,极端时还会重复或改写个别行。

如果副歌只写一次、后面的重复只标 [Chorus],模型可能会变旋律。最可靠的办法是在每个 [Chorus] 标签下粘贴同样的副歌文本——措辞一致,回归一致的可能性大大提高,但也不保证百分之百。

打标签。单独一行的 [Instrumental Break]、[Guitar Solo] 或 [Piano Solo] 能给编曲一段没有人声的伸展。标签下面留空段落也倾向于器乐。

标签是强提示,不是命令。简化措辞,把关键指令挪到前面,去掉堆叠的提示,再生成一次——更干净的提示通常会换来更好的版本。

续写在切点之后接着写:给新部分一个明确的标签,比如 [Final Chorus],并沿用原始的风格描述。替换片段重写一个区间,你歌词里已有的标签就是它编辑时依托的锚点。

相关指南

定方案。打标签。生成。

打开 Create,用方括号勾出段落,把声音写进风格框——结构会稳住。