寫出模型真的會照著唱的歌詞。
方括號標籤告訴模型每段歌詞的用途,風格框決定聲音,標籤之間只放能唱的字。這份指南濃縮了最好的 Suno 與 AI 音樂教學的共同結論。
標籤是讀的。歌詞是唱的。
在歌詞框中,把 [Verse]、[Chorus] 這類結構標籤單獨放一行——模型會把它們當作指令讀取,而不是唱出來。每行沒有方括號的文字都是要照著唱的內容。聲音本身——曲風、速度、人聲、情緒、樂器——屬於風格框,不屬於歌詞。先產生,再修單一段落,而不是重寫整首歌。
LYRICS — 被唱出來的內容
每行沒有方括號的文字都會照原文演唱:你的字句、你的押韻、你的意象。
TAGS — 被讀取的內容
方括號行設定每個段落的任務——結構、唱法、間歇。模型把它們當作強提示,不是命令。
六步寫好一首歌
先規劃結構,加上標籤,分好欄位,然後一次只迭代一個段落。
- 1
下筆前先規劃結構
先決定段落。典型的三分鐘歌曲是 Intro → Verse 1 → Chorus → Verse 2 → Chorus → Bridge → Final Chorus → Outro。先架構,後文字。計畫在哪裡起草順手就在哪裡起草——紙、備忘錄或聊天 AI 都行——寫好帶標籤的成品再貼進來。
- 2
用方括號標記每個段落
在歌詞框中,把 [Intro]、[Verse 1]、[Pre-Chorus]、[Chorus]、[Bridge]、[Outro] 各自單獨一行,放在它管轄的歌詞行正上方——舞曲風格還可用 [Build]、[Drop]、[Breakdown]。一行一個標籤,而且即使歌詞是其他語言,標籤也要用英文寫。
- 3
只在標籤之間寫能唱的字
每行沒有方括號的文字都會被唱,所以副歌行要保持短而重複,對應的主歌之間音節數要一致,並把規劃筆記排除在外——沒有方括號的指令會被唱出來。
- 4
在風格框描述聲音
在自訂模式的風格框裡描述聲音:曲風在前,然後是速度、人聲類型、情緒與樂器——最重要的字放最前面,用逗號分隔,這裡不要用方括號。範例:dream pop, mid-tempo, airy female vocal, warm synth pads, bittersweet。
- 5
只在計畫改變的地方加局部提示
標籤內的簡短指令——[Bridge - drums fall away, close vocal]——只改變一個段落,不動其他部分。括號提示單行的唱法:(whispered)、(spoken)、(harmony)。
- 6
產生、挑選、修段落
每次產生會回傳兩首候選歌曲。保留較好的那首,然後用替換片段修單一段落,或用續寫延續歌曲——沿用一模一樣的風格字句——而不是從頭重新產生整首。
如何寫出模型會照著做的標籤
標籤是強提示,不是命令。簡單、一致、重點在前的標籤最容易被遵守。
建議
- 一行一個標籤,單獨一行,放在它管轄的段落正前方。
- 每次用同樣的名稱——如果副歌是 [Chorus],就不要中途換成 [Hook]。
- 即使歌詞是其他語言,標籤也要用英文寫。
- 最重要的指令放最前面——越前面的字權重越高。
- 為段落和重複編號:[Verse 2]、[Final Chorus]——結尾也給出提示:[Outro]、[Fade Out] 或 [End],歌才收得住,不會拖泥帶水。
避免
- 在同一個段落堆疊互相矛盾的標籤——[Chorus][Drop][Whispered] 會互相打架。
- 在每個段落旁重複整段風格描述。全域聲音只屬於風格框。
- 把白話指示寫在歌詞行之間——「現在唱得更悲傷」這種字也會被唱出來。
- 期待百分之百服從。如果標籤被忽略,把字句簡化再產生一次。
- 因為一個段落失敗就重新產生整首歌。
如何寫出好唱的歌詞行
模型會演唱你輸入的一切。為耳朵寫的行落得住;為紙面寫的行會被趕拍。
建議
- 副歌行保持短、簡單、重複——重複正是讓副歌感覺宏大的原因。
- 對應的行之間音節數要一致,讓主歌共用同一條旋律。
- 想要每次完全相同的副歌返回時,在每個 [Chorus] 標籤下完整寫出副歌,字句一模一樣。
- 用具體意象和日常用字——「cold kitchen light」比「ephemeral solitude」好唱。
- 留呼吸空間:一行短句或一個 [Instrumental Break] 能給編曲留出空間。
避免
- 密實的文學化句子——長字會為了塞進小節而被趕拍或含糊帶過。
- 讓副歌字句在每次重複間漂移,結果每段副歌都換一條新旋律。
- 每一秒都塞滿字。歌曲需要空氣。
- 一整面沒有標籤的文字——模型只能猜結構,而且通常猜得偏短。
- 為了硬押韻犧牲自然的語句。近似韻比破碎的文法好唱。
風格提示詞怎麼寫才好聽
風格框是一段用逗號分隔的簡短聲音描述。順序是有分量的——排在最前面的詞,對整首歌的影響最大。
建議
- 把流派和年代放在最前面——「late-90s alt rock」一個詞組比十個形容詞管用。
- 人聲只寫一次、寫具體:「airy female vocal」「gravel male baritone」,而不是「唱功好」。
- 加上製作質感——「dry drums」「warm analog synths」影響的是混音,不只是音符。
- 控制在 5 到 8 個元素——每多一個詞,前面詞的分量就被稀釋一分。
- 迭代時風格描述一個字都不要改——它是你的對照組。
避免
- 一次塞 20 個關鍵字——所有詞互相搶戲,模型只能隨機挑。
- 自相矛盾——「fast tempo, slow ballad」等於丟硬幣。
- 空泛的稱讚詞——「beautiful, amazing, emotional」對聲音沒有任何描述。
- 在風格框裡寫結構指令——「[Chorus]」和「第二段主歌要更傷感」是歌詞框的事。
- 每次重寫風格描述——你就再也說不清到底是哪個改動起了作用。
標籤小抄
每個值得認識的標籤,按用途分組。全部單獨一行、用英文寫,放在它管轄的段落正前方。
結構——歌曲的骨架
[Intro]簡短的開場。在第一段主歌前定下情緒——常是純樂器,或緩慢揭開。
[Verse]講故事的段落。記得編號——[Verse 1]、[Verse 2]——模型才會把它們當成一組。
[Pre-Chorus]主歌和副歌之間的短暫推升。累積張力,讓副歌落得更重。
[Chorus]記憶點。最大、最簡單、重複最多次的段落——每次返回時字句保持一模一樣。
[Bridge]最後一段副歌前的刻意轉向。音樂走到新地帶,歌詞換一個角度。
[Outro]收尾的段落。有標,歌才收得住,不會話說一半就停。
[Fade Out] / [End]結尾指令。[Fade Out] 慢慢淡出;[End] 停得乾淨。
編曲與能量
[Build]張力上升:一層層堆疊,能量推向頂點。舞曲和流行常用。
[Drop][Build] 之後的釋放。全部一次砸下——節拍、低音、記憶點。
[Breakdown]把編曲剝到只剩幾個元素。安靜、留白,通常在最後一段副歌之前。
[Instrumental Break]一整段沒有人聲。換樂團或合成器領奏。
[Guitar Solo] / [Piano Solo]獨奏的重頭戲。換上你的曲風需要的樂器。
人聲與唱法
[Whispered]唱得輕而貼近。也能行內使用:在單一行前面放 (whispered)。
[Spoken]用講的,不是唱的。適合開場、間奏和口白時刻。
[Harmonies]沿著主旋律層層疊上和聲。
[Female Vocals] / [Male Vocals]設定單一段落的人聲類型——或在風格框裡設一次,全域生效。
(whispered), (spoken), (harmony)括號提示只影響單一行——而且權重比段落標籤低。
需要一次性調整?把簡短指令寫進標籤本身——[Bridge - drums fall away, close vocal]。一個段落,一個指令,不影響全域。
容易出錯的地方
沒有標籤的歌詞把結構交給運氣:模型自選段落長度,可能唱完一段主歌就結束。
不在方括號裡的都會被唱。把製作筆記和「第二段主歌要更悲傷」這類計畫排除在歌詞框之外。
風格框裡用方括號是錯的語法——風格欄位只能是逗號分隔的普通文字。
括號用於單行的唱法提示——(whispered)、(spoken)、(harmony)——不是用來放背景文字。
位置有分量:在兩個框裡,越上面的字比下面的字更重要。
如果模型忽略某個標籤,不要堆更多標籤——把字句簡化再產生一次。
每次產生只改一件事。新風格加新歌詞加新結構,你完全看不出哪個調整真正有效。
器樂段落就是一個標籤:[Instrumental Break] 或 [Guitar Solo] 單獨一行,或在標籤下留一個空段落。
有標籤歌詞 vs 純文字
同樣的字、同樣的風格提示——方括號標籤是唯一差別。
| 如果你想要… | 有標籤歌詞 | 純文字 |
|---|---|---|
| 設定歌曲長度 | 增加或重複有標籤的段落 | 長度不好預測 |
| 讓副歌一模一樣地回來 | 重複同一段有標籤的副歌文字 | 重複容易漂移 |
| 之後修正某個壞段落 | 帶標籤的 [Verse 2] 用替換片段好定位 | 憑耳朵找那段範圍 |
| 控制人聲何時進入 | [Intro] 和 [Instrumental Break] 會擋住人聲 | 人聲立刻開始 |
| 享受編曲的驚喜 | 標籤會約束結果 | 常有意外驚喜 |
設定歌曲長度
- 有標籤歌詞:增加或重複有標籤的段落
- 純文字:長度不好預測
讓副歌一模一樣地回來
- 有標籤歌詞:重複同一段有標籤的副歌文字
- 純文字:重複容易漂移
之後修正某個壞段落
- 有標籤歌詞:帶標籤的 [Verse 2] 用替換片段好定位
- 純文字:憑耳朵找那段範圍
控制人聲何時進入
- 有標籤歌詞:[Intro] 和 [Instrumental Break] 會擋住人聲
- 純文字:人聲立刻開始
享受編曲的驚喜
- 有標籤歌詞:標籤會約束結果
- 純文字:常有意外驚喜
歌詞常見問題
方括號中的行——[Verse]、[Chorus]、[Bridge]——在歌詞框中單獨一行。它們告訴模型每段歌詞的用途。模型把它們當作指令讀取,不會唱出來——但格式錯誤或生僻的標籤偶爾會漏進人聲裡,這也是標籤要保持簡單的又一個理由。
要。即使歌詞是中文、日文或任何其他語言,標籤也要用英文寫——模型是用英文標籤訓練的。歌詞本身可以用任何語言。
因為每行沒有方括號的文字都會被當成歌詞。把結構放進方括號標籤,規劃筆記則完全不要放進歌詞框。
放在風格框,用逗號分隔的普通文字——不要方括號。曲風和速度在前,然後是人聲類型、情緒與樂器,最重要的字放最前面。
可以,但有個前提:圓括號提示比段落標籤弱,有時會被無視。行正前方的括號提示唱法——(whispered)、(spoken)、(shouted)、(harmony)。若要改整個段落,改把簡短指令放進段落標籤內:[Bridge - stripped back, close vocal]。段落標籤的分量更重。
典型的完整歌曲是兩段主歌、兩到三次副歌,也許加一段橋段——三分鐘大約 30 到 60 行演唱行:疏朗的流行歌少些,饒舌多些。標籤段落越多歌會略長一點;要穩妥地加長,用續寫在成曲上接著做。模型會拉長或壓縮演唱來適應內容,極端時還會重複或改寫個別行。
如果你只寫一次副歌,之後的重複只標 [Chorus],模型可能會變化旋律。最可靠的做法是在每個 [Chorus] 標籤下貼上同樣的副歌文字——措辭一致,返回一致的可能性大幅提高,但也不保證百分之百。
加上標籤。[Instrumental Break]、[Guitar Solo] 或 [Piano Solo] 單獨一行,就能給編曲一段沒有人聲的伸展。標籤下的空段落也會偏向器樂。
標籤是強提示,不是命令。把字句簡化,把關鍵指令移到最前面,拿掉堆疊的提示,再產生一次——乾淨的提示通常能換來全新版本。
續寫從切點之後繼續:給新段落一個明確標籤,例如 [Final Chorus],並沿用原本的風格字句。替換片段重寫一段範圍,你歌詞中已有的標籤就是它編輯時的錨點。
相關指南
規劃。標記。產生。
開啟 Create,用方括號畫出你的段落,把聲音放進風格框——結構會穩穩守住。