Suno能從文字提示產生完整歌曲(人聲、樂器、編曲與混音)。V5.5可產出錄音室等級音訊,每次生成最長可達8分鐘,並新增Voices、Custom Models與My Taste自適應偏好。掌握3套系統(提示文字+中繼標籤(metatags)+Creative Sliders),Suno就會從新奇玩具變成製作工具。使用Custom Mode取得控制權,用中繼標籤安排歌曲結構,再透過Song Editor反覆精修。Pro方案(每月10美元,或年繳每月8美元)可使用V5.5並取得商業權利。
Suno的200萬付費訂閱者每天產生700萬首歌曲,每兩週就超越Spotify整個1億首歌的曲庫規模。18 V5跨過了早期版本無法達到的門檻:聽眾會投入聆聽,卻沒有察覺那是AI產生的作品。1 它不再只是新奇嘗試或暫用素材,而是能實際用於製作情境的音樂。
重點摘要
- 認真製作時,Custom Mode不可或缺。 Simple Mode會移除讓Suno成為製作工具的控制項。本指南中的每項技巧,都假設使用Custom Mode,並分別設定Style、Lyrics與Title欄位。
- 這是3套控制系統,不是1套。 Prompt文字定義音樂性格。Metatags控制編曲與結構。Creative Sliders塑造生成結果的個性。掌握這三者,正是可用成品與隨機結果之間的分水嶺。
- Metatags是影響最大的技能。 使用[Verse]/[Chorus]/[Bridge]結構,加上參數化修飾([Verse: whispered vocals, acoustic guitar only]),即可透過純文字達到接近DAW層級的分段編曲控制。
- V5.5是目前的旗艦版本。 在V5的製作品質基礎上(錄音室等級音訊、自然人聲、真實樂器分離),V5.5加入Voices、可依照個人風格客製的Custom Models,以及My Taste自適應偏好。若要存取V5.5、Voices與Custom Models,需要Pro方案(每月$10,或年繳每月$8)。
- 反覆迭代,不要只靠運氣。 生成流程(構思->挑選->修整->延展->編輯->匯出)通常每首精修曲目會花費50–100點credits。請為迭代編列預算,而不是期待一次到位。
- Credits不會累積,但加購點數不會過期。 每月credits會在每個帳單週期重設。購買的加購credits只要訂閱仍有效就會保留,因此很適合在密集製作前先行儲備。
什麼是Suno?
Suno是一個生成式AI平台,可根據文字描述創作完整歌曲。不同於DAW、取樣素材庫或以loop為基礎的工具,Suno會同時生成一首曲目的所有元素:旋律、和聲、節奏、配器、人聲(含歌詞)、編曲與混音。您只要描述想要的內容,Suno就會產出一首完成歌曲。
Suno與傳統音樂製作相比如何?
| 面向 | Suno | 傳統製作 |
|---|---|---|
| 輸入 | 文字prompt+選填歌詞 | 音符、MIDI、錄音音訊 |
| 輸出 | 完整混音歌曲 | 需要混音的個別音軌 |
| 產出第一版所需時間 | 約30秒 | 數小時到數天 |
| 所需音樂知識 | 描述性詞彙 | 樂器熟練度、樂理、混音 |
| 迭代方式 | 重新prompt、編輯段落、調整sliders | 重新錄製、重新編曲、重新混音 |
| 最長長度 | 每次生成8分鐘(可延展) | 無限制 |
您可以創作的內容:
- 含人聲的完整歌曲:任何genre、任何語言,原創歌詞或AI生成歌詞皆可
- Instrumentals:背景音樂、配樂、ambient曲目
- Genre實驗:跨genre融合,通常需要多位專門樂手才能完成
- 變奏版本:針對同一概念生成數十個takes,再挑選最佳版本
- 製作元素:可用於傳統DAW工作流程的stems
Suno不是什麼:
- 不是DAW:您不會手動混音、母帶處理或編曲(雖然Studio加入了部分相關功能)
- 不是決定性的工具:同一個prompt每次都會產生不同結果
- 不是取樣素材庫:無法精準分離並重複使用個別聲音
- 不是無限制:生成會消耗credits,且品質會因嘗試次數而異
開始使用
快速開始(5分鐘)
- 建立帳號:前往suno.com。免費方案每天提供50點credits(約10首歌,通常是5批每批2首的Create)。
- 先試用Simple Mode。 輸入像是「upbeat indie rock song about a road trip」這類簡短描述,然後點選Create。Suno會自動生成歌詞、旋律、編曲與人聲。
- 切換到Custom Mode以取得控制權。Custom Mode會將prompt分成不同欄位:
- Style of Music:Genre、情緒、配器描述詞
- Lyrics:您的歌詞,搭配metatags標示結構
- Title:歌曲標題
- 聆聽兩個輸出版本。 Suno每次創作會生成2個變化版本。挑選較接近意圖的版本,再進一步修整。
- 使用Extend延續歌曲,使其超出初始生成長度;或使用Song Editor替換特定段落。
介面概覽
Suno的網頁介面有2種主要創作模式:
Simple Mode:一個文字框。用自然語言描述歌曲。Suno會推斷genre、撰寫歌詞並生成所有內容。適合探索,不適合精準控制。
Custom Mode:3個獨立欄位(Style、Lyrics、Title)加上Creative Sliders。Custom Mode才是認真製作的核心。Style欄位可接受genre與製作描述詞。Lyrics欄位可接受含metatags的文字。Sliders則控制生成結果的個性。
從Custom Mode開始。 Simple Mode很方便,但會移除讓Suno適合製作工作的控制項。本指南中的每項技巧,都假設使用Custom Mode。
Models與版本
Suno自推出以來快速迭代。每個版本都帶來實質的品質提升,但存取權會依訂閱層級而有所不同。
版本時間軸
| Version | Release | 主要改進 |
|---|---|---|
| V2 | 2023年秋季 | 第一個公開模型。短片段(約30秒)、有限的曲風範圍、明顯的AI痕跡。 |
| V3 | 2024年3月 | 延長至2分鐘。提升人聲清晰度。擴充曲風涵蓋範圍。 |
| V3.5 | 2024年夏季 | 更好的混音、減少瑕疵、改善人聲自然度。 |
| V4 | 2024年11月19日 | 重大品質躍升。4分鐘生成、多語人聲、Covers功能、2-stem分離。 |
| V4.5 | 2025年5月1日 | 8分鐘單次生成(由4分鐘提升)、Creative Sliders(Weirdness、Style Influence)、Prompt Enhancement Helper、擴充曲風準確度、強化人聲。19 |
| V4.5-All | 2025年末 | 免費層級模型。結合V4.5改進與更廣泛的存取權。 |
| V5 | 2025年9月 | 錄音室級音訊20、更高的母帶品質、Suno Studio DAW2、12-stem分離22、Persona Voices15。內部名稱:chirp-crow。20 |
| V5.5 | 2026年3月26日 | 目前旗艦版本。具驗證機制的Voices(Pro/Premier)、Custom Models(每位Pro/Premier訂閱者最多3個)、My Taste自適應偏好系統(所有使用者)。3031 |
目前模型存取權
| 層級 | 模型存取權 | 品質說明 |
|---|---|---|
| Free | V4.5-All | 品質良好,但在人聲自然度與混音清晰度上明顯低於V5.5。沒有Voice Cloning或Custom Models。可使用My Taste。 |
| Pro($10/月) | V5.5 | 錄音室級品質。Voices、最多3個Custom Models、My Taste。 |
| Premier($30/月) | V5.5 + Studio | 生成品質與Pro相同,另含Suno Studio DAW。Voices、最多3個Custom Models、My Taste。 |
V5相較V4.5是有感升級。差異最容易在人聲自然度(較少「AI歌手」感)、低頻清晰度(貝斯與大鼓分離)以及立體聲音像中聽出來。如果您正在評估將Suno用於製作,請以V5評估,而不是免費層級。
V5改變了什麼
V5(內部稱為「chirp-crow」20)代表Suno單一版本中幅度最大的改進:1
- 錄音室級音訊保真度:V5的母帶品質高於V4.5;官方文件以製作層面的描述說明改進,而不是標示特定取樣率。第三方Suno產品中心列出V5為44.1 kHz;如果精確取樣率對您的流程很重要,請檢查匯出的WAV。1620
- 人聲自然度:降低先前版本常見的「恐怖谷」質感。顫音、呼吸聲與子音咬字更具說服力。1
- 樂器分離度:混音中的個別樂器更清楚分明。較少出現「聲牆」式混在一起的感覺。1
- 動態範圍:更能處理由弱到強的轉換。先前版本傾向把所有聲音都壓縮在一起。1
- 曲風準確度:更貼近曲風慣例。「jazz」提示聽起來更像真正的爵士,而不是「帶爵士和弦的流行歌」。19
- Suno Studio:瀏覽器內DAW,用於生成後編輯。無需重新生成即可調整混音、隔離stem並變更編曲。2
V5.5改變了什麼
V5.5(2026年3月26日)以V5的音訊品質為基礎,加入3項個人化功能:3031
- Voices:複製或重複使用您自己的聲音來生成內容。Suno會要求驗證,方式是將一段朗讀語句與上傳或即時擷取的人聲樣本進行比對。僅限Pro/Premier,需使用v5.5模型,且可用性受年齡與所在地限制。在Create選單中,Voices按鈕已取代Personas按鈕,不過Style Personas仍可在Voices選單內存取。31
- Custom Models:根據您目錄中的歌曲或在Suno以外製作的曲目,訓練最多3個V5.5個人化版本。Suno目前的v5.5公告表示Custom Models至少需要6首歌曲;建議使用風格一致的曲目,而不是混入隨機曲風,因為模型學習的是您的聲音風格,不是一包互不相干的參考素材。3031
- My Taste:所有使用者皆可使用的自適應偏好系統。它會從您喜愛的曲風、情緒,以及創作/聆聽習慣中學習,讓未來生成更偏向您偏好的風格、製作美學與人聲特質。啟用Style Augmentation時,Styles方塊右上角的魔杖圖示會產生個人化的風格描述。My Taste預設啟用,可從頭像選單編輯或停用。31
價格與Credits
已於2026年5月驗證。Suno價格可能不另行通知而變更。請至suno.com/pricing確認目前費率。13
方案比較
| 功能 | Free | Pro($10/月) | Premier($30/月) |
|---|---|---|---|
| 年繳 | N/A | $8/月($96/年) | $24/月($288/年) |
| Credits | 50/天 | 2,500/月 | 10,000/月 |
| 模型 | V4.5-All | V5.5 | V5.5 |
| 包含歌曲數 | 10/天 | 最多500/月 | 最多2,000/月 |
| 並行歌曲 | 共享佇列中4首 | 優先佇列中10首 | 優先佇列中10首 |
| 價格頁列出的音訊上傳限制 | 最多8分鐘 | 最多30分鐘 | 最多30分鐘 |
| Song Editor | 有限 | 完整 | 完整 |
| Covers/Remixes | 否 | 是 | 是 |
| Persona Voices | 否 | 是 | 是 |
| Voice Cloning | 否 | 是 | 是 |
| Custom Models | 否 | 最多3個 | 最多3個 |
| My Taste | 是 | 是 | 是 |
| Suno Studio | 否 | 否 | 是 |
| Stem Separation | Split from Mix(2) | Split from Mix + Auto Split(12) | Split from Mix + Auto Split + Advanced Split(約100) |
| 商業使用 | 否 | 是 | 是 |
| 優先生成 | 否 | 是 | 是 |
| Credit結轉 | N/A | 否 | 否 |
| 加購credits | 否 | 是 | 是 |
Credit經濟性
每首歌約需5 credits。典型的Create動作會回傳2個歌曲變化版本,因此每批2首歌約需預算10 credits。Pro訂閱的每月2,500 credits最多可產生500首歌。13
節省credits的做法: - 使用Custom Mode搭配具體提示,減少丟棄不用的生成結果 - 對有潛力的曲目使用Extend,而不是從零重新生成 - 使用Song Editor修正段落,而不是重新生成整首歌 - 先精煉Style prompt再生成,以節省credits
每月credits不會結轉。帳單週期結束時,未使用的credits會歸零。請據此規劃生成工作階段。
每月額度用完後會有每日額外credits。當每月credits用盡後,付費訂閱者在下一個帳單週期前,每天會收到50個額外credits,與免費層級的每日額度相同。這可避免月底完全無法生成,但相較每月額度是大幅縮減(50/天,相對於Pro約83/天、Premier約333/天)。24
只要訂閱維持有效,加購credits就不會過期。購買的加購credits需有有效訂閱才能使用。如果取消訂閱,加購credits會在重新訂閱前無法使用。這種保留機制讓加購credits適合在密集製作工作階段前先行囤積。13
提示詞架構
Suno 的 Custom Mode 將您的創意輸入分為3個欄位,每個欄位各有明確用途。瞭解內容該放在哪裡(以及不該放在哪裡),正是結果時好時壞與穩定輸出的關鍵差異。
Style 欄位
Style 欄位定義生成音樂的整體特質。它接受自然語言描述詞,可用來指定曲風、情緒、速度、樂器配置、人聲質感與製作風格。
最佳公式:
[Genre] [Subgenre], [Tempo/Energy], [Key instruments], [Vocal style], [Production quality], [Mood]
Copy
範例:
Indie folk rock, mid-tempo, acoustic guitar and mandolin, warm female vocals, lo-fi production, nostalgic and wistful
Copy
描述詞的理想數量:4–7個。 少於4個會讓 Suno 擁有過大的發揮空間;超過7個,描述詞便會開始相互牴觸,導致結果混濁,沒有任何單一特質能夠清楚呈現。14
前後比較:提示詞的精準度至關重要
即使創作意圖相同,Style 欄位的精準程度不同,產生的結果也會大相逕庭:
模糊的提示詞(2個描述詞):
rock, energetic
Copy
結果: 常見的流行搖滾,搭配標準鼓組、失真吉他與男聲;人聲預設為適合廣播播放的風格。Suno 會以最常見的預設值補齊所有未指定的參數。生成10次後,沒有任何兩首聽起來彼此相關。
精準的提示詞(6個描述詞):
Garage rock, raw and aggressive, distorted bass, room mic drums, shouted male vocals, lo-fi production
Copy
結果: 穩定產生具有鮮明 lo-fi 特質的車庫搖滾。鼓聲帶有室內麥克風收音感,貝斯突出,人聲原始粗獷。生成10次後,每首都具有易於辨識且一致的聲音特徵;差異主要出現在旋律與編曲,而非音樂的根本性格。
差異原因: 每個描述詞都會限制輸出的其中一個面向。單獨使用「Rock」,會讓速度、人聲風格、製作品質、樂器平衡與情緒完全由 Suno 決定。加入「garage」可限定子類型的慣例;「lo-fi production」會限制聲音質地;「shouted male vocals」則會限定人聲演繹方式。模型可採用通用預設選項的空間因而縮小。
過度指定的提示詞(10個以上描述詞):
Garage rock, raw and aggressive, distorted bass, room mic drums, shouted male vocals, lo-fi production, 145 BPM, minor key, reverb-heavy, vintage tube amp warmth, 1960s Detroit influence
Copy
結果: 混濁的折衷成果。Suno 無法同時滿足所有限制,因此只能部分實現每項要求。「1960s Detroit influence」可能與「145 BPM」衝突,而「reverb-heavy」也會與「lo-fi production」相互牴觸。最終輸出聽起來混亂,而非明確具體。
Style 欄位中有效的內容
| 描述詞類型 | 範例 | 效果 |
|---|---|---|
| 曲風 | rock, jazz, hip-hop, EDM, classical, country | 主要音樂架構 |
| 子類型 | shoegaze, bossa nova, trap, dubstep, baroque | 縮小曲風慣例的範圍 |
| 速度 | slow, mid-tempo, upbeat, fast, 120 BPM | 控制速度(BPM 數值為約略值,並非精確值) |
| 樂器 | acoustic guitar, synth pad, brass section, strings | 建議樂器配置(不保證採用) |
| 人聲質感 | raspy male vocals, ethereal female vocals, choir | 塑造人聲特質 |
| 製作風格 | lo-fi, polished, raw, overdriven, clean | 整體聲音質地 |
| 情緒 | melancholic, euphoric, aggressive, dreamy, dark | 情感基調 |
| 年代 | 80s, 90s grunge, 2000s pop, vintage, modern | 特定時期的音樂慣例 |
Style 欄位中無效的內容
- 特定藝人姓名:「Sounds like Adele」並不可靠,也可能遭到篩選。請改用描述性的同義表達:「powerful female vocal, piano-driven pop ballad」
- 技術性混音術語:「Sidechain compression on the kick」會被忽略。Suno 不會解讀混音參數
- 精確控制 BPM:「127 BPM」只會被視為約略指引,無法像節拍器一樣鎖定速度
- 否定式指示:在 Style 欄位中輸入「No drums」並不可靠。若要排除不需要的樂器與元素,請使用 Advanced Options 下的官方 Exclude 欄位;若要設定整首曲目的結構,請使用 Instrumental 切換選項;若要控制個別段落,則使用 metatags(中繼標籤)
Lyrics 欄位
Lyrics 欄位接受歌曲文字,並可選擇加入 metatags(中繼標籤)以控制結構。若未使用 metatags,Suno 會根據換行與內容模式推斷歌曲結構。
基本歌詞(無 metatags):
Walking down the empty road Headlights fading in the rain Every mile feels like a year But I keep driving through the pain
Copy
含 metatags 的歌詞(建議):
[Verse 1] Walking down the empty road Headlights fading in the rain [Chorus] Keep driving, keep driving Through the storm and through the night [Verse 2] Every mile feels like a year But the horizon's getting bright [Chorus] Keep driving, keep driving Through the storm and through the night [Outro] And the sun comes up again
Copy
務必使用 metatags。 若未使用,Suno 會自行決定歌曲結構,結果可能不符合您的意圖。[Chorus] 標籤可確保段落重複並凸顯旋律,[Bridge] 標籤則表示和聲將出現變化。這些結構提示能大幅提升輸出的一致性。
網頁版 Lyrics Editor(2026年7月)
2026年7月,Suno 重新設計了網頁版歌詞創作流程,核心是一套專用的 Lyrics Editor。40 以下5項新增功能與本指南的工作流程密切相關:
- Lyricist:可儲存並固定個人寫作風格的設定檔,讓後續的歌詞創作維持一致語調,不必每次都重新採用 Suno 的預設語體。
- 自然語言編輯:輸入「make this line funnier」之類的指示,編輯器便會直接在原處套用修改,無須再手動改寫與貼上。
- 押韻與替代表達建議:選取單字或句子,即可取得相應的押韻選項與替代措辭。
- 歌曲結構標籤:將段落標示為 Verse、Chorus 或 Outro,藉此告訴模型歌曲應如何推進。這些標籤是編輯器中的點選式操作介面,功能與上述純文字歌詞表中的方括號 metatags 相同。若要瞭解兩種介面之間的關係,請參閱 Suno 標籤與 Meta Tags。
- 具備自動儲存功能的無干擾全螢幕編輯器:提供全螢幕寫作模式,並在輸入時自動儲存內容。
編輯器改變的是歌詞表的製作方式,而非模型所接受的內容格式。像上述範例一樣完整標記的純文字歌詞表,仍可直接貼入 Lyrics 欄位,運作方式與以往完全相同。
Title 欄位
Title 欄位用於命名生成內容。它對音樂輸出的影響微乎其微,但會顯示在中繼資料與 Suno 的音樂庫中。為便於自行整理,建議採用具描述性的名稱。
提示詞強化輔助工具
Prompt Enhancement Helper 是在 V4.5 推出的 AI 輔助功能,會在生成前改寫 Style 欄位中的提示詞。啟用後,Suno 會將描述詞擴充為更詳盡的提示詞,讓模型能更精準地解讀。14
運作方式
- 您撰寫 Style 提示詞:indie rock, energetic
- Helper 將其擴充為類似以下內容:Energetic indie rock, driving electric guitars, punchy drums, dynamic bass, bright and raw production, anthemic and youthful
- Suno 會依據擴充後的提示詞生成,而非原始提示詞
適用時機
| 情境 | 是否使用 Helper? | 原因 |
|---|---|---|
| 簡短、模糊的提示詞 | 是 | Helper 會補充您未提供的具體細節 |
| 探索新的曲風 | 是 | 呈現您可能尚不熟悉的描述詞 |
| 精準、詳盡的提示詞(5個以上描述詞) | 否 | Helper 可能會改寫或淡化您的原始意圖 |
| 重複使用經過驗證的 Style 提示詞 | 否 | 此時需要的是一致性,而非重新詮釋 |
重要行為
- Helper 具有非確定性:即使輸入相同,每次的改寫結果也會不同
- 生成後可以檢視擴充後的提示詞,瞭解 Suno 認為哪些描述詞有幫助
- 擴充後的提示詞是良好的學習工具:先使用 Helper 生成一次並閱讀擴充內容,再於日後不使用 Helper 的情況下,直接將這些描述詞加入提示詞
- 若是需要精確控制 Suno 接收內容的正式製作工作,請停用此功能
請將 Helper 用於學習,而非依賴它。 從擴充內容中擷取實用的描述詞,納入自己的詞彙庫,再自行撰寫精準的提示詞。完全掌控提示詞,才能獲得最佳成果。
曲風與風格描述詞
Suno能辨識數百種曲風與風格詞彙。研究顯示,AI音樂模型訓練資料約86%來自全球北方曲風;吉他、鋼琴、鼓等樂器占訓練片段的52–67%,而區域性樂器不到3%。21因此,曲風準確度會直接受到具體程度與文化來源影響。
高信心曲風(結果穩定)
這些曲風在訓練資料中具備良好代表性,因此能產生可靠且準確的輸出:
| 曲風 | 有效描述詞 | 備註 |
|---|---|---|
| Pop | pop, synth-pop, indie pop, dream pop, electropop | Suno最強的曲風。若未指定,預設行為傾向產生pop。 |
| Rock | rock, indie rock, alt-rock, classic rock, punk rock, post-punk | 樂器分離良好。吉他音色相當可信。 |
| Hip-Hop/Rap | hip-hop, trap, boom bap, lo-fi hip-hop, conscious rap | Rap人聲在V5表現良好。Flow與唱法可透過歌詞格式控制。 |
| Electronic/EDM | EDM, house, techno, trance, drum and bass, dubstep | 擅長build-drop結構。合成器音色變化豐富。 |
| R&B/Soul | R&B, neo-soul, contemporary R&B, motown | 人聲質感滑順。擅長groove導向的編曲。 |
| Country | country, country rock, outlaw country, bluegrass | 原聲樂器呈現良好。Pedal steel與banjo辨識度高。 |
| Folk | folk, indie folk, folk rock, Americana | 著重原聲質感。人聲風格自然。 |
| Jazz | jazz, smooth jazz, jazz fusion, bebop, swing | 在V5中顯著改善。和聲複雜度明顯優於V4。 |
中信心曲風(可用,但需要引導)
| 曲風 | 有效描述詞 | 備註 |
|---|---|---|
| Metal | metal, heavy metal, death metal, black metal, metalcore | 失真吉他音色表現良好。極端人聲(growls、screams)結果時好時壞。 |
| Classical | classical, orchestral, chamber music, symphony | 擅長基本管弦編曲。複雜對位較弱。 |
| Latin | reggaeton, salsa, bossa nova, cumbia, bachata | 節奏型態通常準確。樂器具體度則不一。 |
| Afrobeats | afrobeats, afropop, highlife | 持續改善中。V5的節奏準確度優於V4。 |
| K-Pop/J-Pop | K-pop, J-pop, city pop | 製作風格容易辨識。除非歌詞另有指定,否則人聲語言可能預設為英文。 |
低信心曲風(需要反覆迭代)
| 曲風 | 有效描述詞 | 備註 |
|---|---|---|
| Microtonal/Avant-garde | avant-garde, experimental, noise | 不可預測。結果有創意,但很少精準符合意圖。 |
| Traditional/Folk(非西方) | gamelan, raga, Tuvan throat singing | 訓練資料有限。結果多為近似,而非真實重現。 |
| Sound design/SFX | ambient drone, soundscape | 交由Stable Audio處理較佳。Suno會優先針對歌曲結構最佳化。 |
人聲風格
人聲特質是Suno輸出中最容易控制的面向之一。V5大幅提升了人聲的自然度與表現力。
人聲描述詞
| 描述詞 | 效果 |
|---|---|
| 性別 | “male vocals”, “female vocals”, “androgynous vocals” |
| 音色 | “warm”, “bright”, “dark”, “rich”, “thin”, “breathy” |
| 技巧 | “raspy”, “smooth”, “vibrato”, “falsetto”, “belt”, “whisper” |
| 風格 | “soulful”, “punk”, “operatic”, “conversational”, “spoken word” |
| 處理 | “reverb-heavy”, “dry vocals”, “auto-tuned”, “distorted”, “lo-fi” |
| 和聲 | “harmonized”, “choir”, “backing vocals”, “vocal layering” |
組合人聲描述詞
堆疊2–3個人聲描述詞,以取得更精準的控制:
Raspy male vocals with subtle vibrato, lo-fi warmth
Copy
Ethereal female vocals, breathy and reverb-heavy, choir harmonies
Copy
Deep baritone, smooth jazz delivery, minimal processing
Copy
語言與多語人聲
Suno V5支援多語人聲生成。模型會從歌詞推斷語言。若使用非英文歌詞:
- 在Lyrics欄位以目標語言撰寫歌詞
- 也可選擇在Style欄位加入語言:”Japanese city pop, female vocals”
- 英文、西班牙文、葡萄牙文、法文、日文、韓文與中文通常效果最佳
- 訓練資料較少的語言,可能出現口音或發音不夠精準的情況
Instrumental Mode
在Custom Mode中切換Instrumental,即可生成沒有人聲的曲目。此時Style欄位會成為唯一的創意輸入。
何時應使用instrumental mode?
- 背景音樂:Podcast片頭、影片配樂、環境型工作音樂
- 製作元素:Beat beds、和弦進行、氛圍質地
- 曲風探索:測試曲風描述詞,避免人聲品質成為變因
- DAW整合:為現場人聲錄製生成伴奏軌
Instrumental prompt模式
沒有人聲時,Style欄位需要更多描述細節來補足資訊:
Cinematic orchestral score, sweeping strings, French horns, timpani rolls, epic and triumphant, Hans Zimmer inspired
Copy
Lo-fi hip-hop beat, jazzy piano chords, vinyl crackle, mellow drums, study music
Copy
Ambient electronic, pad textures, slow evolving synths, ethereal and spacious, Brian Eno inspired
Copy
提示:即使在instrumental mode中,也建議在Lyrics欄位加入[Instrumental]或[Instrumental Break]metatags,以強化意圖並控制編曲結構。
Suno 標籤與中繼標籤
Suno 的標籤(在多數 Suno 文件中寫作「metatags」,在多數搜尋查詢中則寫作「meta tags」;兩者可交替使用)是其結構控制語言。將標籤置於 Lyrics 欄位的方括號內,即可引導編曲、配器、動態與人聲表現。中繼標籤(metatags)讓 Suno 從提示詞生成歌曲的玩具,搖身一變成為作曲工具。10
Suno 有兩套標籤系統,分別用於兩個不同欄位:
- 中繼標籤應放在 Lyrics 欄位的方括號內:[Verse]、[Chorus]、[Guitar Solo]、[Fade Out]。這些標籤控制歌曲結構與各段落的表現。本節及接下來的三節提供完整參考資料。
- 風格標籤應以不含方括號的純文字描述詞放在 Style 欄位中,包括曲風、速度、配器、人聲質感、製作方式與情緒。這些標籤控制整體音樂特質。完整的風格詞彙請參閱提示詞架構與曲風和風格描述詞。
Suno 標籤速覽
將以下任一內容複製貼到 Lyrics 欄位:
| 類別 | 常用標籤 | 複製貼上範例 |
|---|---|---|
| 結構 | [Intro]、[Verse 1]、[Pre-Chorus]、[Chorus]、[Bridge]、[Outro]、[End] | 在副歌主旋律歌詞前單獨放一行 [Chorus] |
| 器樂 | [Instrumental]、[Instrumental Break]、[Guitar Solo]、[Piano Solo]、[Synth Solo] | 在第2段主歌與橋段之間加入 [Instrumental Break] |
| 人聲 | [Male Vocal]、[Female Vocal]、[Choir]、[Harmony]、[Rap]、[Whisper]、[Spoken Word] | 在安靜、親密的歌詞前加入 [Whisper] |
| 動態與製作 | [Fade In]、[Fade Out]、[Crescendo]、[Silence]、[Key Change]、[Tempo: slow] | 將 [Fade Out] 作為尾奏的最後一行 |
| 參數化 | [Verse: whispered vocals, acoustic guitar only]、[Chorus: full band, soaring vocals] | 在任何結構標籤內加入 : descriptors,即可分段控制 |
接下來三節提供完整表格:結構標籤收錄所有段落標籤,器樂與人聲標籤說明樂器及人聲控制,而進階中繼標籤模式則涵蓋參數化標籤與動態控制。
複製貼上入門範例:完整標記的歌詞表
[Intro: sparse, atmospheric] [Verse 1] Your first verse lyrics here [Chorus] Your hook lyrics here [Verse 2] Your second verse lyrics here [Chorus] Your hook lyrics here (same text encourages melodic repetition) [Bridge: stripped down, different energy] Your contrast lyrics here [Chorus] Your hook lyrics here [Outro: fade out] [End]
Copy
是否有 [no vocals] 標籤?
Suno 並沒有專用的 [no vocals] 中繼標籤,而在 Style 欄位中填寫「no vocals」也不可靠(其中的否定指令往往會被忽略)。若要穩定產生沒有人聲的曲目,請搭配使用以下設定:
- 在 Custom Mode 中開啟 Instrumental
- 在 Lyrics 欄位加入 [Instrumental](若只要讓含人聲歌曲中的某個段落沒有人聲,則使用 [Instrumental Break])
- 在 Advanced Options 下的官方 Exclude 欄位中填入 vocals
適用於無人聲歌曲的提示詞模式,請參閱器樂模式。
中繼標籤的運作方式
中繼標籤會被視為編曲指令,而非歌詞。Suno 遇到 [Chorus] 時,會: 1. 在編曲中標示段落轉換 2. 套用典型的副歌特徵(強調旋律、更豐富的配器、更高的能量) 3. 若相同的 [Chorus] 文字再次出現,嘗試重複其旋律與編曲
中繼標籤不區分大小寫:[VERSE]、[Verse] 與 [verse] 效果相同。
為何中繼標籤比提示詞文字更重要:若未使用中繼標籤,Suno 會根據換行位置與歌詞內容推斷歌曲結構。模型會依照訓練資料中的模式,猜測主歌在何處結束、副歌又從何處開始。中繼標籤能免除這種猜測。與其寄望 Suno 自行辨識副歌,不如使用 [Chorus] 明確觸發符合副歌特性的音樂表現,包括旋律主旋律、更豐富的配器、更高的能量,以及後續再次出現時的重複效果。這些影響會在整首歌曲中逐步累積。一首未使用中繼標籤的3分鐘曲目,可能有6至8個結構決策由 Suno 推斷;使用中繼標籤後,這6至8個結構決策將由您掌控。
V5.5 中的標籤行為
截至 V5.5,中繼標籤詞彙並未改變:2026年3月的版本新增了 Voices、Custom Models 與 My Taste,但沒有加入新標籤,也未改變標籤的處理方式。以下是 V5.5 時期值得掌握的4項細節:
- 應優先使用 Exclude 欄位,而非否定標籤。Style 欄位中的否定指令(如「no drums」)並不可靠;若要排除不需要的樂器與元素,Advanced Options 下的 Exclude 欄位才是官方控制方式。
- 網頁版 Lyrics Editor 中的結構標籤,是以不同介面呈現的相同控制功能。2026年7月推出的 Lyrics Editor,讓您可透過使用者介面將段落標記為 Verse、Chorus 或 Outro,藉此告訴模型曲目應如何推進。這與純文字歌詞表中的 [Verse]/[Chorus]/[Outro] 方括號標籤功能相同。在編輯器中撰寫歌詞時可使用標籤;若是在 Suno 外部準備歌詞表再貼入,則使用方括號標籤。標籤詞彙本身並未改變。40
- My Taste 不會覆寫您的標籤。提示詞資訊不足時,My Taste 會影響預設傾向;不過,Style 欄位中的明確描述詞仍會覆寫其偏好,而 Lyrics 欄位中的中繼標籤仍負責設定結構。魔法棒圖示(Style Augmentation)產生的是個人化風格文字,而非結構標籤。
- 拍號屬於編輯介面設定,而非生成標籤。Studio 的格線與節拍器支援3/4、6/8及不規則拍號,但這項設定本身不會影響生成模型。
結構標籤
這些標籤定義歌曲段落並控制編曲流程。
主要結構標籤
| 標籤 | 用途 | 音樂效果 |
|---|---|---|
| [Intro] | 開場段落 | 通常為器樂演奏或簡約編制,用於奠定基調 |
| [Verse] 或 [Verse 1] | 主歌段落 | 能量適中、著重敘事,旋律富於變化 |
| [Pre-Chorus] | 銜接至副歌 | 能量逐步升高,和聲具有過渡作用 |
| [Chorus] | 主旋律/疊句 | 能量達到高峰、旋律令人難忘、配器完整 |
| [Post-Chorus] | 副歌後段 | 維持能量,接著逐步回落並轉場 |
| [Bridge] | 對比段落 | 採用不同和弦與能量,增添變化 |
| [Breakdown] | 精簡編制段落 | 減少配器,營造留白空間 |
| [Build] 或 [Build-Up] | 能量漸升 | 強度逐步提升,常見於 EDM |
| [Drop] | 高能量釋放段落 | 配器與能量達到最大值,接續在漸強段落之後 |
| [Hook] | 朗朗上口的樂句 | 簡短、令人難忘的音樂樂句 |
| [Interlude] | 器樂間奏 | 連接不同段落,轉換聽覺感受 |
| [Outro] | 結尾段落 | 能量逐步收束,為歌曲畫下句點 |
| [End] | 直接結束 | 表示歌曲應在此結束(避免出現拖尾音訊) |
編號段落
使用數字區分重複出現的同類段落:
[Verse 1] First verse lyrics here [Chorus] Chorus lyrics [Verse 2] Second verse with different lyrics [Chorus] Same chorus lyrics (encourages melodic repetition)
Copy
為主歌編號有助於 Suno 理解每段主歌應使用不同旋律,而各段副歌則應重複相同旋律。
器樂與人聲標籤
這些標籤控制各段落內的配器與人聲表現。
器樂標籤
| 標籤 | 效果 |
|---|---|
| [Instrumental] | 沒有人聲的段落 |
| [Instrumental Intro] | 器樂開場 |
| [Instrumental Break] | 歌曲中段的器樂段落 |
| [Guitar Solo] | 以吉他為主的器樂樂段 |
| [Piano Solo] | 以鋼琴為主的樂段 |
| [Drum Solo] | 以打擊樂器為主的樂段 |
| [Bass Solo] | 以貝斯為主的樂段 |
| [Saxophone Solo] | 以薩克斯風為主的樂段 |
| [Strings Rise] | 弦樂聲部逐漸增強 |
| [Percussion Break] | 以節奏為主的精簡編制樂段 |
| [Synth Solo] | 合成器主奏樂段 |
人聲標籤
| 標籤 | 效果 |
|---|---|
| [Male Vocal] | 切換為男性人聲 |
| [Female Vocal] | 切換為女性人聲 |
| [Duet] | 兩個人聲聲部 |
| [Choir] | 合唱人聲 |
| [Harmony] | 人聲和聲 |
| [Rap] | 饒舌唱法 |
| [Spoken Word] | 口白演繹,不演唱 |
| [Whisper] | 耳語式演繹 |
| [Scream] | 嘶吼/吶喊式演繹(金屬、龐克) |
| [Ad-lib] | 即興人聲樂句 |
| [Humming] | 哼唱旋律 |
| [Backing Vocals] | 背景人聲聲部 |
進階中繼標籤模式
參數化中繼標籤
中繼標籤(metatags)可在冒號後接受描述性修飾詞:
[Verse: whispered vocals, acoustic guitar only] Walking through the morning mist The world still sleeping, still [Chorus: full band, powerful vocals] But I'm awake, I'm alive And every sound is a sign
Copy
冒號語法可讓您修改個別段落,而不必變更全域 Style 欄位。參數化中繼標籤是最強大的中繼標籤功能,可逐段控制編曲。
動態與製作中繼標籤
| 標籤 | 效果 |
|---|---|
| [Fade In] | 音量逐漸增強 |
| [Fade Out] | 音量逐漸降低 |
| [Silence] | 音訊短暫停頓 |
| [Crescendo] | 強度逐步提升 |
| [Decrescendo] | 強度逐步降低 |
| [Tempo: slow] | 段落層級的速度變化 |
| [Key Change] | 和聲轉調 |
結合結構與修飾標籤
[Intro: ambient pads, reversed guitar, ethereal] [Verse 1: lo-fi drums, muted bass, whispered vocals] Words that float on morning air Disappearing into light [Pre-Chorus: building energy, adding layers] But something shifts beneath the surface [Chorus: full production, soaring vocals, epic drums] We break through the silence Into the wide open sky [Bridge: stripped down, piano only, vulnerable vocals] And in the quiet after the storm [Outro: fade out, ambient reprise]
Copy
如此一來,單憑文字即可達成 DAW 等級的編曲控制。
Creative Sliders
Creative Sliders 是 V4.5+ 的控制項,可塑造生成內容的風格特質。這些控制項會顯示在 Custom Mode 的 Lyrics 欄位下方。11
為何滑桿與文字提示並存:文字提示會定義要生成「什麼」(曲風、樂器、情緒),滑桿則控制模型「如何」解讀這些提示。使用低 Weirdness 時,「jazz」提示會產生傳統的爵士標準曲;相同提示搭配高 Weirdness,則會產生打破自身慣例的爵士樂。提示定義詞彙,滑桿則定義文法。
Weirdness
範圍:Safe ← → Chaos(滑桿,不顯示數值)
| 位置 | 效果 |
|---|---|
| Safe(左側) | 傳統結構、可預期地遵循曲風,以及穩妥的旋律選擇 |
| 中央(預設,約 50%) | 取得平衡。在曲風慣例內加入一些創意驚喜 |
| Chaos(右側) | 非傳統結構、出乎意料的和聲選擇,以及跨曲風創作。不連貫的風險較高 |
Weirdness 的實際運作方式:在低設定值下,Suno 會於每個步驟選擇機率最高的下一個音樂事件,因而產生較傳統的結果;在高設定值下,機率較低的事件會更常出現,形成出人意表的組合。Suno 並未說明具體機制,但可以觀察到其取捨核心在於連貫性:較安全的設定聽起來更精緻,而較奇特的設定則更具創意,卻可能較不連貫。
適合提高 Weirdness 的情況: - 實驗或前衛曲風 - 傳統結果顯得平庸時 - 進行曲風融合實驗時
適合降低 Weirdness 的情況: - 需要聽起來「正常」的商業音樂 - 必須嚴格遵循曲風慣例時 - 不應喧賓奪主的背景/氛圍音樂
Style Influence
範圍:Loose ← → Strong(滑桿)
| 位置 | 效果 |
|---|---|
| Loose(左側) | 曲風描述僅是建議,而非硬性要求。Suno 擁有更大的創作自由 |
| 中央(預設) | 適度遵循曲風描述 |
| Strong(右側) | 嚴格遵循曲風描述,減少創意偏離 |
當 Style 欄位內容精確,而且希望成果完全符合描述時,請使用 Strong。若希望 Suno 更自由地詮釋提示,並可能帶來意外驚喜,請使用 Loose。
Audio Influence
範圍:控制任何上傳音訊參考對生成結果的影響程度。
使用 Audio Upload(Covers、Remixes 或 Add Vocals/Instrumentals)時即可調整。設定值越高,輸出就越貼近參考音訊的特徵。
Song Editor
Song Editor 可在生成後進行編輯,無須重新建立整首歌曲。它解決了「已有 90% 完美,卻有一個段落不對」的難題。12
可用操作
| 操作 | 功能 | 適用時機 |
|---|---|---|
| Inpainting | 以新內容取代特定時間範圍 | 主歌表現薄弱,但副歌十分完美 |
| Extend | 從目前結尾繼續延伸歌曲 | 歌曲結束得太早,或需要增加段落 |
| Crop | 將歌曲裁短 | 移除結尾靜音或不需要的段落 |
| Fade In/Out | 在開頭/結尾套用漸進式音量變化 | 為前奏/尾奏增添專業質感 |
| Replace Section | 依照新指示重新生成段落 | 橋段在調性上不協調 |
Inpainting 工作流程
- 選取要替換的時間範圍(在波形上拖曳)
- 視需要為替換段落提供新的歌詞/中繼標籤
- 生成:Suno 會建立與前後音訊相符的新內容
- 聆聽並比較。接受結果或重新生成。
Inpainting 是反覆調整的過程。第一次替換很少能與前後內容完美銜接。建議預留 2–5 次嘗試,以獲得流暢的過渡效果。
Extend 工作流程
- 在任何現有生成內容上按一下 Extend
- 視需要為延續內容提供歌詞/中繼標籤
- Suno 會生成約 30–60 秒的新音訊,從原本的結尾繼續延伸
- 每次延伸都是一次獨立生成(會消耗點數)
最佳做法:在延伸提示的開頭加入結構中繼標籤(例如 [Chorus] 或 [Outro]),藉此引導延伸內容的生成方向。
Covers 與 Remixes
Pro 和 Premier 方案可為現有 Suno 曲目建立 Covers 與 Remixes。
Covers
上傳或選取現有 Suno 曲目作為參考,接著套用新的曲風:
Style: Acoustic folk cover, fingerpicked guitar, soft female vocals, intimate production
Copy
Cover 會保留旋律與歌詞,同時重新詮釋編曲與製作。
Remixes
相較於 Covers,Remixes 會更大幅度地重製現有曲目:
Style: EDM remix, heavy bass, 128 BPM, drop-focused, festival energy
Copy
Add Vocals / Add Instrumentals
兩種可疊加至現有音訊的專門模式:
- Add Vocals:上傳純演奏曲目,由 Suno 在其上生成歌聲
- Add Instrumentals:上傳人聲曲目,由 Suno 為其生成伴奏
這兩種模式都能將 Suno 融入傳統製作流程:錄製真人歌聲,再讓 Suno 生成伴奏;或反向操作。
Voices
Voices系統(Pro/Premier,v5.5)讓您能在多次生成中建立並重複使用一致的聲音角色。不必期待每次生成都分配到相似的聲音,而是先定義一個聲音,再加以引用。Voices延續早期Personas功能;Suno目前的說明中心指出,Create選單現在使用Voices,而Style Personas仍位於Voices選單內。1531
建立Persona Voice
- 生成一首您喜歡其人聲的歌曲
- 在該次生成結果上點選三點選單,並選擇「Create Persona」
- 以具描述性的名稱命名該persona(例如:「Warm Alto Folk」、「Raspy Baritone Rock」、「Ethereal Soprano」)
- 該persona會儲存到您的帳號資料庫
建立有效persona的技巧: - 請專門為persona生成歌曲,而不是把它當成另一首歌的副產物。使用清楚、符合曲風且人聲突出的Style prompt。 - 避免從人聲處理很重的歌曲建立persona(例如auto-tune、distortion)。persona會捕捉處理後的聲音,而不是底層原始聲線。 - 建立特定曲風的persona,而不是一個「通用」聲音。以indie folk曲目訓練出的persona,用在trap beat上會產生難以預測的結果。
使用Persona Voices
在Custom Mode中,生成前從Persona下拉選單選取已儲存的persona。除非變更設定,該persona會套用到該工作階段中的所有生成。
Persona行為: - persona會保留音色(人聲聲調、共鳴)與基本演唱風格(氣聲、沙啞、順滑) - 它不會保留精確的旋律模式、樂句處理或節奏詮釋。這些由Style prompt與metatags決定 - 將persona套用到不同速度與調性通常效果良好。若跨越差異極大的曲風(例如把jazz persona用在death metal),結果會不穩定。
Persona管理
- 儲存上限:Suno允許儲存多個personas(確切上限未公開記載,但使用者回報儲存20個以上也沒有問題)
- 命名慣例:使用包含人聲特質與曲風脈絡的描述性名稱。否則您很快就會忘記「Voice 3」是哪一個
- 刪除:可以從資料庫刪除personas。刪除後無法復原。
- 帳號限定:personas無法在帳號之間共享或匯出
限制
- Persona Voices捕捉的是音色與基本演唱風格,不是精確的人聲技巧
- 將persona套用到遠離原始曲風的情境時,結果會有所差異
- Persona Voices限定於帳號內使用,無法共享
- 2025年12月更新提升了persona在多次生成間的一致性,但仍不保證能完美重現15
Voice Cloning(V5.5)
V5.5推出Voices,讓Pro與Premier訂閱者可以複製自己的聲音並用於生成。3031不同於Persona Voices(從生成歌曲中擷取音色),經驗證的Voice會捕捉真實人類聲音的特徵。
運作方式:
- 錄製或上傳一段人聲樣本
- 完成驗證流程,系統會將一段朗讀短語與您上傳或即時擷取的人聲樣本進行比對
- 複製出的聲音會成為Custom Mode中可選取的voice
與Persona Voices的主要差異:
| 面向 | Persona Voices | Voice Cloning |
|---|---|---|
| 來源 | 生成的Suno歌曲 | 真實人類聲音錄音 |
| 驗證 | 無 | 需要身分驗證 |
| 擬真度 | 捕捉音色與基本演唱方式 | 對來源聲音有更高擬真度的重現 |
| 可用性 | Pro/Premier | 僅限Pro/Premier、v5.5;受年齡/地區限制 |
驗證與分享:Suno要求驗證,以防止未經授權複製他人的聲音。您必須確認自己是該聲音的擁有者,或已取得明確使用許可。只有您能使用自己的Voice創作,但若您發布或分享含有該Voice的歌曲,並在發布選項中允許remixing,其他使用者就可以cover或remix該歌曲。31
Custom Models(V5.5)
Custom Models讓Pro與Premier訂閱者能依自己的特定音樂風格個人化V5.5。3031與其每次都從Suno的通用模型開始,Custom Model會依您的創作偏好進行調校。
Custom Models的運作方式:
- 上傳至少6首來自您作品目錄的歌曲,或在Suno以外製作、能代表目標風格的曲目
- 讓訓練素材在風格上保持一致。在同一個模型中混入隨機曲風會讓學習變得雜亂;專注在單一路線(例如full orchestral、future bass、indie folk)能讓模型方向更清楚
- 命名Custom Model,Suno會根據這些選擇訓練一個個人化版本的V5.5
- 將Custom Model用於之後的生成,讓作品承襲您的風格指紋
限制:每位Pro或Premier訂閱者最多可建立3個Custom Models。這可用來為不同專案或曲風維持獨立模型(例如一個用於indie folk、一個用於electronic、一個用於hip-hop)。
Custom Models捕捉的內容:從您選定的訓練歌曲中捕捉曲風傾向、編曲模式、製作美學與風格偏好。它們不會記憶或重現訓練素材中的特定旋律或歌詞。
My Taste(V5.5)
My Taste是V5.5功能,所有使用者皆可使用(包含免費方案),會隨時間將Suno的生成行為調整為更貼近個人偏好。3031
運作方式:隨著您生成、按讚並與歌曲互動,Suno會建立偏好設定檔。My Taste預設啟用,但可從avatar選單檢視、編輯或停用。Styles框右上角的magic wand圖示是主要觸發點:啟用Style Augmentation時,它會生成一段符合您taste profile的style文字。31My Taste會影響生成預設值,並對您一貫偏好的曲風、製作風格、人聲特質與結構模式產生細微偏向。
My Taste會影響的項目: - prompt描述不足時的預設曲風與風格傾向 - 製作美學偏好(lo-fi相對於polished、sparse相對於dense) - 人聲風格偏向 - 編曲與結構模式
My Taste不會取代的項目: - 明確的Style欄位描述仍會覆蓋My Taste偏好 - Creative Sliders仍會獨立運作 - Persona Voices與Voice Cloning不受影響
實務意義:My Taste降低了新使用者容易得到泛泛結果的「cold start」問題。隨著時間推移,即使只是「upbeat rock song」這樣簡單的prompt,也會根據您的生成紀錄,產生更貼近您偏好之特定rock風味的結果。
生成迴圈
有效使用Suno時,應採用反覆迭代的工作流程,而不是只靠單一提示詞。
製作週期
1. IDEATION ↓ Generate 5-10 variations with different Style descriptors ↓ (Cost: ~25-50 credits) 2. SELECTION ↓ Pick the 1-2 best results ↓ Identify what works and what doesn't 3. REFINEMENT ↓ Adjust Style descriptors based on what you heard ↓ Refine lyrics and metatags ↓ Regenerate with tighter prompts ↓ (Cost: ~15-30 credits per round) 4. EXTENSION ↓ Extend the best track to full length ↓ Add missing sections (bridge, outro) ↓ (Cost: ~5-15 credits) 5. EDITING ↓ Use Song Editor to fix weak sections ↓ Inpaint, crop, fade as needed ↓ (Cost: ~5-20 credits) 6. EXPORT ↓ Download final audio (MP3/WAV) ↓ Optionally export stems for DAW work
Copy
完成一首精修曲目的典型成本:50–100 credits(約10–20首生成歌曲,通常是5–10批每批2首的Create,再加上編輯)。
實作範例:從概念到匯出一首歌
以下是一首單曲完整的製作週期,展示每個階段實際使用的提示詞與決策:
1. 概念:「一首關於失眠、情緒陰鬱的indie folk歌曲。」
2. 第一批Create(10 credits,2個變體):
Style: Indie folk, slow tempo, acoustic guitar fingerpicking, soft female vocals, intimate lo-fi recording, melancholic Lyrics: [Verse 1] The ceiling holds no answers Just shadows and the clock Every hour stretches longer When the world has gone to dark [Chorus] Sleep won't come, sleep won't come I'm counting every sound [Verse 2] The neighbors' lights went out at ten The street grew still by twelve Now it's somewhere past forever And I'm talking to myself [Chorus] Sleep won't come, sleep won't come I'm counting every sound [Outro: fade out, humming]
Copy
3. 選擇:Variation B的聲音語氣正確,但副歌旋律對這個情緒來說太明亮。Variation A的副歌較好,但吉他音色偏薄。
4. 精修(10 credits):用調整後的Style重新生成:將「lo-fi recording」改為「warm analog recording」,並加入「sparse arrangement」。歌詞維持不變。新的Variation A保留第一輪的溫暖感,也有較克制的副歌。
5. 延伸(5 credits):歌曲在2:30結束。使用[Bridge: piano only, vulnerable vocals]+新歌詞+[Chorus]+[Outro: fade out, ambient reprise]延伸。橋段自然帶入鋼琴。
6. 編輯(10 credits):第2段主歌進副歌的轉場太突兀。使用Song Editor在該銜接處inpaint一段4秒區間。第二次inpainting嘗試後順利銜接。
7. 匯出:下載WAV,準備在Logic Pro中進行母帶處理。總成本:35 credits,約7次歌曲層級的生成或編輯。
關鍵觀察是:大多數credits花在前兩輪(找出正確聲音),而不是後三輪(精修一個好的take)。前期提高提示詞精準度,相較於使用模糊提示詞再反覆迭代的做法,至少省下30 credits。
節省credits的工作流程技巧
- 把時間花在提示詞,而不是生成次數。精心撰寫的Style+Lyrics提示詞,通常比用模糊提示詞快速迭代更能產生良好的初次結果。
- 批次生成。探索一個概念時,一次生成4–6個變體,再挑出最佳方向後進行精修。
- 優先使用Song Editor,而不是重新生成。如果一首歌有80%已經不錯,編輯剩下20%,不要整首重新生成。
- 保存成功的Style提示詞。某組描述詞組合效果良好時,請保存起來以便重複使用。
Suno Studio DAW
Suno Studio(Premier方案,隨V5推出)是一套瀏覽器內的數位音訊工作站,用於生成後編輯。它銜接了Suno的生成引擎與傳統音樂製作流程。2
Studio功能
| 功能 | 作用 |
|---|---|
| 多軌檢視 | 具備個別stem軌道的視覺化時間軸 |
| 混音控制 | 各stem的音量、pan、mute、solo |
| Warp markers | 對特定段落進行時間伸縮,而不影響音高 |
| Remove FX | 從stems移除殘響、delay與其他效果 |
| Alt takes | 生成特定段落的替代版本 |
| 拍號 | 調整或修正拍號判讀 |
| Stem隔離 | 存取最多12個個別stems,以進行細部混音 |
Studio 1.2(2026年2月)
最新的Studio更新加入了:25
- Warp markers with quantize:微調個別音符與樂句的時間,並以貼齊格線量化讓節奏對齊更緊密
- Remove FX:移除AI套用的殘響與delay,取得乾聲stems
- Alt takes:在同一介面中生成並試聽替代段落
- Studio網格中的拍號支援:3/4、6/8與不規則拍號可在網格與節拍器中使用,用於編輯與對齊。拍號尚未影響生成模型本身;該tag/進階設定影響的是編輯介面,而不是生成行為。4
Suno的Sounds(瀏覽並疊加預製音訊元素)是Create Mode中的另一項beta功能,不屬於Studio 1.2功能。Personas另有文件說明;兩者目前的介面,請以app內UI與官方help center為準。
WavTool收購
Suno於2025年6月收購WavTool;WavTool是一套瀏覽器型DAW,支援VST外掛、sample-accurate編輯與AI功能。27 WavTool核心團隊加入Suno,擔任產品與工程領導職務。這次收購也解釋了Studio功能快速發展的原因:Warp Markers、Remove FX與Sounds library,都反映出WavTool的專業DAW能力被整合進Suno以生成為優先的工作流程。執行長Mikey Shulman將此舉定位為用「放大人類創造力的工具」賦能音樂人。27
MILO-1080:AI Step Sequencer
2026年3月,Suno推出MILO-1080(Model-Integrated Loop Orchestrator),這是一套16軌step sequencer與合成器設計工具,面向有經驗的製作人與beatmakers。28 MILO-1080結合手動sequencing與AI生成聲音:
- 文字轉聲音生成:從文字提示詞建立samples
- Suno曲目庫:從先前生成的Suno曲目中擷取clips
- 內建合成引擎:不使用AI也能手動設計聲音
- MIDI支援:提供標準MIDI輸入/輸出,便於硬體整合
- 16軌:完整多軌sequencing,並具備逐軌控制
MILO-1080代表Suno正從文字轉音樂推進到完整創作平台。結合WavTool收購與Studio DAW,這顯示Suno鎖定的對象不只是休閒使用者,也包括專業製作人。
該使用Studio,還是匯出到DAW?
| 情境 | 使用Studio | 匯出到DAW |
|---|---|---|
| 快速修正(音量平衡、mute某個stem) | 是 | 否 |
| 完整專業混音與母帶處理 | 否 | 是 |
| 嘗試編曲變體 | 是 | 否 |
| 加入外部音訊(現場樂器、人聲) | 否 | 是 |
| 一般聆聽與分享 | 是 | 否 |
| 商業發行準備 | 視情況 | 是 |
Stem分離與匯出
Suno提供3種stem分離方法,並於2026年6月11日全面更新,輸出更乾淨、更清晰,且不易產生artifact:37
Split from Mix(2個stems,所有方案)
從mix中抽出任何單一樂器或聲音,並取得2個stems:目標樂器或聲音,以及其餘所有內容。這是舊版人聲對instrumental分離的泛化版本;目標不再必須是vocal。
適用於:卡拉OK版本、人聲取樣、隔離單一樂器、基本remixing。
Auto Split(12類,Pro/Premier)
Suno的經典模型,可將歌曲拆成最多12種stem類別:22 - Vocals、drums、bass、guitar、keys/piano、synths、strings、brass、woodwinds、percussion、effects、other
Advanced Split(Premier)
從近100種樂器清單中精確選擇要抽取的項目,產生一組依曲目調整的自訂stems。僅限Premier。37
一個重要差異:Suno的「stem separation」與iZotope RX或Demucs這類工具本質上不同。那些工具會分析已混音的音訊檔案,並事後嘗試隔離音源。Suno很可能是直接匯出個別生成層,因為所有音訊原本就是它建立的。因此結果更接近從DAW匯出submixes,而不是事後的音源分離。23 實務上,Suno stems比第三方分離工具在同一個混音檔上產出的結果更乾淨,但未必能與原始mix通過完美的null-test。
品質注意事項:stems之間可能仍會有一些bleed,尤其是頻率相近的樂器之間。V5中的分離品質已有顯著提升。若是針對任意音訊檔案(非Suno生成)進行專業工作,Demucs與iZotope RX這類專門工具仍是標準選擇。23
匯出格式
- MP3:標準壓縮音訊。適合分享、串流與草稿。
- WAV:未壓縮音訊。專業DAW工作與母帶處理必備。
DAW整合
Suno的輸出可透過stem匯出,整合進傳統音樂製作流程。
建議工作流程
- 在Suno中生成,直到編曲與氛圍到位
- 匯出12個stems(Pro/Premier)為WAV檔案
- 匯入您的DAW(Logic Pro、Ableton、Pro Tools、FL Studio、Reaper)
- 使用專業工具與處理流程進行混音與母帶處理
- 視需要替換或補強個別stems,例如加入現場錄音
DAW混音能帶來什麼
- EQ與壓縮:針對每個stem進行音色塑形,補足Suno的AI混音無法提供的控制
- 空間處理:精準的立體聲定位、混響發送、延遲點綴
- 自動化:隨時間產生動態變化(淡入堆疊、濾波掃頻)
- 外部樂器:將現場錄音與AI生成的stems疊合
- 母帶鏈:響度標準化、限制器處理,以及發行前的最終潤飾
- 自動化腳本:使用Claude Code建立prompt範本、批次處理Style欄位變化,或撰寫生成、挑選、精修迴圈的腳本
Genre Blending
Suno的獨特強項之一,是能在多種音樂類型的交會處生成作品;若以傳統製作方式完成,往往需要多位專精不同領域的音樂人。
有效的融合模式
雙類型融合(最可靠):
Jazz-funk fusion, slap bass, Rhodes piano, syncopated drums, groovy and sophisticated
Copy
類型+年代混搭:
80s synthwave meets modern trap, analog synths, 808 bass, retro-futuristic
Copy
類型+意外樂器:
Death metal with jazz saxophone solos, blast beats, dissonant chords
Copy
融合規則
- 以主要類型開頭。「Jazz with electronic elements」與「Electronic with jazz elements」會產生不同結果。
- 限制在2到3種類型。 超過這個範圍,Suno的輸出容易變成焦點分散的折衷結果。
- 使用年代標記錨定風格。「90s」或「2020s」能協助Suno選擇正確的製作慣例。
- 提高Weirdness以製作不尋常的融合。預設Weirdness設定會試圖把一切正常化,反而削弱Genre Blending的目的。
多段式作曲
若歌曲長度超過8分鐘,需要分多次生成並接合。
策略1:Extend
先生成第一段,接著使用Extend加入後續段落。每次延伸都會以前一段的結尾作為脈絡。
優點: 音樂連貫性佳。每次延伸都會自然承接前一段。 缺點: 對後段控制較少。多次延伸後可能出現音樂走向漂移。
策略2:逐段生成
使用特定的metatag+Style組合,獨立生成每個段落,再於DAW中接合。
優點: 可最大程度控制每個段落的性格。 缺點: 獨立生成段落之間的轉場可能聽起來突兀。需要DAW技巧來完成接合。
策略3:混合方法(建議)
- 將歌曲核心(verse-chorus-verse-chorus)作為一次生成完成
- 使用Extend製作bridge與最後一段chorus
- 使用Song Editor對任何薄弱轉場進行inpainting
- 匯出stems,並在DAW中完成最終處理
Prompt串接
透過一系列相互關聯的生成,建立複雜歌曲。
串接模式
Generation 1: "Atmospheric intro, ambient pads, slow build" → Extend with: "[Build-Up] [Drop: full energy, heavy drums]" → Extend with: "[Verse 1: vocals enter, riding the beat]" → Extend with: "[Chorus: anthemic, crowd-singing energy]" → Extend with: "[Outro: fade out, return to ambient pads]"
Copy
每次延伸都會繼承前一次生成的音樂DNA,因此能建立連貫的多段式作品,而不必每次都從零開始。
疑難排解
為什麼我的Suno歌曲聽起來不對?
| 問題 | 可能原因 | 解法 |
|---|---|---|
| 歌曲聽起來完全不像Style prompt | 描述詞互相競爭,或Weirdness太高 | 縮減為4到5個核心描述詞。降低Weirdness。 |
| 人聲聽起來像機器人 | 免費方案使用V4.5-All模型 | 升級至Pro以取得V5人聲品質。 |
| 歌曲突然結束 | 沒有[Outro]標籤 | 在歌詞中加入[Outro]或[End]。 |
| 歌曲在自然結尾後仍繼續播放 | Suno正在填滿最大長度 | 在最後段落後加入[End]標籤。 |
| 錯誤的類型成為主導 | 第二個列出的類型被降低優先順序 | 將主要類型放在Style欄位最前面。 |
| Metatags出現在歌詞中 | 標籤語法錯誤 | 檢查是否有拼字錯誤。標籤必須使用方括號,格式為[Tag]。 |
| 各段落人聲不一致 | 沒有設定Persona Voice | 使用Persona Voices維持跨生成的一致性。 |
| 延伸段落與原曲不匹配 | 原曲與延伸版本之間隔了太多次生成 | 從最新版本Extend,而不是從原始版本Extend。 |
| Instrumental曲目有人聲殘留 | Style描述詞暗示有人聲 | 明確切換Instrumental模式。加入[Instrumental]標籤。 |
生成品質檢查清單
在花費點數精修前,請確認prompt涵蓋:
- [ ] 類型夠具體(不是只寫「rock」,而是「indie rock」或「post-punk」)
- [ ] 人聲風格有描述(或已開啟Instrumental)
- [ ] Metatags定義結構(至少包含:Verse、Chorus、Outro)
- [ ] Style欄位有4到7個描述詞(不要太少,也不要太多)
- [ ] 情緒明確(若沒有指示,Suno預設傾向歡快、正向)