AI 圖像生成(Text-to-Image, TTI) 的應用中,提示詞(Prompt) 是決定生成結果的核心。不同模型(如 Stable Diffusion、MidJourney、DALL·E、Imagen、Runway)對提示詞解析方式略有不同,但基本技巧與語法原則是相通的。以下幫您整理成完整的技巧與語法指南:
一、提示詞的基本結構
通常一個提示詞(Prompt)可以拆解為以下結構:
- 主體(Subject):主要物件或場景,例如 “a cyberpunk city”
- 細節(Details):外觀、服飾、姿態、動作,例如 “with neon signs, rainy streets, people holding umbrellas”
- 風格(Style):藝術風格、攝影風格,例如 “in the style of Studio Ghibli, cinematic lighting”
- 技術參數(Modifiers):解析度、相機鏡頭、材質等,例如 “8k resolution, ultra detailed, wide angle lens”
- 負面提示(Negative prompt):排除不要的元素,例如 “no blur, no distortion, no extra fingers”
通用的提示詞結構:
- 具體性: 盡可能詳細地描述你想要的內容。例如,不要只說 "一朵花",而是 "一朵在陽光下盛開的紅色玫瑰,花瓣上還有露珠"。
- 關鍵詞: 使用描述性的關鍵詞來引導模型。例如,"寫實主義"、"印象派"、"賽博朋克"、"幻想" 等。
- 藝術家風格: 如果你喜歡某位藝術家的風格,可以將其納入提示詞中。例如,"文森特·梵谷風格的星空"。
- 光線和氛圍: 描述你想要的光線條件(例如,"日落餘暉"、"柔和的月光")和整體氛圍(例如,"神秘"、"寧靜"、"活潑")。
- 視角和構圖: 指定你想要的視角(例如,"特寫"、"廣角"、"鳥瞰")和構圖(例如,"黃金比例"、"對稱")。
- 負面提示詞(Negative Prompts): 告訴模型你不想要出現的內容。這對於避免常見的生成問題(如模糊、變形)非常有用。例如,"低解析度, 模糊, 畸形" 等。
- 權重調整: 某些模型允許你為提示詞中的不同部分設定權重,以強調某些元素。
二、語法技巧
1. 關鍵詞順序
- 模型通常會優先解讀前面的詞,因此最重要的描述詞應放在最前。
- 例如:
- "portrait of a woman, renaissance style, soft lighting"
- 比 "renaissance style, portrait of a woman" 更強調「肖像」主題。
2. 權重語法
不同模型支援不同的加權語法:
- Stable Diffusion:使用 (word:1.5) 增加權重,(word:0.5) 降低權重。
- MidJourney:使用 --iw 或重複單字提升影響,例如 “cat cat cat”。
- 常見寫法:
- (masterpiece:1.4), (detailed:1.2), (bad anatomy:0.2)
3. 風格混合
可以同時加入多種風格描述:
- "anime style + photorealistic + oil painting texture"
- 模型會嘗試融合,但比例不均衡時可透過權重控制。
4. 分隔符號
- 逗號 ,:分隔不同描述,最常用。
- AND / OR:部分模型支援語意邏輯。
- :::在 MidJourney 用來分隔並賦予不同元素比重,例如:
- "dog::2 cat::1" → 狗比貓更重要。
三、常見提示詞模組
1. 攝影類
- 相機參數:35mm lens, f1.8, bokeh, depth of field
- 拍攝角度:aerial view, close-up, wide shot
- 光線氛圍:cinematic lighting, golden hour, neon glow
2. 藝術類
- 風格:impressionism, surrealism, ukiyo-e, cyberpunk
- 藝術家:inspired by Van Gogh, by H.R. Giger
- 材質:oil painting, watercolor, digital art, voxel art
3. 建築/景觀
- futuristic skyscrapers, medieval castle, Japanese garden
- isometric view, blueprint style, voxel landscape
4. 人物/角色
- 外觀:silver hair, red eyes, cybernetic arm
- 服裝:samurai armor, business suit, spacesuit
- 表情與動作:smiling, running, meditating
四、負面提示(Negative Prompts)
在 Stable Diffusion 特別重要,用來避免瑕疵:
- "low quality, blurry, bad hands, extra limbs, watermark, text, distorted"
- 可以有效減少多手、多腳或變形。
五、進階技巧
- 多語言提示:英文效果最佳,但繁體中文/日文有時能生成更本土化的風格。
- 分層生成(Step by step prompting):先輸入簡單提示生成,再逐步添加細節優化。
- 圖生圖(Image-to-Image):搭配圖片與提示詞,可更精準控制風格與構圖。
- 種子控制(Seed):相同提示詞 + 相同種子 → 可重現結果。
- 搭配 LoRA / ControlNet:能強化特定人物、姿勢或結構的精準度。
✅ 提示詞範例
A portrait of a young woman, cyberpunk style, neon lights, rain-soaked street, cinematic lighting, ultra detailed, 8k, masterpiece, (by greg rutkowski:1.2), (sharp focus:1.3), Negative prompt: blurry, extra fingers, bad anatomy, lowres
