Seedance 2.0 提示詞攻略:2026 年最佳 Prompt、範本及實用技巧
徹底掌握 Seedance 2.0 提示詞技巧 — 由基本文字及圖片提示,到電影級首尾幀、參考圖轉影片及音訊驅動生成。內含實戰驗證嘅範本、各模式專用策略,以及適用於所有 Seedance 2.0 模式嘅可重用提示公式。
你上載咗一張參考圖去 Seedance 2.0,寫咗段睇落唔錯嘅文字提示,撳生成 — 結果出嚟一塌糊塗。主體變晒形、動作生硬唔自然、或者鏡頭做咗啲你從來冇叫佢做嘅嘢。
呢個係 2026 年對 AI 影片工具最常見嘅投訴,而問題幾乎一定出喺提示詞,唔係個模型本身。
Seedance 2.0 同純文字影片模型好唔同。因為佢同時接受圖片、影片、音訊同文字 — 仲要由呢啲輸入一齊生成影片 — 提示詞嘅角色經已變咗。你嘅文字提示唔再需要描述晒所有嘢;佢只需要描述其他輸入俾唔到嘅部分。輸出嘅質素完全取決於你幾理解呢個轉變,同埋識唔識得跟住寫。
呢份攻略嚟自喺 Seedance 2.0 每個模式測試過幾百段提示詞嘅經驗,俾你一套系統去做呢種溝通。你會學到經實戰驗證嘅提示詞範本、每個模式嘅專用策略,同一條無論你做邊種片都用到嘅可重用公式。到最後,你會清楚知道應該寫啲乜 — 同埋唔應該寫啲乜 — 先可以喺 Seedance 2.0 consistently 得到高質素結果。
點解 2026 年提示詞咁重要
AI 影片模型今年達到咗全新層次嘅質素。Seedance 2.0 可以生成 10 秒片段,動作流暢、角色一致、燈光充滿電影感 — 但前提係你嘅提示詞要準確話俾佢知做咩。2026 年,一個好提示詞同一個差提示詞嘅分別,就係一段用得嘅片同一段浪費咗生成配額嘅片之間嘅距離。
呢份攻略嘅技巧之所以有效,係因為佢哋配合 Seedance 2.0 實際處理提示詞嘅方式,而唔係舊模型嘅做法。明白呢個分別,係得到穩定結果嘅第一步。
Seedance 2.0 解讀提示詞嘅獨特方式
Seedance 2.0 處理提示詞嘅方式同純文字影片模型好唔同。因為佢接受多種輸入類型,文字提示嘅角色亦唔同咗:
| 輸入類型 | 生成中的角色 |
|---|---|
| 文字提示 | 控制動作、節奏、鏡頭及敘事意圖 |
| 圖片參考 | 鎖定視覺身份 — 主體、風格、構圖 |
| 影片參考 | 定義動作風格、編排、鏡頭移動 |
| 音訊輸入 | 驅動韻律、節奏同情緒配合 |
| 風格方向 | 全局美學 — 電影感、紀錄片、動畫 |
關鍵洞察: 喺 Seedance 2.0,你嘅文字提示應該專注於其他輸入俾唔到嘅嘢 — 動作、節奏同敘事流程。唔好浪費提示詞去描述你嘅參考圖已經顯示嘅內容。
一旦明白個模型點樣處理唔同輸入,下一條問題就係:為咗你嘅目標,應該用邊種輸入組合。
揀啱模式:快速決策框架
呢個係最常見嘅混淆點。用家未揀啱輸入模式就開始生成,然後奇怪點解結果同佢哋諗嘅唔同。
| 你嘅目標 | 用呢個模式 | 點解 |
|---|---|---|
| 由文字構思創造一條片 | 文字轉影片 | 唔需要參考;文字做晒所有嘢 |
| 將特定圖片做成動畫 | 圖片轉影片 | 圖片提供視覺基礎;提示詞加入動作 |
| 連接兩個關鍵幀 | 首/尾幀模式 | 模型喺你嘅開始同結束圖片之間插入動作 |
| 一致咁保持角色或風格 | 參考轉影片 | 綁定參考可以跨生成鎖定身份 |
| 將影片節奏同步到音樂或人聲 | 音訊驅動 | 音訊驅動節奏;提示詞定義你見到嘅嘢 |
如果你乜都冇得個概念,就由文字轉影片開始。如果你有特定角色或場景想整成動畫,就用圖片轉影片加一張好嘅參考圖。用錯起始模式會浪費頭幾次生成去摸索,而另一個模式本來就可以避開呢個問題。
揀好模式之後,下面嘅可重用提示公式幫你結構化文字提示,無論你用邊個模式都適用。
Seedance 2.0 提示公式
呢條公式適用於所有模式。填入適用嘅部分,唔適用嘅留空就得。
[模式背景] + [主體 + 動作] + [動作與節奏] + [鏡頭指引] + [風格與質素]
模式背景(1 句)
話俾模型知呢次係邊種生成類型。咁樣設定咗點樣解讀提示詞其餘部分嘅期望。
- 「電影級文字轉影片生成:」
- 「由靜態人像做圖片轉影片動畫:」
- 「由首幀到尾幀嘅過渡:」
- 「參考驅動嘅角色影片:」
主體 + 動作
畫面入面有咩,同埋佢做咩。維持一個清晰嘅動作就得。多個連續動作會混淆個模型。
好: 「一位芭蕾舞者喺昏暗舞台上做一個大字跳」
差: 「一位芭蕾舞者熱身,然後做一個旋轉,然後一個大字跳,然後鞠躬」
動作與節奏
啲嘢點樣移動,同埋咩速度。呢個係 Seedance 2.0 最重要嘅文字輸入。
有效嘅動作詞彙:
- 「緩慢而刻意嘅動作 — 每幀都有重量感」
- 「快節奏、動態移動 — 快速剪接配合韻律」
- 「逐漸揭示 — 主體喺 3 秒內由陰影中浮現」
- 「連續流暢動作 — 冇停頓、冇窒礙」
鏡頭指引
鏡頭喺邊同埋佢點樣移動。Seedance 2.0 對電影鏡頭語言反應好好。
例子:
- 「靜止廣角鏡,淺景深」
- 「5 秒內由中景緩慢推進到特寫」
- 「俯瞰吊臂鏡頭,下降到視線水平」
- 「手持寫實風格,輕微自然搖晃」
風格與質素
視覺美學同技術質素。參考某種電影風格、菲林質感或格式。
- 「35mm 菲林質感,自然顆粒,暖色調」
- 「乾淨數碼風格,銳利,商業產品燈光」
- 「紀錄片風格,現場光,真實色彩」
各模式專用提示範本
上面條公式可以適應每個生成模式。以下係應用方法:
文字轉影片範本
[模式背景] [主體] [喺] [環境] [做動作]。 [動作描述 — 速度、質素、方向]。 [鏡頭指引 — shot 類型、移動]。 [燈光]。 [時長 — 5 或 10 秒]。 [風格 + 質素]。實戰驗證例子: 「電影級文字轉影片:一位孤獨天文學家喺山上天文台透過巨型望遠鏡凝望。緩慢而沉思嘅動作 — 望遠鏡劃過天際,星光穿過圓頂開口移動。天文台內部靜止廣角鏡,溫暖嘅琥珀色儀器燈光襯托深藍夜色。10 秒。菲林質感,豐富陰影,24fps。」
圖片轉影片範本
由提供嘅圖片開始:[描述圖片睇唔到嘅動作]。 [鏡頭行為]。 [邊啲嘢保持靜止 vs 邊啲嘢移動]。 [時長 + 質素]。實戰驗證例子: 「由提供嘅人像開始:表情嘅微妙變化 — 眼尾微微起皺,嘴角醞釀一絲微笑。鏡頭保持靜止,淺景深保持面部銳利,背景則柔和模糊。面部同頭髮保持自然 — 唔 morph、唔變形。5 秒。電影級人像質素。」
首/尾幀範本
由[起始幀描述]過渡到[結束幀描述]。鏡頭[描述幀之間嘅鏡頭路徑]。動作係[速度 + 質素]。[必須保持一致嘅嘢]。[時長 + 質素]。實戰驗證例子: 「由主體喺懸崖邊日出時站立,過渡到主體沿懸崖小路遠離鏡頭行開。鏡頭喺過渡期間保持原位 — 唔 pan 唔 zoom。動作緩慢而刻意 — 5 秒由開始幀移到結束幀。主體身份同服裝保持完美一致。10 秒。電影感,全程黃金時段光線。」
參考轉影片範本
使用綁定參考:[主體參考]喺[環境參考]中[做動作],以[風格參考]風格呈現。[動作模式]。[鏡頭]。[質素]。實戰驗證例子: 「使用綁定參考:角色行過雨中文京區夜街,以黑色電影風格呈現。穩定嘅步行節奏 — 鏡頭以匹配速度橫向跟拍,淺景深保持角色銳利,對比柔和嘅霓虹散景。10 秒。變形鏡頭質感,高對比度,菲林顆粒。」
音訊驅動範本
影片同步到提供嘅音訊:[描述視覺內容]。動作跟隨[音訊特徵 — 節拍、節奏、情緒、高潮]。[配合音訊能量嘅鏡頭行為]。[風格]。實戰驗證例子: 「影片同步到提供嘅音訊:聲音嘅抽象視覺化 — 光嘅粒子隨節拍脈動流動。動作強度跟隨音訊動態 — 主歌部分平靜,副歌爆發時激烈。鏡頭漂浮穿過粒子場,隨節奏加速。10 秒。霓虹色調,電影級光芒。」
提示詞測試框架
寫好範本之後,喺用全質素渲染之前系統性噉測試提示詞。呢個低成本循環係建立 Seedance 2.0 技巧最重要嘅工具:
- 寫基線提示 — 用上面條公式或範本
- 以 5s 720p 生成 — 最平、最快
- 評三個維度: 動作質素(1–5)、主體準確度(1–5)、鏡頭執行(1–5)
- 只改最弱嘅維度 — 每次疊代只改一樣
- 重新生成再評分 — 確認改動提升咗分數
- 重複 直到三個維度都達到 4+
- 最終渲染 以目標解像度及時長
呢個框架將提示詞工程由靠估變成可量度嘅過程。提升結果最快嘅方法係認清你最弱嘅維度,然後喺下一次生成淨係 fix 嗰一樣。一次過改多樣嘢,你會冇可能知道邊個改動有用。
一旦掌握咗條公式同測試週期,以下係常見場景嘅即用提示詞。
按用途分類嘅最佳提示詞
產品展示
「電影級產品影片:一隻名貴手錶喺黑暗中浮現。慢速 360° 旋轉呈現每個細節 — 金屬錶帶捕捉逆光,水晶錶面反射柔和主光。微距鏡頭,極端特寫,畫面只有手錶。5 秒。商業產品攝影質素,全段銳利對焦。」
角色登場
「電影級角色登場:一位身穿長褸嘅神秘人物企喺雨中街燈下。人物慢慢抬頭望向燈光 — 鏡頭由廣角推入到中近景,需時 5 秒,逐步揭示面部細節。雨以慢動作落下,每滴雨珠捕捉琥珀色光芒。10 秒。黑色電影美學。」
風景/旅遊
「航拍建立鏡頭:一個海邊村莊喺黎明時分甦醒。鏡頭緩慢飛過陶瓦屋頂向港口 — 漁船輕柔搖晃,晨霧纏繞山巒,溫暖嘅金色光芒遍佈場景。流暢不間斷嘅航拍鏡頭。10 秒。自然紀錄片質素,色彩鮮豔而自然。」
動作場面
「動態動作:一位 parkour 運動員喺日落時份跑過天台。快速、充滿力量嘅動作 — 鏡頭由後方跟拍,然後轉到側面捕捉運動員跨越建築之間空隙嘅一刻。快速剪接同速度調整配合動作節奏。5 秒。高能量運動電影風格。」
專家級提示詞陷阱(同解決方法)
就算有齊好嘅範本,某啲模式 consistently 會導致失敗。呢啲唔係新手錯誤 — 係有經驗用家都會中嘅陷阱,而且佢哋會悄悄地搞垮你嘅生成。每個陷阱都跟同一結構:情景、根本原因、解決方案。
陷阱 1:描述圖片唔係描述動作
情景: 你上載咗一張參考圖,然後寫嘅文字提示描述嘅係圖片入面已經見到嘅嘢 — 主體嘅外貌、背景、燈光。
根本原因: 你當咗文字提示係影片嘅完整描述,但圖片已經提供咗大部分視覺資訊。文字提示應該描述圖片冇嘅嘢。
解決方法: 寫之前問自己:「我嘅參考材料仲有咩冇顯示?」淨係寫啲。
陷阱 2:模式背景寫得太長
情景: 你嘅模式背景寫咗三、四句,描述你想個模型逐步做啲乜。
根本原因: 你以為模式背景需要向模型解釋生成過程。實情係,模式背景係一個 flag,話俾模型知點樣解讀你嘅提示詞 — 保持一句就維持到訊號強度。多句會將指令稀釋成普通內容。
解決方法: 「電影級文字轉影片:」就夠。你唔需要解釋文字轉影片係乜。
陷阱 3:抽象嘅動作描述
情景: 你喺提示詞用咗「動態嘅移動」、「有趣嘅鏡頭運用」或者「好嘅節奏」呢啲短語,結果得到嘅係平庸冇靈魂嘅輸出。
根本原因: 抽象詞語轉化唔到具體嘅動作指令。模型每次解讀 generic 形容詞嘅方式都唔同,令輸出不一致。
解決方法: 將每個抽象動作詞換成具體描述。「動態」→「快速推入同時主體轉身」。「有趣」→「俯瞰吊臂下降到視線水平」。
陷阱 4:提示詞忽略時長
情景: 你寫咗好詳細嘅動作序列,但留咗時長預設冇改,或者你改咗時長設定但冇調整動作描述。
根本原因: 時長控制模型點樣編排動作節奏。一段描述 10 秒緩慢揭示嘅提示詞喺 5 秒嘅設定下會顯得好趕,而一段 5 秒快速剪接喺 10 秒會拖得太長。模型會編排動作去填滿你設定嘅時長。
解決方法: 一定要喺提示詞入面加一個同你設定時長匹配嘅時長提示。「5 秒內快速推入鏡頭」或者「一個緩慢嘅 10 秒畫面揭示」。
陷阱 5:有音訊但冇視覺方向
情景: 你喺音訊驅動模式上載咗音訊,但冇描述畫面應該顯示啲乜。
根本原因: 音訊驅動模式用上載嘅音訊控制節奏同情緒,但仍然需要視覺方向。冇咗佢,模型會產出抽象嘅、通常用唔到嘅結果。
解決方法: 一定要將音訊配搭清晰嘅視覺描述。音訊影響節奏;提示詞定義觀眾實際見到啲乜。
負責任嘅提示詞使用:成本、配額同高效測試
除咗提示詞質素,管理生成成本同配額係專業使用 Seedance 2.0 必不可少嘅一部分。AI 影片生成唔係免費嘅 — 每次生成都會消耗運算時間同配額,而成本會因解像度同長度而有顯著差異。
成本意識喺開始前就好重要。 一段 10 秒 1080p 嘅生成成本可以係 5 秒 720p 測試渲染嘅 5–10 倍。先用低解像度測試唔單止快 — 仲平好多。
點樣測試先唔會浪費配額
- 永遠由 5 秒、720p 開始。 呢個係你嘅探索解像度。留返高解像度俾最終渲染先用。
- 每次生成淨改一個變數。 同時改模式、主體、鏡頭同長度會產出你學唔到嘢嘅結果。
- 維持評分記錄。 每次測試生成,記低提示詞、三個分數(動作、準確度、鏡頭)同你改咗啲乜。記錄 10–15 次測試之後,模式就會浮現。
幾時先用全質素渲染
淨係喺你嘅測試週期確認三個維度喺 720p 都達到 4+ 之後,先渲染 1080p。720p 嘅差提示詞去到 1080p 仍然係差提示詞 — 解像度唔會 fix 到弱嘅動作描述或者含糊嘅鏡頭方向。
經驗法則
每 1 分鐘最終影片,預留 15–20 分鐘嘅 720p 測試時間。 呢個比例喺大部分使用場景都成立。如果你用嚟測試嘅時間明顯少過呢個數,你係盲緊生成。如果你用嘅時間多好多,檢討一下你係唔係每次測試疊代改得太多變數。
提示詞速查庫
保存以下提示詞 starter 用喺你下次生成:
電影感: 「電影級鏡頭:[主體]喺[環境]。[鏡頭移動]。[燈光描述]。[時長]。24fps,菲林顆粒,豐富對比。」
商業: 「商業產品影片:[產品]喺[背景]上。緩慢[鏡頭移動]。影樓燈光,銳利對焦。[時長]。乾淨、精緻效果。」
紀錄片: 「紀錄片風格:[主體]喺[真實環境][做動作]。手持鏡頭,現場光,自然色彩。[時長]。寫實感覺。」
社交媒體: 「直向社交影片:[主體][做動作]。快節奏、動態移動。鮮豔色彩,高能量。9:16 比例。[時長]。」
總結
Seedance 2.0 獎勵結構化嘅提示詞 — 但淨係結構唔保證質素。真正嘅提升嚟自將正確結構搭配系統化嘅測試習慣。
完整嘅工作流程係咁:用決策框架揀啱模式,用五元素公式寫提示詞,用模式專用範本做調整,低成本測試每次只改一個維度,三個維度分數確認提示詞得先做最終渲染。
你而家可以做嘅一個最實際嘅改變:下次 Seedance 2.0 生成失敗嘅時候,唔好成段提示詞 rewrite。認清五個公式元素入面邊個最弱,淨係 fix 嗰一個,然後再生。一個測試週期你就會見到分別。
去 seedance2pro.io 試你嘅第一次測試生成。用上面條公式由 5 秒 720p 渲染開始 — 睇吓結構化提示詞做到啲乜,然後先上全質素。想睇完整嘅 Seedance 2.0 功能參考,請睇 Seedance 2.0 完全攻略。
常見問題
Seedance 2.0 嘅提示詞應該寫幾長?
50–120 字係大部分模式嘅最佳範圍。少過 30 字會令模型對動作同鏡頭要靠估。多過 150 字通常超過模型對提示詞細節嘅有效注意力範圍。
我需唔需要喺文字提示入面描述我嘅參考圖?
唔需要。Seedance 2.0 直接分析參考圖。你嘅文字提示應該描述動作、鏡頭同節奏 — 即係圖片冇嘅嘢。重複描述圖片係浪費提示詞空間。
我可以唔同模式用同一段提示詞嗎?
部分可以。主體同風格元素可以轉移,但動作同鏡頭方向通常需要按模式調整。一段文字轉影片提示詞用喺圖片轉影片模式會表現得差啲。
邊啲提示詞最出到電影級質素?
包含具體鏡頭語言(shot 類型、鏡頭、移動)、燈光描述同風格參考(菲林質感、色調)嘅提示詞 consistently 產生更有電影感嘅輸出。就咁一個「電影級」三個字係唔夠嘅。
點樣提示先可以跨多段影片保持角色一致?
用參考轉影片模式,綁定一個主體參考圖。保持角色描述喺提示詞入面一致,但改變動作、環境同鏡頭去創造同一個角色嘅唔同 shots。
我預期要測試幾多次生成先得到可用嘅結果?
由基線提示開始,每條 scene 通常需要 3–5 次疊代。需要特定動作或鏡頭要求嘅複雜場景可能需要 8–12 次疊代,三個質素維度先全部達到 4+。
作者
更多文章

Kimi K3 Explained: Moonshot AI's 2.5T Flagship Model — Leaked Specs, Verified Tech, and What to Watch
Kimi K3 is an unreleased 2.5T MoE model with 1M-token context. We sort every leaked claim by confidence level and explain the one technology you can verify today.


Does Seedance 2.0 Accept Voice Reference? Audio Control Guide for 2026
Does Seedance 2.0 accept voice reference? Yes — as audio input, but with important limits. Here is how audio-driven generation works, what Omni Reference means for voice sync, and 3 practical workflows for adding external voiceover when native voice control falls short.

How to Access Seedance 2.0: Platforms, Regions, and Browser Access
Learn how to access Seedance 2.0 — which platforms work in your browser, region restrictions explained, and what to do if the model is blocked in your country.
電子報
加入社區
訂閱我們的電子報,獲取最新消息及更新