教學指南

Seedance 2.0 提示詞指南

Seedance 2.0 系列原生支援生動的影音同步生成,具備卓越的語義理解與多模態互動能力。本指南將帶您掌握 Seedance 2.0 提示詞的撰寫核心與實用技巧,助您更高效地創作出符合心中所想的高畫質影片。

基礎公式

Seedance 2.0 模型支援同時參照影片、圖片及音訊素材,精準鎖定角色外貌、動作效果、畫面風格、配音音色等。這大幅降低了提示詞的撰寫門檻:只需套用幾個簡單的基礎公式,即可引導模型充分發揮多模態素材的優勢,快速生成符合特定需求的影片。

參照素材生成影片的任务主要分為三種類型:多模態參照影片編輯影片續寫。請根據您的任務類型選擇對應的基礎公式。

多模態參照

從參考素材中提取特定元素(如主體、風格、場景或聲音),並生成全新影片。

  • 適用場景:動作遷移、主體重用、氛圍借鑑等任務
  • 推薦句式
  • 圖片參照:參照 <Image N> 中的 <Subject N>,生成……
  • 影片參照:參照 <Video N> 中的 <motion / camera work / style / sound>,生成……
  • 音訊參照:參照 <Audio N> 中的配音音色,生成……

影片編輯

在現有影片的基礎上進行局部或全域修改。未提及的內容預設保持不變。

  • 適用場景:局部替換、消除主體、屬性變更等任務
  • 推薦句式
  • 增加元素:清晰描述 <element traits> + <when it appears> + <where it appears>
  • 修改元素:嚴格修改 <Video N>,將 <original trait> 改為 <new trait>
  • 刪除元素:指明要消除的元素。若有需保持不變的元素,在提示詞中明確指出可使效果更佳

影片續寫

沿著時間軸延長原始影片,並保持影音風格、主體與敘事的一致性。

  • 適用場景:劇情延續、動作延伸、缺失片段修補
  • 推薦句式
  • 影片續寫:向後/向前延伸 <Video N>,生成……
  • 軌道銜接<Video 1> + <transition description> + 接 <Video 2> + <transition description> + 接 <Video 3>

注意

在進行編輯或續寫任務時,請直接指代影片為 <Video N>請勿寫「參照 <Video N>」,否則任務可能會被誤判為單純的參照生成任務。

複合任務

上述三種任務類型也可以組合使用。

  • 適用場景:一邊參照特定素材,一邊對另一段素材進行編輯
  • 推薦句式:參照 <Image/Video N>[reference dimension],嚴格修改 <Video X>,進行 [specific edits]

提示詞經典案例

為您提供 Seedance 2.0 在不同場景下的提示詞範例,助您快速掌握多模態參照控制與文字生成技巧。選擇最貼近您任務的句式並進行微調即可。

文字生成

廣告標語

提示詞範本:

「文字內容」+「出現時間」+「出現畫面位置」+「入場方式」,「文字外觀特徵(顏色、字體風格等)」

提示

Seedance 2.0 能根據畫面自動匹配合適的文字樣式。若您對文字的外觀有嚴格要求,請參閱下方「多圖參照 -> Logo 參照」章節。

參考素材

Image 1
Image 1

生成效果

提示詞

手繪動漫風格。三個人聚在一起吃著 Image 1 中的炸雞,氛圍溫馨融洽。隨後畫面逐漸模糊,中央出現文字「快樂盡在 Seedance」。

字幕

提示詞範本:

畫面底部出現字幕「……」,且字幕與音訊完美同步。

生成效果

參考素材

Tutorial illustration

提示詞

生成一段帶有旁白的影片。低沉平靜的男聲說道:「In the vastness of the cosmos, our world is but a fleeting moment. And yet, within it, life flourishes against all odds。」畫面從黑夜緩慢過渡到黎明,群星漸隱,太陽從山後升起。字幕隨著旁白同步呈現在畫面底部。

生成效果

參考素材

Tutorial illustration

提示詞

圖中的兩個人在辦公室聊天。女人先開口說道:「你每次卡點到,是不是很享受這種剛剛好的感覺?」男人笑著回答:「我有我的節奏」。對話顯得輕鬆自然,畫面底部配有對應的對話字幕。

對話氣泡

提示詞範本:

「角色」說道:「……」;說話時其身旁出現一個對話氣泡,氣泡內顯示其台詞。

生成效果

參考素材

Tutorial illustration

提示詞

Image 1 中的兩個人穿著運動服在學校跑道上跑步。女孩看著男孩,帶著自信的微笑說道:「We can definitely do it!」鏡頭切到男孩的特寫,他有些猶豫地回答:「Are you sure?」鏡頭再切回女孩的中特寫,她開朗地說:「Yes!」——語氣堅定明快。每當有人說話時,身旁就會出現對應的對話氣泡,裡面寫著台詞。

生成效果

參考素材

Tutorial illustration

提示詞

參照 Image 1Image 2 中的女孩:在草莓園裡,她摘下一顆草莓嚐了一口,笑著說道:「This is the real deal!」。她的身邊伴隨出現一個寫有此台詞的對話氣泡。

圖片參照

Seedance 2.0 支援多視角主體參照,以及場景圖、分鏡圖等多圖參照。

如果圖片的順序很重要,請按順序上傳,並在提示詞中精準地用 Image 1Image 2……Image n 來指代。

多視角主體參照

只需明確標示參照對象即可,模型可很好地執行包括(但不限於)以下範例的指令。商品類

3C 數位商品

生成效果

參考素材

Tutorial illustration

提示詞

提取 Image 1Image 2Image 3 中的相機,並將背景更換為純白。相機放置在白色桌面上,鏡頭先特寫相機,隨後圍繞相機主體緩慢旋轉,清晰展示相機的正面、側面及背面。

家居生活用品

生成效果

參考素材

Tutorial illustration

提示詞

在溫馨基調的家居場景中,中景呈現參考圖片中的保溫杯。鏡頭平緩推進至特寫,一隻手自然地伸入畫面,握住保溫杯身並將其拿起,鏡頭跟隨手部的輕微旋轉動態展示產品細節。

角色類

參考素材

Tutorial illustration

生成效果

提示詞

參照 Image 1Image 2Image 3 中的女子,生成她在咖啡廳裡吃蛋糕的場景。

多圖聯合參照

Logo 參照

生成效果

參考素材

Tutorial illustration

提示詞

背景是未來都市霓虹閃爍的空中步道,飛行器在全像廣告牌之間穿梭。參照 Image 2 中的女孩:首先是她放飛一個帶著全像投影的銀色懸浮孔明燈的中景,隨後鏡頭拉遠,展現滿天的漂浮孔明燈。畫面逐漸模糊,顯現出 Image 1 中的 Logo。整體風格:3D 數碼龐克科幻動畫。

多主體參照

生成效果

參考素材

Tutorial illustration

提示詞

參照圖片中的貓和狗:在溫馨的公寓裡,狗正躺著吃碗裡的食物;貓走過來用爪子拍了拍狗;狗看到貓後停止吃食,貓依偎在狗的身旁。色調溫暖。

多元素參照

生成效果

參考素材

Tutorial illustration

提示詞

場景設定在 Image 4 中熱鬧非凡、顧客盈門的餐廳。Image 1 中的女孩穿著 Image 2 中的服裝,正在櫃檯整理物品。Image 3 中的男孩是一名顧客,正走上前去,希望能要到女孩的聯絡方式。Image 5 中的 Logo 在整個影片中一直顯示在畫面的右下角。

多格分鏡圖參照

生成效果

參考素材

Tutorial illustration

提示詞

參照圖片中的分鏡圖,生成一段激烈的打鬥場面。按順序展現每個分鏡的構圖,隨後兩人展開激烈對決。

單格分鏡圖參照

生成效果

參考素材

Tutorial illustration

提示詞

參照分鏡 Image 3 的構圖:女孩等待爸爸做完飯,並說道:「아빠, 배고파요! 밥 다 됐어요?」——女孩的外貌參照 Image 1。隨後鏡頭向右平移,切換至 Image 4 的構圖:外貌參照 Image 2 的爸爸回答:「거의 다 됐어, 조금만 기다려!」。接著切回女兒略顯失望的近景特寫,她說:「아직 멀었어요? 맛있는 냄새 나는데…」。最後切換到爸爸的特寫,他笑著說:「이제 진짜 금방이야。 "빨리빨리" 하지 말고 손부터 씻고 와!」

影片參照

Seedance 2.0 支援影片參照——只需在提示詞中清晰指明生成內容與參照內容即可。

如果影片的順序很重要,請按順序上傳,並在提示詞中精準地用 Video 1Video 2……Video n 來指代。

動作參照

影視創作

生成效果

參考素材

Video 1
Tutorial illustration

提示詞

參照 Video 1 中的人物動作與鏡頭語言,生成 Image 2Image 1 之間的打鬥場景——Image 2 為左側人物,Image 1 為右側人物。搭配激昂的背景音樂。

廣告行銷

生成效果

參考素材

Video 1

提示詞

參照 Video 1 中馬匹奔馳的姿態,生成一匹在草原上奔馳的金色駿馬,隨後定格其矯健的奔跑姿態並幻化為一隻馬形黃金吊墜。

運鏡參照

生成效果

參考素材

Video 1
Image 1
Image 1

提示詞

參照 Video 1 的鏡頭運動軌跡,製作一段科技園區的宣傳概念片:以 Image 1 中的高聳建築為視覺中心,採用相同的俯衝第一人稱視角,展現 Image 1 中園區的未來感設計。

特效參照

影視創作

生成效果

參考素材

Video 1
Image 1
Image 1

提示詞

參照 Video 1 中的金色粒子特效:當 Image 2 中的角色吹奏長笛時,相同的金色粒子特效環繞其周圍旋轉漂浮。

創意趣味特效

生成效果

參考素材

Video 1
Image 1
Image 1

提示詞

參照 Video 1 的特效,為 Image 1 中的女孩加上相同的翅膀,並保持完全一致的展翅生長軌跡。

影片編輯與續寫

Seedance 2.0 支援豐富的影片編輯功能:如添加、刪除或修改元素;向前或向後續寫影片;以及多軌道畫面銜接。

如果影片的順序很重要,請按順序上傳,並在提示詞中精準地用 Video 1Video 2……Video n 來指代。

增加 / 刪除 / 修改元素

增加元素

生成效果

參考素材

Video 1

提示詞

Video 1 的櫃檯上,添加炸雞、披薩等各類零食。

刪除元素

生成效果

參考素材

Video 1

提示詞

清理掉 Video 1 桌上的其他零件和工具,保持案面乾淨整潔——僅保留兩人手中拿著的物件。

修改元素

生成效果

參考素材

Video 1
Image 1
Image 1

提示詞

Video 1 中的香水替換為 Image 1 中的面霜,保持人物動作與運鏡軌跡不變。

影片續寫

注意

模型會自動對接縫處的畫面進行剪輯合成——不會重複生成輸入影片中已有的畫面片段。

向後續寫

生成效果

參考素材

Video 1

提示詞

生成 Video 1 之後發生的情節:兩位遲到的男士朝他們跑來,五人終於會合並熱烈地交談起來。

向前續寫

生成效果

參考素材

Video 1

提示詞

向前延伸 Video 1:採用白衣男子的過肩鏡頭,他說道:「事情沒那麼糟,你只是壓力太大了。每個人都會經歷這個階段,撐過去就好了。」

畫面銜接

提示

  • Seedance 2.0 最多支援輸入 3 段影片,總長度不超過 15 秒。
  • 生成時系統會自動剪裁前後影片的對接邊界,僅保留必要部分完成過渡合成。

生成效果

參考素材

Video 1
Video 2

提示詞

Video 1 —— 在落葉著地的瞬間,激起一圈金色粒子特效;隨後一陣風拂過 —— 接 Video 2

進階黃金公式

Seedance 2.0 本質上是一位多模態 AI 導演:它能同時讀懂您的文字提示詞、圖片、影片與音訊,並在模型內部將其拆解為空間層(畫面上有些什麼)與時間層(畫面如何隨時間變化),進而精準理解並生成畫面。

因此,優秀的提示詞絕非空洞的「廣告行銷形容詞疊加」,而是工程思維式的架構指令:交代清楚「誰、在什麼場景、做什麼動作、配什麼運鏡、按什麼順序」,並將這些要素分別餵給空間層與時間層。其結構如下:

進階提示詞公式:精準主體 + 動作細節 + 場景與環境 + 光影色調 + 鏡頭運鏡 + 畫面風格 + 畫質要求 + 負面排除限制

簡而言之:首先鎖定「在做什麼」,接著奠定「哪裡何種氛圍」,然後指引模型「如何運鏡拍攝」,最後以風格、畫質和限制條件來規範生成效果。以下將為您逐一拆解各要素。

1. 明設定義主體

單張參考圖片中通常包含多個元素。為了精準參照其中某個特定對象,您必須對主體進行明確定義。主體可以是一個人、一件道具,或是一個場景。

  • 推薦句式:將 <Image/Video N> 中具有 [主體核心特徵] 的主體定義為 <Subject N>
  • 特徵要求:提取 2~3 個清晰且穩定的靜態特徵(如衣著、髮型、長相、類別等),使主體具備明確的唯一辨識度。
  • Examples:
  • Image 1 中穿紅裙戴草帽的女子定義為 Subject 1
  • Image 1 中穿紅裙戴草帽的女子定義為 Zhang Hong

注意

  • 每當主體出現時,必須進行顯式指代,切勿使用模糊的隱式代稱。系統支援以下兩種方式:
  • 在未預先定義主體的簡單場景中,每次描述主體時,可採用 <Subject N>@<Image N> 的格式,以強調主體與特定素材的綁定關係。例如:張三@Image 1
  • 在已預設定義主體的場景中,後續全程保持標籤一致。例如:將 Video 1 中的高個子男人定義為 Cop,矮個子定義為 Thief,後續描述便一律以此標籤指代。
  • 描述應儘量精煉簡明。避免冗餘廢話與語義衝突(例如同一個主體在前後描述中出現互相排斥的特徵)。
  • 儘量透過上傳參考圖片來展現空間布局關係,避免使用複雜抽象的文字描述空間位置。

2. 寫好分鏡編排

模型內部會將空間與時間解耦處理。因此,在面對複雜的長鏡頭或劇情片時,理想的提示詞結構應呈分鏡時間軸形狀:將影片拆分為數個分鏡,並按照事件發生的順序,逐個鏡頭進行動態描述——闡明誰 + 在哪裡 + 有何動作 + 鏡頭如何運動。

實用建議:可以先為影片梳理一份簡單的『Shot 1 / Shot 2 / Shot 3』大綱,再融入到完整的提示詞中。

  • 反面範例:「一個男人緊張地在街上跑,畫面很有電影感。」
  • 優秀範例
  • Shot 1:街道小巷的側面中景。男人深呼吸後緩緩起跑,神色顯得驚慌而急迫。
  • Shot 2:男人意外撞翻了路邊的水果攤;鏡頭快速橫甩,定格並推近至他驚恐神色張望的臉部特寫。
  • Shot 3:男人奮力躍過矮牆並消失在視野中;鏡頭緩慢拉遠,定格在空無一人的悠長街道上。

分鏡細則

  • 使用 Shot 1Shot 2Shot 3 等指代標記,並按照情節發生的先後順序(主務優先)編排。請勿在提示詞中強行規定每個片段的精確秒數,應由模型本身自然地推進敘事節奏。

提示

模型目前對精確秒數(例如「0~3秒」)的控制較不穩定,強行指定時間區間容易導致生成畫面異常。

每個分鏡的內容推薦按以下順序進行組織:

  1. 鏡頭運動或過渡轉場:如「遠景緩慢推進」、「固定鏡頭拍攝」、「切換至……」。
  2. 主體動作與表情:主體人物或核心物件的關鍵動作和表情神態變化。
  3. 位置與空間變更:主體所處的場景位置、方位或空間布局關係描述。
  4. 音訊與神態資訊:該分鏡下的台詞 dialogue、環境音效或背景音樂細節。

3. 細化動作描述

  • 精準局部部位 + 量化動作幅度與力度 —— 將動作細緻拆解至雙手、雙腿、頭部、肩膀或背部,並輔以幅度、速度與力量感。例如:緩慢抬起右手、快速轉頭、用力蹬地起跑、微微低下頭。
  • 優先選擇緩慢、柔和、連續的微調動作 —— 多描述緩慢、流暢、連貫的微小動作;儘量避免急停急揮、大步跳躍、劇烈翻滾等高爆發、大動態的劇烈行為。例如:漫步徜徉、溫柔地抬手、輕微頷首、一氣呵成得坐下。
  • 描述動作之間的過渡與借力 —— 詳細寫出連續動作之間的借力與承接方式,以確保運動神態連貫。例如:順著轉身的慣性順勢抬手、由靜止自然過渡到抬起手臂。
  • 將抽象情感外化為具體肢體神態 —— 不要使用「非常悲傷」或「怒不可遏」等抽象詞彙,而是透過具體的肢體細節與神情來展現。詳見下表配合說明:
抽象情緒外化肢體表情與細節
悲傷低下頭,肩膀微微顫抖,眼眶泛紅,手指無意識地抓緊衣角,眼淚在眼眶中打轉而未落下
喜悅嘴角抑制不住地自發上揚,眉眼舒展,步伐變得輕盈,無意識地哼起小調,忍不住在原地輕快地轉了個圈
緊張 / 焦慮頻繁看手錶,手指不停地快速敲擊桌面,呼吸急促,眼神飄忽不定,無意識地輕咬指甲
憤怒雙拳緊握,下頜線緊繃,胸口劇烈起伏,眼神如利刃般凌厲,咬牙切齒地吐出每一個字
釋然深吸一口氣後緩緩吐出,緊繃的雙肩完全放鬆下來,臉上浮現出久違的淡淡微笑,目光投向遠方

4. 標準運鏡指令

模型內部對專業運鏡與相機詞彙有著極高的理解度——請直接在提示詞中使用標準的鏡頭術語。例如:「中景、特寫、全景、緩慢推鏡頭、平滑橫鋪跟拍、固定機位拍攝」。

注意

每個鏡頭分鏡中建議僅指定一種主要運鏡軌跡。若同時要求前推、後拉、橫移加跟拍,會成倍增加畫面不穩定與撕裂的機率。

5. 規整畫質風格與排除限度

畫質要求、視覺風格與排除限制詞是約束與優化生成效果的關鍵要素。它們一方面幫助定義創作邊界、統一美術水準,另一方面能有效抑制畸變與無序漂移,是保障產出效果穩定且合規的關鍵依據。

1. 畫質控制詞 —— 定義內容的清晰度、紋理細節與光影質感,拉高生成成品的下限。典型範例:超高畫質、豐富細節、電影級畫面質感、色調自然、光影柔和。

2. 風格引導詞 —— 指引排版和美術方向,統一全片的視覺格調。典型範例:數碼龐克冷調藍紫配色、復古膠卷、清新日系色調。

3. 負面排除詞(非常重要) —— 用於強力抑制多指、形變、不合邏輯物件等視覺瑕疵,精简生成方向,提升成品可用率。常用排除模板

  • 排除字幕:「畫面無任何字幕」、「避免生成任何文字或字幕」
  • 排除標誌:「請勿生成任何品牌 Logo」
  • 排除浮水印:「請勿生成浮水印」

6. 進階實戰案例演練

以下兩個經典範例向您呈現如何將進階黃金公式中的各個元素有機結合,寫出高水準的全局提示詞。

參考素材

  • @Image 1:女主角的半身生活照
  • @Image 2:宿舍情境場景參考圖
  • @Video 1:室內對話運鏡參考(中景推拉或輕微平移鏡頭)
  • @Audio 1:室內生活環境音或輕快背景音樂

提示詞

@Image 1 中的女孩為女主角,@Image 2 為宿舍場景風格參考,鏡頭運鏡參考 @Video 1。 Shot 1:黃昏時分,女孩 @Image 1 步伐輕快地走向宿舍門口 @Image 2。鏡頭採用穩定的中景跟拍;溫暖的黃色夕陽透過窗戶灑向走廊。她在門口停下,深吸了一口氣,神色顯得有些緊張。 Shot 2:女孩 @Image 1 推開門走進宿舍。畫面切換至室內中景:室友們正抬起頭整理手頭的書籍,其中一位笑著問道:{How did the exam go? Did you pass?} 鏡頭在眾人的半身特寫中緩慢切換對焦。 Shot 3:女孩 @Image 1 先是神態沮喪地低下頭——鏡頭推進至其臉部特寫——隨後她忍不住嘴角上揚狂喜,大笑著說出台詞:{Fooled you all}。室友們紛紛笑鬧著追打她;鏡頭此時緩緩拉遠,定格在充滿歡聲笑語的宿舍全景畫面中。 全局要求:高清紀錄片質感,溫暖色調,光影柔和;人物面部穩定不失真,肢體動作自然流暢、無卡頓或閃爍;環境音與 @Audio 1 完美融合。

實戰進階技巧

排版文字生成技巧

Seedance 2.0 支援在影片中直接生成常見的畫面上文字。模型預設會根據背景構圖自動匹配合適的文字樣式與配色,同時也允許您在提示詞中主動指定文字的顏色、字體、入場動態、出現秒數與畫面位置。為了獲得最佳的渲染效果,提示詞中請儘量使用常用漢字,避免使用生僻生冷字特殊符號。目前支持包括廣告標語、字幕、對話氣泡等場景,具體提示詞套用公式請參考上文 文字生成 範例。

長鏡頭續寫 vs. 分段剪輯拼接

  • 一鏡到底長鏡頭(影片續寫):適用於單一場景內偏對話驅動的「文戲」——如長對話談話、情感渲染鋪墊、單一路線行走等,提供極具沉浸感的高階畫面呈現。
  • 劇情/動作翻轉(分段剪輯拼接):適用於情節發生明顯轉折或動作動態極強的「武戲」——如追逐打鬥、節奏切換。建議將各片段獨立生成,再透過後期軟體剪輯在一起,以確保敘事節奏與畫面衝擊力。

在實際影視專案中,通常會將兩者結合使用:先透過續寫生成流暢連貫的對話長鏡頭,再利用剪輯穿插插入特寫鏡頭或轉場空鏡,一邊維持故事沉浸感,一邊豐富整體節奏與層次。

高階參考素材配置策略

進行創作時,可以將您手中準備的外界參考素材歸納為以下 4 大功能定位:

  1. 角色骨架錨點:精準鎖定角色的外貌特徵
  2. 場景基調錨點:鎖定場景空間與整體色彩美術風格
  3. 相機與動作參照:約束分鏡運鏡語言與肢體動作規律
  4. 節奏與配音錨點:運用音訊訊號精確引導剪輯節奏與台詞音色

最優推薦組合(總計 4~5 個素材):1~2 張角色圖(含五官近景特寫 + 全身著裝照) + 1 張場景背景圖 + 1 段運鏡參考影片 + 1 段配音/音效音訊。

提示

素材並非越多越好,請避免塞滿上傳上限。過多冗餘的參考素材會嚴重干擾模型對核心特徵的識別比重,極易引發風格失調、主體身份識別模糊、生成結果嚴重偏離預期等情況。

規範化書寫指南

語言一致性

請在台詞對話中保持單一語言。避免在同一句話中混用多種語言(核心專有名詞除外)。

特定控制符號定義

在提示詞中規範使用特定控制符號,可以幫助模型清晰劃分並正確理解不同類別的資訊:

資訊類別標記符號典型範例
伴奏/背景音樂()(背景播放節奏強烈的搖滾樂,音量激昂)
環境特效音<><遠處傳來幾聲低沉的狗吠聲>
台詞對話{}{Hello, world}。若台詞為小眾語言(非中/英文),請主動備註語種。例如:日語說道 {こんにちは}。
畫面字幕/圖貼【】【第一章:啟程】

疑難排解與常見問題 (FAQ)

角色 ID 漂移(人物一致性偏差)

具體病徵 —— 生成影片中的主角與參考圖片相差甚遠;或在生成影片中途,人物面部出現了劇烈變化(即 ID 漂移現象),有時甚至因誤撞明星長相而觸發系統合規審查過濾器。

根本癥結 —— 面部核心特徵提取效率低下:

  • 素材特徵混雜:面部特寫與全身站姿、衣著配飾或環境細節強行融合在一張參考圖中上傳。
  • 人臉佔比過小:主體人臉在整張合圖中的面積比例過低,導致模型內部分配的面部特徵權重被外圍的背景、衣著等無關噪聲大幅稀釋。

救治方案 —— 大幅提升並強化面部素材的獨立性與內部關注度權重:

  1. 特別準備一張高畫質面部特寫(Headshot):除了全身著裝照外,務必單獨準備一張僅包含角色面部頭部的特寫大頭照(表情推薦自然平靜,避免繁雜的肩膀和花哨背景)。
  2. 在提示詞中明確主體各部位的參照映射關係:“Subject 1 的面部五官細節參照 Image 1(頭像特寫圖),妝容與穿著搭配參照 Image 2(全身服裝圖)”。
  3. 核心素材最前置原則:某張素材需要被參照的精確度越高,對應的提示詞描述便應越早、越靠前呈現在完整的提示詞中。

注意

推薦使用「面部特寫照 + 全身服裝照」的獨立組合。強烈不建議直接上傳多角度三視圖(Multi-view sheets) —— 三視圖在同一張圖內塞入了多個角度的同一人,模型極易將其誤讀為『畫面上存在多個長相相似的不同主體』,反而會加劇 ID 漂移與複製人現象。

調整前

影片中段人物面部突變,面部特寫與明星神似

調整後

人物面部特徵全程與參考圖保持高度一致

如何避免不想要的「幽靈字幕」

具體病徵 —— 提示詞中分明並未要求生成任何字幕,但生成的整段影片底部依然固執地帶著字幕。

提示

模型技術上目前尚未能做到百分之百完全杜絕,套用以下物理方案可將其發生的機率降至極低,大幅提高生成成功率。

  1. 在提示詞最末端加入明確的硬性負面指令:「畫面嚴禁出現任何字幕」、「避免生成任何文字、浮水印或字幕」。
  2. 若您上傳的參考圖片或參考影片中含有不必要的文字標誌,請在輸入模型前,先使用 Seedream 或 Seedance 的消除編輯功能將這些原生文字抹除乾淨。
  3. 在業務場景允許的前提下,優先選擇生成橫向影片(Landscape)(橫向模式下出現字幕的機率顯著低於直向影片),隨後在剪輯軟體中将其裁切為直向比例。

意外生成外部 Logo/浮水印

具體病徵 —— 提示詞並未要求生成任何浮水印,但成品中莫名出現了其他短影片平台的附隨 Logo 或不規則浮水印斑塊。

解決方案 —— 提示詞末端必須疊加明確排除句式:「請勿生成任何品牌 Logo」、「畫面無任何浮水印」。

風格跑偏(風格不一致問題)

具體病徵 —— 目標是生成 2D 或 3D 經典動漫風格影片,但由於上傳的參考圖本身略帶寫實厚塗質感,加之提示詞未重點強調藝術風格,導致成品不知不覺跑偏成了真人寫實質感。

解決方案 —— 主動增添強風格約束詞,如「2D日式動漫風」或「3D國潮國風CG動畫」。如需進行極限控制,建議先使用繪圖工具將參考底圖轉換為目標美術風格,再將其作為素材輸入進行影片生成。

調整前

仙俠奇幻風走偏、淡化為真人寫實感

調整後

精準保留 3D 國風 CG 仙俠奇幻美術風格

影片拼接接縫處跳幀與回退

具體病徵 —— 在生成影片向後續寫並與前段影片相拼接的過度位置(接縫處),轉場出現明顯的生硬震動、跳幀,或出現畫面邏輯開倒車回退現象。

解決方案 —— 隨著模型升級此問題將得到根治。目前,推薦使用『關鍵影格精準對齊』工作流進行後期剪輯處理:

  1. 將生成的續寫影片與前段影片一併拖入 剪映 (CapCut) 或 Premiere 等專業剪輯軟體中。
  2. 在第一道銜接縫處,將前一個片段的末端切掉 6 幀
  3. 同時,將後一個片段的開頭切掉 1 幀
  4. 依次對每個銜接駁接點進行此縮幀操作。
  5. 匯出影片,檢查拼接過渡是否已變得平滑流暢。

提示

受制於生成原理,即使進行空格修剪,部分大動態場景可能仍有輕微違和感。建議在設計續寫腳本時,讓前片段結束在某個完美的『鏡頭切換』轉場時間點,隨後直接讓後一個片段以新場景、新鏡頭開啟,從物理上巧妙隱藏拼接痕跡。

調整前

接縫處有顯著的閃爍跳格與畫面内容回溯(出現在 5s、20s)

調整後

平滑過渡,接縫銜接自然順暢

「複製雙胞胎」問題

具體病徵 —— 在涉及多個角色的場景中(尤其是當上傳了人物三視圖/多角度合圖進行參照時),生成的影片畫面中常常在同一個畫幅裡神仙打架般出現兩個一模一樣的可複製雙胞胎。

根本癥結

  • 提示詞中未能為主體角色建立起明確的對應關係標籤,導致模型邏輯識別混淆。
  • 三視圖等多視角拼接圖在上傳後未能被模型正確拆解,模型在解耦生成時將其誤判為『畫面中本就應有多個彼此相似的人物』。

提示

目前尚未有完美的演算法自動杜絕複製人。運用以下多重技巧,能最大程度降低複製人事件的發生頻率,提高高合規影片的產出良率。

  1. 實施精準的人像特徵一一綁定:在書寫提示詞時,對每個人物標註其對應來源圖,並保持格式統一。例如:『張三(對應 Image 1 外貌)將綠色存摺用力甩向站立著的李四(對應 Image 2 外貌)』。
  2. 在提示詞最尾端疊加全域限制詞:「此影片中禁止出現長相、衣著極度雷同的複製品;畫面禁止出現任何克隆體、雙胞胎效果;確保同一畫面中每種外觀特徵的人物有且僅存於單個實體,嚴禁畫面角色穿模重影、多頭複製。」
  3. 簡化並優化您的參考素材:強烈推薦上傳乾淨的單人頭像/半身照;全面棄用多角度拼接圖、三視圖、九宮格等多角度素材。
  4. 為提示詞脫水(精簡化描述):切勿將整個冗長的劇本直接貼入提示詞中——多餘的贅述會嚴重稀釋其注意力權重。大刀闊斧砍掉與人物和動態無關的背景台詞,直奔指令核心。

調整前

影片在第 8 秒時出現了人物「克隆複製體」

調整後

重複續寫導致的品質衰退疊加

具體病徵 —— 將第一輪生成的影片成品再次作為輸入材料進行向後續寫延長時,第二次產出的片段畫質會出現顯著劣化。隨著續寫輪次增加,降級效應會無情累加,人物臉部等細節處容易溢出斑駁的色塊和模糊色斑。

解決方案 —— 研發團隊正在加速疊代核心模型以優化編解碼精度。目前可以採用以下物理「白模過渡」工作流進行規避和降載:

  1. 首選「白模中繼」方案:先將前片段影片透過 Seedance 2.0 轉換為標準的極簡 3D 白模,再以此無色白模作為續寫的核心輸入,大幅減少色彩噪聲的傳染。參考白模提示詞:『將輸入影片轉換為白模 3D 模型:所有人物轉變為純白色 3D 模型,無外表顏色、無細節紋理、無陰影遮擋,背景為純白,畫面結構保持高度穩定,動作平滑流暢。』
  2. 在面部和細節參照中,堅持使用分辨率較高的超清原圖作為始發素材。
  3. 合理克制單個故事的無限續寫深度,儘量避免超長、多輪、無限層級的續寫套娃。

調整前

直接對模型的原始成品影片進行多輪續寫

調整後

先轉換為極簡白模動態,再進行接力續寫

特效動態未能滿足預期

具體病徵 —— 那些包含複雜運動物理規律或邏輯嚴密的特效,很難單純依靠文字描述一步到位。例如:在提示詞中吩咐「數字 2999 以倒計時動畫動態進場」,然而成品文字卻是不符合邏輯地隨機亂跳、滾動,根本無法形成規整的倒計時特效。

解決方案 —— 直接提供特效參考影片:上傳一段現成的、包含目標粒子運動或字體跑馬燈軌跡的實體影片,讓模型像素級參照其物理軌跡。提示詞語法:『數字 2999 以 Video 1 中完全一致的進場軌跡與特效進場播放。』

調整前

參考素材

Video 1 —— 特效參考影片

單純通過文字描述,複雜的數字滾動粒子效應出現了無序亂跳

調整後

透過上傳正確的數字滾動特效影片進行精準引導後,生成效果完美符合預期

參照的主體角色數量超載

具體病徵 —— 當一幅畫面、一部短片中涉及到多於 4 個或以上需要被模型逐一精準參照的角色時,成品的畫面架構穩定度會呈斷崖式下跌:影片極易漏掉個別角色、莫名生出路人,或角色臉部瘋狂跑偏、錯位穿模。

解決方案 —— 多角色並列是多模態生成領域的業界公認難題,目前可靈活採用此『分組聚合工作流』分散模型算力負擔:

  1. 實施多主角分組聚合群像:將主角們切分為更小的組合群組,確保單張場景圖內不超過 4 個人。例如,6 個角色可以先拆解為 2 組,每組 3 人獨立生成照片。
  2. 以分組全家福底圖作為素材輸入:將這些事先生成好、角色外貌已被固化收束的分組照片作為底圖參照,再進行最終的圖生影片操作。

調整前

一股腦餵入 8 個參考角色素材 → 影片生成出來變成了混亂的 9 個人

調整後

先將 8 個角色分別融合成 2 張高一致性合影,再將合影作為底圖送入圖生影片

配音音色與參考音軌出現偏差

具體病徵 —— 雖然已經上傳了特定人聲語音(Audio)作為配音複製參考,但最終成品影片中的發音音質、厚度與音色特徵仍與參考音訊相差較大,嚴重失真。

解決方案

  1. 在文字中極力細化聲音的質地特徵:在提示詞中為配音輔以詳細的物理音色特徵語句。如:『主角以類似 @Audio 1 那般沙啞低沉、溫潤厚重的中年男中音緩緩訴說……』
  2. 對齊文風與講話神態語調:撰寫台詞長句時,請在口氣、用詞長短、中英文夾雜成分上與背景 Audio 的口氣習慣保持一致,能顯著幫助聲學算法定位特徵,提高音聲還原度。

調整前

參考素材

Audio 1 —— 參考音軌素材

人物配音音色與上傳的音軌素材存在割裂感

調整後

在提示詞中詳盡描述了音色特徵後,成品音質和音色形似度獲得了顯著飛躍