如何撰寫真正有效的 AI 影片提示詞:五維度框架
- 是什麼讓 AI 影片提示詞發揮作用?
- AI 影片提示詞的五個維度
- 輔助控制:時長、格式、音訊與連續性
- 文生影與圖生影提示詞的差異
- 真實 AI 影片範例與實用教學
- 可直接複製的 AI 影片提示詞範本
- 常見 AI 影片提示詞錯誤與實用修正方法
- 如何修改生成失敗的影片
- 多數 AI 影片提示詞指南忽略的要點
- 初學者的簡易練習計畫
- 生成前的最終檢查清單
- 常見問題
- 結論
AI 影片生成器可以將簡短的描述轉變為動態場景,但模糊的提示詞往往會產生模糊的結果。主體可能在第一幀看起來正常,接著就變形了;鏡頭可能靜止不動;或者多個動作可能混雜成混亂的運動。
解決方法並非在提示詞中堆砌更多形容詞。更好的方法是撰寫一份精簡的鏡頭摘要:定義畫面中的內容、發生了什麼變化、鏡頭如何觀察它,以及哪些細節必須保持穩定。本指南將透過五維架構、真實影片範例、可直接複製的範本以及簡單的修改工作流程,說明如何撰寫 AI 影片生成提示詞。
是什麼讓 AI 影片提示詞發揮作用?
有效的 AI 影片提示詞能為模型指派明確的視覺任務。它能識別主體、描述一個可見的動作、將該動作置於特定環境中、指導鏡頭運作,並定義鏡頭的外觀風格。
效果較差的提示詞:
A beautiful woman walking in a cinematic city.
這留下了許多重要決定未解。這位女士長什麼樣子?她是朝向鏡頭走還是背對鏡頭走?鏡頭是靜止還是移動的?模型應該使用哪座城市、什麼時間點和什麼樣的光影?
效果更好的提示詞:
A young woman with short dark hair, a black leather jacket, and dark trousers walks slowly through a rain-soaked Tokyo street, then turns toward the camera. Medium side-tracking shot with a gentle forward push. Wet pavement reflects blue and pink neon, with light mist in the air. Realistic 35mm film look, low-saturation colors, soft neon side light, 8 seconds.

第二個版本為生成器提供了主體、動作、場景、鏡頭指導、視覺處理和時長。這並不能保證完美的結果,但它減少了模型需要猜測的部分。
AI 影片提示詞的五個維度
請使用以下順序作為起點:
[Subject] + [Action] + [Setting] + [Camera] + [Style and Lighting]

若要製作可用於實際生產的提示詞,請在後面加上輸出控制:
[Duration] + [Aspect Ratio] + [Audio] + [Continuity Rules]
這五個維度描述了鏡頭的創意內容。時長、格式、聲音和連續性則是輔助限制條件,有助於讓結果更易於使用。
1. 主體:定義觀眾應該看到的內容
從人物、產品、動物或主要物體開始。使用對鏡頭至關重要的細節,而不是描繪你能想像到的一切。
對於人物,有用的細節可能包括:
- 大致年齡;
- 髮型、服裝和配件;
- 身體姿勢或面部表情;
- 應保持一致的身分特徵細節。
對於產品,請描述:
- 形狀與材質;
- 顏色與表面處理;
- 標籤或包裝位置;
- 應展示的角度。
比較以下兩種描述:
A woman
A short-haired woman in a charcoal wool coat, cream scarf, and brown leather gloves
第二個版本為模型提供了可在後續鏡頭中重複的視覺身分特徵。對於重複出現的角色,請在不同提示詞中逐字複製關鍵描述,而不是每次都用新的同義詞重寫。
2. 動作:描述隨時間推移的一個主要變化
影片需要動詞。靜態圖片提示詞可以描述主體站在房間裡,但影片提示詞應該說明在片段期間發生了什麼變化。
好的動作是具體且可見的:
- 將咖啡倒入陶瓷杯中;
- 緩慢轉向窗戶;
- 將紙船放到水面上;
- 打開筆記型電腦並敲擊一個按鍵;
- 漫步在飄雪中。
避免將完整的故事情節塞進單一短片中。「她打開門,穿過街道,坐進車裡,然後開車離開」包含了多個鏡頭。請將其拆分為不同的提示詞,或者當工具支援較長序列時使用分鏡腳本時間軸。
你可以添加一個微小的次要動作,讓鏡頭感覺更生動:
The woman walks slowly along the pier while her scarf moves gently in the wind.
主要動作是行走。圍巾的晃動起到了輔助作用,而不會分散注意力。
3. 場景:為動作提供一個可信的場所
「辦公室」或「森林」往往太過寬泛。請添加影響氛圍和構圖的細節:
- 地點;
- 時間(如清晨、黃昏);
- 天氣;
- 前景與背景元素;
- 可見紋理;
- 背景動態。
範例:
A quiet ceramic studio at dawn, with wooden shelves, pale clay bowls, a large north-facing window, and soft dust floating in the sunlight.
你不需要描述房間裡的每件物品。選擇有助於模型理解該地點且觀眾確實能看見的細節。
4. 鏡頭:說明鏡頭的拍攝方式
鏡頭語言能將場景轉變為具有導演意圖的鏡頭。在需要時請包含景別、角度、運動方式和速度。
常見景別術語:
- 大特寫;
- 特寫;
- 中景;
- 全景;
- 俯拍鏡頭;
- 空拍鏡頭。
常見運鏡術語:
- 固定機位鏡頭;
- 緩慢推進(推鏡頭);
- 拉遠(拉鏡頭);
- 由左至右平移;
- 跟隨鏡頭(跟鏡頭);
- 環繞鏡頭;
- 升降搖臂上升;
- 手持跟隨。
每個短片段使用一種主要運鏡方式。例如:
Macro close-up with a slow push-in toward condensation forming on the glass bottle.
這比「讓產品鏡頭更具動態感」更具操作性。如果主體也在移動,請分別描述這兩種運動:
The cyclist moves from left to right while the camera tracks alongside at a steady pace.
5. 風格與光影:定義視覺處理方式
風格告訴模型畫面的外觀質感。光影則告訴模型場景該如何被照亮。這兩者相關,但並非相同的指令。
有用的風格方向包括:
- 寫實紀錄片畫面;
- 簡潔的產品廣告;
- 手工剪紙動畫;
- 柔和低調的 35mm 底片質感;
- 定格動畫;
- 賽璐珞著色動漫風格;
- 手機拍攝的 UGC(使用者原創內容)畫面。
有用的光影方向包括:
- 溫暖的清晨窗邊光;
- 陰天的冷色調自然光;
- 日落時分的硬朗逆光;
- 柔和的霓虹側光;
- 單一頂部聚光燈;
- 帶有深邃陰影的燭光。
用具體可見的特質取代抽象短語。與其使用「高階電影氛圍」,不如嘗試「柔和逆光、克制的鏡頭運動、淺景深以及柔和的暖色調」。
輔助控制:時長、格式、音訊與連續性
五個維度構建了鏡頭,而以下控制項則有助於讓鏡頭契合實際專案需求。
時長與長寬比
在模型支援時指明預期時長,並選擇符合目標用途的長寬比:
- 16:9 適用於寬螢幕影片與電影風風景;
- 9:16 適用於直式社群影片;
- 1:1 適用於正方形社群貼文。
如果工具將時長和長寬比作為獨立控制項提供,請優先使用這些控制項,並讓提示詞專注於創意方向。
音訊與對白
如果模型支援原生音訊生成,請描述你真正想要的聲音:
Natural café ambience, soft cup and spoon sounds, distant conversation, no music.
對於對白,請用引號寫出確切字句並指明發話者。台詞長度應保持簡短以符合片段長度。如果你不希望有語音或字幕,只有在模型支援此類限制條件時才需說明。
連續性規則
當同一個角色或產品出現在多個鏡頭中時,請重複不可更改的細節:
Keep the same face, hairstyle, cream sweatshirt, product shape, label position, and warm color palette throughout the sequence.
對於圖生影(image-to-video),請專注於哪些部分應該運動、哪些部分應保持固定。來源圖片已經提供了大部分構圖,因此提示詞通常不需要重複所有視覺細節。
文生影與圖生影提示詞的差異
文生影要求模型從文字中建構場景。請包含主體、場景、動作、鏡頭、光影和風格。
圖生影則始於既有的視覺參考。請聚焦於動作、鏡頭運作和穩定性:
Animate the supplied product image with a slow push-in. Add a subtle highlight moving across the glass and a shallow background parallax. Keep the bottle shape, label, color, and position unchanged. Avoid extra products, packaging distortion, and unreadable text.

「讓這張圖片動起來」這句話通常太過模糊。請告訴模型哪些地方會改變、哪些地方不變。
真實 AI 影片範例與實用教學
以下範例基於 GoEnhance 提示詞庫的精選案例。文中附帶了影片,以便你將文字指令與產生的動作效果進行比對。線上來源頁面與影片 URL 於 2026 年 8 月 26 日查核;來源頁面可能會隨時間變更。
如需查看更多特定模型的範例,請瀏覽 Seedance 2.0 提示詞、Grok Imagine 提示詞 以及更廣泛的影片提示詞合集。
範例 1:低保真鄉村 Vlog
使用案例: 紀錄片風格的生活 Vlog 影片。
Seedance 2.0 slice-of-life vlog, 15 seconds, 16:9. Preserve the same woman’s face, hairstyle, skin tone, and body proportions. She wears an oversized olive linen shirt, dusty burgundy wide-leg trousers, brown sandals, and small gold hoops. Set the video in an authentic Korean rural village with mossy walls, hanok roofs, ceramic jars, roosters, cooking smoke, and overgrown paths. Use a late-2000s flip-camera look: heavy handheld shake, imperfect reframing, autofocus hunting, exposure swings, rolling shutter, motion blur, faded muddy colors, digital noise, and compression artifacts. She walks, splashes water on her face, feeds a stray dog, sips from a tin cup, then waves as the recording cuts off. No posing, glamour, stabilization, music, or modern grading. Include birds, roosters, footsteps, wind, water, and village ambience.
此提示詞特意明確指定了視覺時代感、鏡頭瑕疵、服裝、環境、動作序列和聲音。這表明「寫實」並不總是意味著乾淨或精緻;當瑕疵本身就是風格的一部分時,期望的鏡頭語言也可以包含瑕疵。
範例 2:科幻探索發現鏡頭
使用案例: 電影級科幻敘事。
Create a cinematic sci-fi short with a lonely, contemplative tone that gradually shifts into quiet wonder. A damaged exploration robot moves through a desaturated alien landscape of dusty earth and grey rock under overcast daylight. Use one glowing blue accent in the robot’s chest. Begin with macro close-ups of scratched metal and slow mechanical movement, then track behind the robot as it discovers a tiny living plant inside a collapsed research station. Push in slowly while dust floats through the beam of light. Use 35mm cinematography, restrained camera movement, realistic surface texture, soft atmospheric haze, and a quiet electronic score. End on the robot reaching toward the plant. No comedy, no fast cuts, no extra characters, no flicker.
這裡的重要借鑑是情緒的推進。該提示詞不僅列出了物體,還解釋了鏡頭如何從孤獨轉向驚奇,並為模型提供了一個明確的結尾。
範例 3:美食廣告
使用案例: 產品廣告與美食內容。
Create a premium food commercial featuring a freshly grilled burger on a dark wooden table. Begin with a macro close-up of melted cheese and crisp lettuce, then slowly orbit around the burger as steam rises from the toasted bun. Warm side lighting creates soft highlights on the ingredients, with a shallow depth of field and a rich but natural color grade. Add subtle restaurant ambience and a gentle sizzle. End with a clean hero shot centered on the burger, leaving empty space on the right for a short CTA. Keep the burger shape and ingredient layers consistent. No extra burgers, distorted food, unreadable text, or sudden cuts.
此範例指定了最終構圖,而不是讓片段隨機結束。這在廣告中至關重要,因為剪輯時最後一幀通常需要容納標誌(Logo)、產品名稱或行動號召(CTA)。
範例 4:動作受控的產品鏡頭
使用案例: 科技或生活風格產品行銷。
Create a sleek cyberpunk product commercial featuring matte black wireless earbuds in an open charging case on a reflective metal surface. Use a slow orbital camera move while thin blue and violet light strips pass across the case. Macro close-up, shallow depth of field, crisp material texture, controlled reflections, and a dark futuristic color palette. Add a quiet electronic pulse and a soft mechanical click as the case opens. End with the earbuds centered in a clean hero composition. Keep the case shape, earbud position, and branding consistent. Avoid extra products, warped reflections, and invented text.
產品始終是核心。移動的光線增添了動感,但提示詞並未要求產品同時旋轉、打開、變形和飛行。
可直接複製的 AI 影片提示詞範本
請將這些範本作為起點。替換中括號內的欄位,並刪除任何不適用於你鏡頭的指令。
範本 1:電影級角色場景
Create a [duration] [aspect ratio] [visual style] featuring [subject description]. The scene takes place in [location] during [time of day and weather]. [Subject] [one primary action]. Use a [shot type] with [camera movement and speed]. Add [lighting, color palette, and texture]. Include [sound or dialogue] if needed. End with [final image]. Keep [identity, outfit, and important props] consistent. Avoid [specific failure modes].
範本 2:產品商業廣告
Create a [duration] commercial for [product]. Begin with [opening shot] that shows [material, texture, or feature]. Then [one product action or use case] with [camera movement]. Use [lighting, color, and visual style]. End with a clean hero composition of [product], leaving space for [logo or CTA]. Keep the product shape, color, label, and branding consistent. Avoid [extra objects, distorted packaging, or invented text].
範本 3:圖生影動態化
Animate the supplied image with [camera movement]. Make [specific subject or environmental element] move slowly and naturally. Add [secondary motion such as wind, light, steam, or water]. Keep [face, clothing, product shape, label, composition, and colors] unchanged. Use [style and lighting]. Duration: [duration]. Avoid [warping, flicker, extra objects, and unwanted text].
範本 4:社群 UGC 影片
Create a natural [duration] vertical UGC video featuring [creator] in [location]. 0–[x] seconds: [hook]. [x]–[y] seconds: [demonstration or transformation]. [y]–[end] seconds: [reaction and CTA]. Use phone-camera handheld movement, realistic lighting, natural speech, and authentic ambient sound. Keep [product, clothing, and creator identity] consistent. Avoid forced acting, studio polish, random subtitles, and label changes.
範本 5:動畫變形轉場
Create a [duration] [animation style] transformation. Begin with [starting object or scene]. Gradually transform it into [final object or scene] through [specific visible steps]. Keep the transformation centered and continuous. Use [camera movement], [texture], [lighting], and [sound]. End on [final pose, product, or logo]. Avoid abrupt cuts, random characters, flicker, and style changes.
常見 AI 影片提示詞錯誤與實用修正方法
錯誤 1:堆砌形容詞而非指導鏡頭
「美麗」、「史詩級」和「高品質」等詞彙並不能告訴模型要讓什麼動起來。請用關於景別、運動、光線和紋理的具體視覺決策來取代它們。
錯誤 2:要求多個不相關的動作
請將序列拆分為多個鏡頭。當一個 6 秒的片段只有一個明確的節拍(例如「女子轉向窗戶」)時,會比塞入整個晨間常規動作更容易控制。
錯誤 3:忽略鏡頭設定
如果鏡頭運作很重要,請具體說明。固定機位鏡頭可以是一種刻意的選擇,但對鏡頭隻字不提則會讓模型替你隨機決定。
錯誤 4:僅描述主體,未描述變化
「公園裡的一隻狗」描述的是單一畫面。「一隻黃金獵犬在濕漉漉的草地上奔跑,鏡頭在身側跟隨拍攝」描述的才是一支影片。
錯誤 5:使用模糊的負向提示詞
「不要弄得太糟」毫無用處。請指明你想避免的問題:「保持標籤清晰可讀且瓶身形狀不變」。某些模型對正向期望狀態的反應也更好,例如用「平穩穩定的鏡頭運動」代替「無鏡頭晃動」。請在你所使用的模型上測試措辭效果。
錯誤 6:期望提示詞文字控制所有技術設定
解析度、時長、長寬比、隨機種子(Seed)和相機控制項可能已在工具介面中提供。請盡可能使用這些介面設定,並讓文字提示詞專注於視覺方向。
如何修改生成失敗的影片
將第一次生成視為診斷過程。找出最重要的失敗點,然後只更改一個變數。
- 如果主體變形或走樣,請重複其視覺身分特徵並移除不必要的細節。
- 如果動作不明確,請將片段簡化為一個主要動詞。
- 如果鏡頭感覺平淡,請添加具體的運動方式和速度。
- 如果背景混亂,請移除次要物體並簡化場景。
- 如果產品變形,請添加連續性規則,並在支援時使用圖片參考。
- 如果氛圍不對,請調整光影和色彩描述,而不是重寫整個提示詞。
- 如果結尾不可用,請明確描述最終構圖。
一次只更改一個變數,能讓你更容易了解模型能可靠遵循哪些指令。保留最佳版本作為新的基礎提示詞,而不是每次嘗試後都從頭重寫。
多數 AI 影片提示詞指南忽略的要點
公式很有用,但可重複執行的工作流程遠比冗長的關鍵字清單更有價值。當你希望獲得更穩定的結果時,請採用以下實務做法:
- 對比展示失敗版本與修改後版本,讓調整之處一目了然。
- 分開描述主體運動、鏡頭運動和環境動態。
- 將一個提示詞視為一個鏡頭,然後在後製剪輯時將多個鏡頭連接起來。
- 在相關提示詞之間重複使用角色、服裝、產品和色彩細節。
- 讓提示詞契合用途:產品廣告需要穩定的包裝呈現,而低保真 Vlog 則可能需要刻意營造的手持瑕疵。
- 讓廣告和社群短片以可用的構圖結尾,而不是戛然而止。
- 建立簡要的提示詞日誌,記錄所用模型、設定、成功措辭以及修正過的錯誤。
這些實務做法讓提示詞更容易審視與重複使用。它們還能防止一個常見錯誤:在鏡頭存在過多互相衝突的指令時,反而添加更多文字。
初學者的簡易練習計畫
你不需要一開始就創作複雜的故事。先用簡短、易於評估的鏡頭來練習這個架構。
練習 1:主體與動作
使用相同的結構撰寫五個提示詞:
[Subject] performs [one visible action].
僅更改主體和動作。這有助於你觀察模型是否能理解動詞。
練習 2:加入場景與鏡頭
保持相同的動作,然後測試三個地點和三種鏡頭運動方式。比對哪些組合能產生最清晰的動態。
練習 3:加入微動態與連續性
添加一種環境動態,例如風、蒸汽、水流或飄散的塵埃。接著為臉部、服裝、產品或道具添加一條連續性規則。
練習 4:修改單一變數
生成同一個提示詞的兩個版本。僅更改鏡頭、光影或動作。記錄哪些方面獲得改善、哪些方面變得不穩定。
生成前的最終檢查清單
在消耗下一次算力生成前,請先問自己以下問題:
- 主要主體是否足夠具體以便識別?
- 提示詞是否包含一個明確的主要動作?
- 場景是否可見且具體?
- 鏡頭是否有明確的景別或運動指令?
- 光影和視覺風格是否具體而非泛泛之談?
- 是否已在需要的地方設定了時長與長寬比?
- 是否僅在必要時才加入音訊或對白?
- 是否指明了哪些內容必須保持一致?
- 片段的最後一刻是否具有實用的構圖?
- 如果生成失敗,你是否知道下一步該更改哪一個單一變數?
常見問題
AI 影片提示詞應該多長?
足以清楚描述鏡頭,同時又足夠精簡以保持指令聚焦即可。精簡的段落或結構化的句子組合,通常比一長串不相關的形容詞更容易修改。
一個 AI 影片提示詞應該包含多少個動作?
短片段請使用一個主要動作。如果主體必須完成多個主要動作,請將想法拆分為多個鏡頭,或先建立分鏡時間軸規劃。
AI 影片提示詞應該用英文撰寫嗎?
這取決於模型。許多工具支援多種語言,但最重要的因素是具體的名詞、可見的動詞、清晰的鏡頭指令和穩定的結構。請在你選擇的工具中測試能帶來最可預測結果的語言。
AI 影片生成需要負向提示詞嗎?
它們可以針對特定的失敗情況提供幫助,但效果因模型而異。建議先清楚描述期望的結果,然後在工具支援該指令時,再添加具體的限制條件(例如保持產品標籤不變或避免出現額外物體)。
我可以在每個 AI 影片工具中使用相同的提示詞嗎?
五維架構具有良好的通用性,但各個模型對鏡頭術語、音訊指令、時長和負向限制條件的理解可能有所不同。請將跨平台提示詞作為起點,並在測試後進行調整。
提示詞越長越好嗎?
不是。額外的細節只有在能闡明畫面上可見或對鏡頭重要的內容時才有幫助。如果提示詞同時要求過多的主體、動作、風格和鏡頭運動,指令之間可能會互相衝突。
結論
撰寫 AI 影片生成提示詞最可靠的方法,就是像導演撰寫簡短鏡頭摘要一樣思考。定義主體、一個明確的動作、場景、鏡頭以及視覺處理方式。接著僅添加專案實際需要的時長、格式、聲音和連續性規則。
從單一鏡頭開始,檢視結果,並一次只更改一個變數。清晰的視覺邏輯遠比一堆空泛的關鍵字更有用,而隨著每次生成累積的小型測試提示詞庫將會越來越具價值。



