Cotor AI

Cotor AI

使用與 Cotor 全系列工具一致的電影級工作流程,輕鬆創建、預覽並分享 AI 影片內容。

  • 使用 Cotor AI 工具將你的靈感快速轉成可分享的影片內容。
  • 支援文生影片、圖片轉影片與多模型創作流程,幾分鐘內完成成片。
  • 適合教學實踐、靈感驗證、社群媒體內容製作與廣告素材產出。
  • 借助 Cotor AI 的先進技術,輕鬆創作電影級高品質短片。
如何利用圖片轉視頻提示製作女孩跳舞視頻
cate1July 24, 2026

如何利用圖片轉視頻提示製作女孩跳舞視頻

將一張照片轉換為逼真的舞蹈影片,主要在於給予人工智慧足夠的指引,但又不能過度干預。只要輸入「讓她跳舞」,模型仍需自行猜測編舞、節奏、身體動作以及攝影機的運作方式。這正是笨拙動作與意外結果經常出現之處。

透過〈圖片轉影片〉功能,通常沒必要再費心描述人物的細節——因為源頭照片已經完成了這項工作。更實用的提示語則會告訴模型哪些地方應該改變:無論是輕鬆自在的律動、俐落的K-pop編舞、TikTok風格的表演,或是更緩慢且具電影感的動作。以下範例旨在供複製與調整,但更重要的是,它們能說明當首次生成的結果不理想時,究竟哪些細節才值得修改。


最佳影像轉影片女孩跳舞提示

選擇合適的提示,不僅取決於照片本身,還取決於你想創建的舞蹈風格。如果你不確定從何入手,我們為不同舞蹈風格和影像類型準備了數個可直接使用的提示。

自然舞

「輕柔地進入一場放鬆的舞蹈,以柔和的左右步法、微妙的臀部擺動、鬆散的手臂動作,以及輕盈的肩部律動來展現。保持節奏自然,讓全身在畫面中平衡協調。」

TikTok風舞

「打造一段充滿活力、正面朝向的TikTok風格舞步,搭配快速的手勢、肩膀彈跳、簡單的側步,以及與節拍完美契合的清晰動作。讓她保持居中,並與鏡頭保持互動。」

K-Pop舞

「她以俐落的動作演繹精心設計的K-Pop風格編舞:手臂擊打乾淨利落、身體分離動作乾淨俐落、側步精準到位,並自信地做出各種姿勢變化。每個動作之間過渡流暢,節奏充滿活力,宛如舞台表演般到位。」

嘻哈舞

「以輕鬆自在的嘻哈節奏賦予她生命:膝蓋輕微彈跳、自然的重心轉移、肩膀彈跳、順滑的身體滾動,以及有節奏感的腳步動作。整個動作感覺輕鬆、接地穩固且充滿自信,而非急促慌亂。」

電影感舞

「她以緩慢的現代舞步移動,手臂舒展延長、溫柔轉身、輕柔步伐,並在動作之間穿插短暫的靜止時刻。保持畫面平靜,讓演出充滿表現力與電影感。」

如何撰寫更好的AI舞蹈影片提示詞

為〈影像轉影片〉撰寫提示詞,與為〈文字轉影片〉撰寫提示詞略有不同。你已經眼前有真人、服裝、姿勢和場景,因此通常無需再詳細描述它們。把這些字句留給影像無法呈現的部分:動作。

對於大多數舞蹈片段,以下四點最重要:

舞蹈風格 → 身體動作 → 動作強度 → 相機

只有當情緒或視覺風格能改變你真正想要的結果時,才加入它們。

以動作描述舞蹈

風格名稱為模特兒提供了方向,但動作才能讓這個方向變得有用。

「表演街舞」雖然易懂,卻仍顯寬泛。

「採用輕鬆的彈跳、肩部抖動、流暢的身體滾動,以及節奏感十足的側步」則為模特兒提供了可操作的具體動作。

同樣的道理也適用於其他風格。K-pop可能使用俐落的手臂擊打和乾淨的姿勢變化;較柔和的現代舞則可能運用大範圍的伸展和緩慢的轉身。

你不必規劃完整的舞步。對於短片來說,幾種搭配得宜的動作通常就夠了。一旦提示詞開始將跳躍、旋轉、地板動作、快速腳步和手勢混搭在一起,清晰度就會迅速下降。

讓動作與照片相匹配

在加入編舞之前,先看看原始照片實際給了你什麼。

一張清晰的全身照為步伐和轉身留下了更多空間。如果是半身人像,則更適合以肩膀、手部、頭部動作及上半身節奏來發揮。隱藏的肢體、交叉的姿勢或複雜的服飾也是讓第一個動作保持簡單的好理由。

把照片想像成影片的第一幀。模特兒越少需要立即即興創作,動作就越容易保持視覺上的連貫性。

分別控制能量與相機

像「溫柔」、「控制」、「輕快」或「高能量」這樣的詞語有助於設定動作的幅度和速度。保持這個方向一致——一段緩慢優雅的舞步不該在同一句話中突然要求爆發性的編舞。

相機的移動則是另一個選擇。對大多數舞蹈世代來說,穩定的全身或中廣角畫面都是合適的起始點。緩慢的推近可以為電影般的演出增添戲劇效果,而正面鏡頭則適合注重手勢的社交舞蹈。

我建議第一次嘗試時避免讓所有元素同時運動。快速的編舞加上環繞的相機,再加上戲劇化的變焦,會讓模特兒同時面對多項動作挑戰。先讓舞蹈順利完成,如果片段需要,再逐步增加相機的野心。

一個簡單的人工智慧舞蹈提示公式

當你不太確定該寫什麼時,從這裡開始:

[舞蹈風格] + [2~4個可見動作] + [動作強度] + [相機/構圖]

例如:

「表演受K-pop啟發的編舞,包括俐落的手臂擊打、控制的側步,以及乾淨的姿勢變化。保持動作輕快精準,並以穩定的全身畫面呈現。」

若想更自然一點:

「進入一種放鬆的舞蹈,以輕柔的側步、鬆弛的手臂擺動,以及微妙的肩部律動來表現。保持動作輕鬆自然,並以穩定的全身鏡頭拍攝。」

注意,這裡缺少的是對人物、髮型、服裝或背景的長篇描述。除非你想讓這些元素有所變化,否則原始照片已經處理好了它們。

思考人工智慧舞蹈提示詞最有效的方式,是把它視為對表演者的指示,而非〈影像生成器〉的描述。先告訴模特兒身體應該怎麼做。其他一切皆為次要。

壞與好的AI舞蹈提示

一個薄弱的舞蹈提示並不總是太短。有時它很長,描述得很詳細,卻仍然給模型極少有用的指導。改善它的最快方法,就是找出最易讓人猜測的部分。

過於模糊

薄弱:
「讓她跳舞。」

問題不在於長度,而在於「跳舞」這個詞沒有任何編舞內容。

較好:
「以輕鬆的流行舞步移動,配合溫柔的側步、鬆弛的手臂擺動,以及微妙的肩部律動。」

現在,模型有了可見的動作可以發揮。如果第一個結果需要,你後續再加入能量或攝影機方向也來得及。

重複照片已有的內容

薄弱:
「一位美麗的女士,留著長髮,穿著時尚洋裝,在現代都市中優雅地跳舞。」

大部分這段提示所描述的資訊,其實早已出現在源圖像裡了。

較好:
「以緩慢轉身、柔和的手臂伸展和控制良好的步伐,進行一場優雅的舞蹈,同時保持她原本的外觀一致。」

修訂後,更多篇幅用在變化的部分,而不是重新描述第一幀畫面。

編舞過於繁雜

薄弱:
「表演一段充滿活力的K-pop舞蹈,包含快速旋轉、跳躍、複雜的腳步、身體滾動、俐落的姿勢,以及迅速的轉換。」

每條指令本身都合理,但加在一起,卻讓模型在短短幾秒內要處理太多身體狀態。

較好:
「表演一段充滿活力、靈感來自K-pop的編舞,手臂動作乾淨利落,側步精準,姿勢轉換乾淨俐落。」

如果這個序列整體表現良好,可以在下一輪再增加一個動作。比起所有動作同時開始後才去修正,先建立穩定的動作更容易在此基礎上添加更多編舞。

讓攝影機與舞蹈互相對抗

薄弱:
「隨著攝影機繞著她轉動,快速拉近鏡頭、拉遠,並改變角度,她要精力充沛地跳舞。」

這裡,表演者和攝影機都在爭奪動作的主導權。

較好:
「在穩定的中景畫面中,以節奏感十足的步伐和肩部律動,表演一段充滿活力的嘻哈節奏。」

簡單的畫面有助於判斷舞蹈本身是否順暢。攝影機的移動可以延後再考慮。

同樣的道理適用於大多數AI舞蹈提示:當結果接近正確卻仍顯得不對勁時,應先修正最薄弱的指令,而非一味增加更多指令。如果動作模糊,就明確化動作;如果編舞不穩定,就簡化它;如果取景令人分心,就讓攝影機放輕鬆些。小小的修正通常能提供比全面改寫更多的線索。

如何用AI讓照片跳舞

一旦你有了提示,將照片轉換成舞蹈影片,主要就是匹配三樣東西:源圖、動作,以及你想要創建的格式。你不需要複雜的工作流程,但在點擊生成之前稍作規劃,通常能省下好幾次無謂的嘗試。

1. 選擇一張能動起來的照片

把圖片當作影片的第一幀。

對於全身跳舞,請尋找一個清晰的姿勢,讓手臂和腿都看得見,且不會被家具、道具或其他人嚴重遮擋。一般的直立姿勢通常能為模特兒提供更多空間,以便做出可信的步法與轉身。

肖像照也可以用;只是需要不同的動作設計。如果圖片到腰部為止,就應以肩膀、手部、頭部移動及上半身節奏來規劃,而不是要求依賴明顯腳步的編舞。

2. 讓舞蹈與圖片相匹配

在撰寫或選擇提示之前,先決定你真正想要什麼樣的動作。

一張隨意的肖像照可能只需要輕鬆自在的律動。一張乾淨俐落的全身時尚照片則能搭配更銳利、受K-pop啟發的編舞。而一幅戲劇性的圖片,或許用較緩慢的現代舞會比快速的社交舞更適合。

對於第一代作品,保持想法簡單易懂。一段短小且搭配得宜的動作序列,比整段編舞塞進短短幾秒內,更能清楚地告訴你這張圖片能承載多少內容。

3. 設定格式並生成

上傳圖片,加入你的舞蹈提示,並選擇工具提供的基本輸出設定。

想想看這段影片最終會放在哪裡。垂直構圖很適合TikTok、Reels和Shorts,而較寬的構圖則能為更大的舞蹈動作提供更多空間。確保第一段影片夠短,方便你輕易判斷動作是否順暢。

接著直接生成影片,別過度添加額外的修改。如果你已經要求了相當程度的編舞,那麼在第一次嘗試時就加上激烈的鏡頭移動,其實沒有太大必要。

4. 檢視後,只改動一樣東西

別把第一代作品當作最終成品。先完整觀看一次,確認整體舞蹈是否合適;再仔細檢視一遍,確保一致性。

動作是否符合你的要求?畫面構圖是否穩定?主角看起來還像原照片裡的人嗎?

如果結果接近預期,就別急著全面重寫。只需修改指令中最薄弱的部分,然後再次生成。降低動作強度、明確某個動作、簡化編舞,或者調整畫面構圖——但最好別一次性全改四項。

這樣每次嘗試都能有所收穫。比起猜測哪個改變起了作用,你可以清楚看到模型對單一特定調整的反應,並以此為基礎逐步改善。

如何解決常見的AI舞蹈影片問題

當AI舞蹈影片出現問題時,最快的解決方法通常並不是增加提示長度。首先應仔細檢視究竟是什麼出了問題。舞步僵硬、臉部變形、手部斷裂以及背景不穩,這些都是不同的問題,因此不該用同一套解決方案來處理。

先修好動作,再添加更多動作

如果舞者看起來動作僵硬,單純增加「更多活力」往往無法真正解決問題。

相反,請為模型提供更明確的身體動作:

「使用輕柔的側步、鬆弛的手臂擺動、微妙的肩部動作,以及輕盈的節奏跳躍。」

如果隨著編舞變得更複雜,身體開始崩解,那就反其道而行之。將快速旋轉改為可控的轉身,取消跳躍動作,或者將多個動作簡化為兩三個即可。

通常,一個簡單且自然流暢的序列,會比模型無法完整呈現的複雜編舞更好看。

當臉部、手部或身體開始變形時

大幅度的姿勢變化會讓一致性更難維持,因為模型必須從一幀到下一幀重新建構人物的更多部分。

首先,減少導致問題的動作。例如,快速的手勢可以改為幅度更大的手臂動作,複雜的腳步也可以改為簡單的側步。

你還可以告訴模型哪些部分應該保持穩定:

「在整個動作過程中,保持原始的臉部外觀、髮型、服裝和身體比例一致。」

此外,還有一個臨界點:當提示詞不再是主要問題時。如果幾個不同的提示都導致同樣的手部斷裂、腿部隱藏或身體部位不穩,那就回頭看看原始照片吧。裁剪過的肢體、交叉的姿勢,或是被衣物與物件遮掩的身體部位,都會讓模型可參考的視覺資訊減少。

當場景開始崩壞時,讓相機保持平穩

舞者可能能完美地完成動作,但畫面其他部分卻開始變得不穩定。

當這種情況發生時,在改變編舞之前,先讓相機簡單一點:

「保持相機穩定,並讓全身居中於畫面。」

一旦動作能夠順利進行,你就可以嘗試緩慢推近鏡頭,或是其他較為克制的攝影機移動方式。如果同時引入快速編舞與激烈攝影機運動,後者會更難判斷效果。

是否該使用負面提示?

如果你的影片工具提供了負面提示欄位,就專門針對那些不斷出現的特定瑕疵來使用,而不是把所有你能想到的缺陷都填進去。

一個實用的起始點是:

「扭曲的手、多餘的肢體、變形的臉部、扭曲的身體、不穩定的背景」

只保留那些與你實際看到的問題有關的詞彙。

如果沒有負面提示選項,那就直接把重要的限制條件放入主指令中:

「保持臉部一致,維持自然的身體比例,並確保背景穩定。」

負面提示確實有助於解決一些瑕疵,但它們無法挽救本質上過於複雜的編舞。當身體動作崩解時,先從簡化動作著手;當畫面崩壞時,則要讓相機保持平穩;如果同樣的錯誤在多次調整提示後依然存在,那就直接檢視原始影像吧。


AI 舞蹈提示,適用於 TikTok、Reels 和 Shorts

一場看起來很優美的舞蹈,並不總是能成為一段出色的短影片。對於TikTok、Reels和Shorts而言,動作必須能在手機螢幕上迅速呈現出來。請以9:16的垂直畫面為起點,確保主題易於跟隨,並為整段舞步設計一個清晰的視覺亮點。

這個亮點可以很簡單:例如節奏一到就來個甩肩彈跳、指點與擺姿勢的序列、從靜止突然轉為動態,或是最後一個強烈的定格姿勢。你不需要更複雜的編舞——你需要的是觀眾幾乎立刻就能理解的動作。

針對社交風格的舞蹈:

「先以一個簡短的靜止姿勢面對鏡頭,接著進入輕快的舞蹈,配合兩次節奏同步的手勢、一次甩肩彈跳,以及簡單的側步。保持舞者在垂直畫面的中央位置,最後以一個乾淨且自信的姿勢收尾。」

針對更精緻的表演:

「以俐落的臂部擊打、準確的側步,以及與節奏同步的乾淨姿勢變化,演出受K-pop啟發的編舞。保持動作正面朝向,在9:16的全身畫面中清晰可見,最後以一個有力的定格姿勢結束。」

請注意,這些提示不僅描述了舞蹈風格,還為影片提供了開頭、易於理解的中段,以及可作為剪輯或循環播放的結尾。

通常來說,音訊最好作為最終社交剪輯的一部分來處理,除非你的影片模板直接支援聲音功能。選擇一首節奏與你所創作的動作相匹配的音樂,而不是試圖用後製音樂來挽救原本笨拙的舞蹈。

一個簡單的測試方法是:先不放音訊觀看一遍影片。如果主要動作和亮點依然清晰可見,那麼這段編舞大概就足以應付短影片內容了。之後再透過音樂、字幕、剪輯及符合潮流的特效處理,就能為影片增添更多層次,而無需讓生成提示包辦一切。

關於影像轉影片女孩跳舞提示的常見問題

什麼樣的圖像轉影片舞蹈提示才算好?

一個有用的提示會告訴模型人物應該做什麼,而不是用大部分文字去描述已經看得見的內容。

簡單的結構是:

舞蹈風格+2~4個可見動作+動作強度+構圖

例如:

「以輕鬆的流行舞姿表演,搭配溫柔的側步、鬆弛的手臂擺動和微妙的肩部律動。保持全身穩定、自然的動作,並以完整畫面呈現。」

提示不需要很長,重點在於讓動作容易被理解。

我需要在提示中再次描述人物嗎?

通常不需要。

在圖像轉影片的情境下,源照片已經提供了人物的臉部、髮型、服裝、姿勢和背景。如果再重複這些細節,反而會浪費提示空間,而這些空間其實可以更有效地用來描述動作。

只有當你想保留或改變某些特定細節時,才需要描述外觀——例如:「保持原有的服裝和臉部外觀一致。」

我需要全身照才能讓人跳舞嗎?

當舞蹈依賴腳步、轉身或較大範圍的身體動作時,全身照會很有幫助,但並非每個片段都必須使用全身照。

半身像則很適合搭配手勢、肩部動作、頭部移動以及上半身的律動。

更好的原則是根據影像實際呈現的內容來調整編舞。如果腳部不在畫面內,就不要把詳細的腳步動作設定為提示的主要部分。

我可以對不同的照片使用相同的舞蹈提示嗎?

你可以以同一個提示作為起始點,但可能需要稍作調整。

清晰的站姿人像通常能很好地表現側步和轉身,而坐姿或四肢交叉或隱藏的照片則可能需要較小幅度的動作。裁剪過的人像通常效果更好,因為編舞會集中在腰部以上的位置。

比起為每張圖片固定使用同一個提示,不如保持舞蹈風格,並根據姿勢與構圖調整動作。

一個AI舞蹈提示應該包含多少個動作?

對於短暫的圖像轉影片片段,建議從幾個相容的動作開始,而非整套完整的編舞。

通常兩到四個清晰明確的動作就足以建立整個編舞:

「肩膀彈跳、兩次側步、手臂掃動、最後定格」

如果這個順序可行,可以在下一輪增加更多複雜性。如果一開始就列出十種不同的動作,反而會難以判斷哪個指令導致了結果崩壞。

我能用AI讓任何人的照片跳舞嗎?

請使用你有權進行動畫處理的照片,尤其是當主題是真人時。

取得同意很重要,因為圖像轉影片工具能夠創造出從未發生過的真實動作。若要用於公開、宣傳或商業用途,也務必清楚說明這段看起來很真實的舞蹈片段究竟是由AI生成的。

技術流程可能只需要一張照片和一個提示,但負責的使用方式,首先要確保你本身就有權利使用這張影像。