影片片段與參考圖
先看工具接受哪些素材。Seedance 2.5 可使用文字、圖片、影片片段與音訊,Seedance-2.0 可組合最多九張圖片、三段影片、音訊與文字;Gemini Omni 和 Flux 3 API 也支援從既有影片開始。若你要維持角色外觀,AI Seedance 2.5、Seedance 2.5 與 Gemini Omni 都把參考素材列為控制方式,選擇時要對照自己手上的檔案類型。
84 個工具 · 2026年10月1日 更新
把既有影片改成另一個版本:輸入影片片段,再搭配文字、參考圖片或音訊,生成重繪場景、延長鏡頭、角色換臉或動作轉移的影片。你可以在這裡比較各工具支援的素材、片長、解析度、聲音與 API 串接方式,找到適合創作與製作流程的選擇。
先看工具接受哪些素材。Seedance 2.5 可使用文字、圖片、影片片段與音訊,Seedance-2.0 可組合最多九張圖片、三段影片、音訊與文字;Gemini Omni 和 Flux 3 API 也支援從既有影片開始。若你要維持角色外觀,AI Seedance 2.5、Seedance 2.5 與 Gemini Omni 都把參考素材列為控制方式,選擇時要對照自己手上的檔案類型。
片長和輸出規格會直接限制製作方式:Seedance 3.0、Seedance-2.5 與 AI Seedance 2.5 可做到最多 30 秒,Flux 3 API 最多 20 秒,Seedance-2.0 為 4–15 秒,Seedance 2.0 API 最多 15 秒。解析度也不同,Happy Horse API 提供 720p 或 1080p,Flux 3 API 為 1080p,Seedance 2.0 API標示原生 4K。若需要聲音,還要確認是否支援同步語音、環境音或音效。
不同工具解決的改片任務並不相同。Video Face Swap AI 讓你上傳短片與照片、裁切場景,並選擇單人或多人換臉;Seedance 2.5 提供場景延長,Seedance-2.5 有區域層級重繪,Gemini Omni 可用對話方式修改場景而不必重新開始。這類工具不是影片轉文字、摘要或單純轉檔;若只需要時間軸剪輯,也不屬於本分類。
若影片要接進既有服務,先看交付方式。Flux 3 API 透過單一 REST API 從提示、圖片或既有片段建立影片;Seedance 2.0 API 與 Happy Horse API 也提供 API 生成,後者另有 webhook 交付。偏好直接操作的人,可看 SparkVid 的瀏覽器內影片編輯與模型結果比較,或使用 Alav AI 在同一工作區編輯場景、生成圖片並調整輸出設定。
先依工作目標縮小範圍:要把靜態素材與文字組成短片,可比較 Seedance 3.0、Seedance-2.0 或 SparkVid;要改造現有鏡頭,優先查看支援影片輸入、場景延長或區域重繪的項目;要批次接入服務,則看 Flux 3 API、Seedance 2.0 API 與 Happy Horse API。頁面資料沒有列出各產品價格、配額或檔案匯出格式,實際選用前應再核對方案與整合需求。
從文字、圖片、音訊或影片建立影片,然後透過對話調整場景、角色、攝影機運動和聲音。
從文字、圖片、參考素材與關鍵幀創作電影感廣告和故事影片,同時保持角色與產品的辨識度。
透過描述動作、鏡頭運動和氛圍,讓靜態照片栩栩如生,為創意專案製作短影片。
透過文字、圖片、片段與音訊生成影片,並具備同步聲音、多鏡頭場景與目標編輯。
透過參考控制、場景延展、音效,以及最高 1080p 輸出,從文字、圖片、片段與音訊建立電影感影片。
從文字與多模態參考建立最長 30 秒的影片,並同步聲音、環境音與音效。
從文字、圖片或片段建立一致的影片,然後透過對話式編輯精修場景,無需重新開始。
從提示詞、圖片或參考資料建立影片,然後在同一個工作區中編輯場景、生成圖片並調整輸出設定。
透過上傳片段與照片、裁切場景,並選擇單一或多重替換,在短影片中替換臉孔。
透過文字、圖片與參考,結合同步音訊、3D 預覽與區域層級重繪編輯,建立完整的 30 秒影片。
從文字與圖片建立 HD 影片,同時掌控動作、比較模型輸出,並直接在瀏覽器中編輯素材。
從文字或圖片創作最長 30 秒的影片,透過參考素材保留角色細節,並可在不重拍的情況下編輯既有畫格。
結合最多九張圖片、三段影片、音訊與文字,透過精準素材參考建立 4–15 秒影片。
從提示詞與最多 9 張參考圖片生成 720p 或 1080p 影片,並附同步音訊與 webhook 傳送。
透過一個 REST API,從提示詞、圖片或現有片段建立最長 20 秒、含同步音訊的 1080p 影片。
透過單一 API,從文字、圖片、影片與音訊生成最長 15 秒的原生 4K 影片,並附同步聲音。
透過一個 REST API,利用同步音訊與最多 50 個多模態參考,生成最長 30 秒的電影感影片片段。
在引導運動、鏡頭方向、參考與場景連貫性的同時,從提示詞或圖片創作影片。
即時替您的網路攝影機換臉,在瀏覽器中預覽變化,並將虛擬攝影機輸出傳送到串流與會議應用程式。
只要用簡單英文描述相機、主體與環境的動作,就能把單張圖片變成會動的影片。
結合文字、圖片、影片和音訊,並同步立體聲音效,創作最長 15 秒、連貫一致的原生 2K 影片。
將提示詞、圖片和參考片段轉換為具有電影感且一致的影片,具備導演式攝影機運動與失敗渲染自動退款功能。
從文字、圖片、片段與音訊建立連貫的 AI 影片序列,同時導演鏡頭、攝影機運動、節奏與聲音。
多模態 AI 影片生成器,可產生 4–15 秒的 2K 片段與原生音訊,並支援以指點與變更指令進行編輯。
從文字、圖片、影片和音訊建立短影片,同時複製動作、運鏡、角色和聲音。
從文字、圖片、音訊或現有片段生成無浮水印的 4K 影片,並同步動作與聲音。
生成並編輯圖片,接著將參考轉換為具有原生音訊、多語言對話,以及最長 20 秒片段的影片。
在同一個網頁應用程式中,使用多種 AI 影片工作流程,從圖片、文字、參考或剪輯建立影片。
從提示詞、圖片或參考片段建立具有比例、時長與解析度控制的短篇電影感影片。
使用最多 50 個圖片、影片與音訊參考資料,建立 30 秒 4K AI 影片,打造一致的場景。
只要文字提示,幾秒鐘就能建立適合社群發佈的影片,AI 生成不需要任何剪輯技能。
從文字或照片建立社群影片,然後在同一個工作室中生成對應的圖片、音樂、人聲與音效。
透過將手勢、表情與全身動作從參考片段轉移過來,創建無浮水印的角色影片。
以文字或一張圖片生成具備原生音訊、可控動態與 4K 匯出的電影感片段。
Seedance 2.5 可將提示詞與參考資料轉換為具電影感的多鏡頭 AI 影片,並保持角色一致與相機控制。
一個多模態 AI 影片工作室,可從文字、圖片、音訊和參考片段創作電影級內容。
可將文字、圖片、參考與音訊輸入轉成電影感短片的 AI 影片生成器。
MiaDance 可將文字或照片轉換為適用於 TikTok、Reels 和 Shorts 的 AI 影片與圖片。
免費 AI 唇形同步生成器,可在幾秒內將照片或影片轉換成逼真的說話影片。
一款 AI 影片生成器,可將文字或圖片轉換為具備強烈動態品質的電影級短片。
基於瀏覽器的 AI 影片與圖片生成器,可將文字或圖片轉換為具電影感、高解析度的創意內容。
基於瀏覽器的 AI 影片生成器,能將提示詞與參考圖片轉換成電影感短片,並支援 HD 下載。
Kling AI Motion Control:從單張圖片和參考影片生成具電影感的全身角色動畫。
免費的 AI 影片產生器,輸出逼真人物畫面,無浮水印,並享有完整商業使用權。
以 AI 為動力的動作轉移,將參考影片的動作套用到靜態角色,產生逼真的動畫。
一款 AI 動作轉移工具,透過參考影片讓靜態圖片動起來,快速生成精準逐格、具電影感的結果。
Seedance 2 是一款免費的 AI 視頻生成器,能將文字與圖像轉換為 1080p/2K 多鏡頭視頻。
Seedance 是一個 AI 平台,可以從文字或圖片生成具有精準提示控制的電影級 1080p 影片。
整合 Sora 2、Veo 3、Kling 等 10 多種頂級模型的一體化 AI 影片與影像生成器。
WAN-2.6 是一款先進的 AI 影片生成器,支援文字、圖像和影片輸入。