ByteDance/seedance-v2.0-mini-reference-to-video
seedance-v2.0-mini-reference-to-video

使用 Seedance 2.0 Mini,透過圖片、影片和音訊生成參考素材引導的影片,支援可選聲音、彈性時長和實惠的 ByteDance 輸出。在多參考工作流程中最多可分別加入 9 張圖片、3 段影片和 3 段音訊,並組合 1–12 個參考主體;單段影片或音訊參考時長範圍為 2–15 秒。

Reference to Video

Seedance 2.0 Mini 相關模型

Seedance 2.0 Mini Reference to Video
新增音訊
從裝置上傳
mp3, wav
0/3 音訊
上傳圖片
點擊或拖曳以上傳
支援格式: jpg, png, webp
0/9 圖片
新增影片
從裝置上傳
支援格式: mp4, webm, mov
0/3 影片
提示詞
翻譯
s
立即體驗 AI 影片生成器

README

Seedance V2.0 Mini Reference-to-Video API:經濟實惠的多模態影片生成

Seedance V2.0 Mini Reference-to-Video 是字節跳動推出的一款高性價比模型,可根據圖像、影片和音訊參考素材生成影片。它將多模態引導與靈活的輸出控制相結合,適合需要保持一致視覺方向、但不需要標準版 Seedance V2.0 模型所提供高解析度輸出的創作者和開發者。

Seedance V2.0 Mini Reference-to-Video 的主要功能

  • 多模態參考素材引導:可在單一請求中使用圖像、影片和音訊片段引導生成。
  • 靈活的參考素材輸入:支援使用 1-9 張圖像、最多 3 個影片和最多 3 個音訊片段。提供至少一個參考影片時,可以不必上傳圖像。
  • 基於參考素材的提示詞:可在提示詞中使用帶編號的圖像、影片和音訊預留位置,直接指定已上傳的媒體素材。
  • 實用的輸出解析度:支援以 480p 或 720p 生成,適用於注重成本的製作流程。
  • 靈活的影片時長:可建立 4 到 15 秒的影片片段。
  • 多種寬高比:可選擇 21:9、16:9、9:16、1:1、4:3 和 3:4。
  • 可選生成音效:預設啟用音效,也可在需要無聲結果時將其停用。
  • 無 Seed 參數:Seedance V2.0 Mini 模型不支援 Seed 控制。

如何使用 Seedance V2.0 Mini Reference-to-Video

  1. 編寫提示詞:描述預期的場景、動作、鏡頭表現、時間安排以及所提供參考素材之間的關係。
  2. 新增視覺參考素材:上傳至少一張圖像或一個影片。你可以提供 1-9 張圖像和 0-3 個影片;只有在提供參考影片時,圖像清單才可以為空。
  3. 新增可選的音訊參考素材:當你希望聲音、節奏、語音或時間安排影響輸出時,最多可上傳 3 個音訊片段。
  4. 在提示詞中引用媒體素材:透過 API 文件中展示的 API 預留位置語法,使用圖像 1、影片 1 和音訊 1 等帶編號的預留位置。
  5. 設定輸出:選擇 480p 或 720p、4-15 秒的時長,以及六種支援寬高比中的一種。
  6. 選擇是否生成音效:保留預設啟用的音效,或將其停用以生成無聲影片。
  7. 提交請求:向影片任務 API 傳送請求,並使用傳回的任務識別碼查詢生成狀態。

上傳一個或多個參考影片時,生成費用會統一加倍一次。無論上傳的參考影片數量或時長如何,倍數都相同。

Seedance V2.0 Mini Reference-to-Video 的最佳使用場景

  • 角色和產品一致性:使用參考圖像或影片片段,在新場景中保持可辨識且一致的視覺方向。
  • 社群媒體影片:為常見的發佈格式製作直向、方形、橫向或電影感影片片段。
  • 動作和鏡頭引導:使用參考影片傳達動作、節奏、構圖或鏡頭表現。
  • 音訊引導創作:讓生成的畫面與提供的音樂、語音、音效或時間提示保持一致。
  • 快速創意探索:在投入更高解析度製作之前,先以 480p 或 720p 測試多模態創意。

注意:每個請求必須包含至少一個圖像或影片參考素材。上傳的每個影片和音訊片段時長必須介於 2 到 15 秒之間。不支援僅使用音訊的請求。

Seedance V2.0 Mini Reference-to-Video 與競品比較

  • 與 Seedance V2.0 Reference-to-Video 相比:兩者均支援圖像、影片和音訊引導,而 Mini 模型著重經濟實惠的 480p 和 720p 輸出,不提供標準模型的更高解析度選項。
  • 與 Wan 2.7 Reference-to-Video 相比:Seedance V2.0 Mini 支援獨立的圖像、影片和音訊參考素材陣列以及生成音效,但不提供 Seed 控制。
  • 與 Vidu Q3 Reference-to-Video 相比:Seedance V2.0 Mini 可接收影片和音訊輸入,將參考素材引導從圖像擴展到更多媒體類型。
  • 與 Seedance V2.0 Mini Text-to-Video 相比:Text-to-Video 僅根據提示詞生成,而 Reference-to-Video 增加了圖像、影片和可選音訊輸入,用於多模態引導。
  • 與 Runway 的影片模型相比:Seedance V2.0 Mini 提供直接的 Reference-to-Video API,適合希望在單一請求中使用圖像、影片和音訊引導的團隊。

使用 Flaq AI 探索多種創意工具

在瀏覽器中探索多種 AI 創作工具,快速完成圖片與影片工作流程,然後透過 Flaq AI 的生產級模型 API 擴展成功想法。Flaq AI 為所有模型提供統一 API 層,讓你的工作流程更容易使用和擴展。