ByteDance/seedance-v2.0-mini-reference-to-video
seedance-v2.0-mini-reference-to-video

使用 Seedance 2.0 Mini,通过图片、视频和音频生成参考素材引导的视频,支持可选声音、灵活时长和实惠的 ByteDance 输出。在多参考工作流中最多可分别添加 9 张图片、3 段视频和 3 段音频,并组合 1–12 个参考主体;单段视频或音频参考时长范围为 2–15 秒。

Reference to Video

Seedance 2.0 Mini 相关模型

Seedance 2.0 Mini Reference to Video
添加音频
从设备上传
mp3, wav
0/3 音频
上传图片
点击或拖拽上传
支持格式: jpg, png, webp
0/9 图片
添加视频
从设备上传
支持格式: mp4, webm, mov
0/3 视频
提示词
翻译
s
立即体验 AI 视频生成

README

Seedance V2.0 Mini Reference-to-Video API:经济实惠的多模态视频生成

Seedance V2.0 Mini Reference-to-Video 是字节跳动推出的一款高性价比模型,可根据图像、视频和音频参考素材生成视频。它将多模态引导与灵活的输出控制相结合,适合需要保持一致视觉方向、但不需要标准版 Seedance V2.0 模型所提供高分辨率输出的创作者和开发者。

Seedance V2.0 Mini Reference-to-Video 的主要功能

  • 多模态参考素材引导:可在单个请求中使用图像、视频和音频片段引导生成。
  • 灵活的参考素材输入:支持使用 1-9 张图像、最多 3 个视频和最多 3 个音频片段。提供至少一个参考视频时,可以不上传图像。
  • 基于参考素材的提示词:可在提示词中使用带编号的图像、视频和音频占位符,直接指定已上传的媒体素材。
  • 实用的输出分辨率:支持以 480p 或 720p 生成,适用于注重成本的制作流程。
  • 灵活的视频时长:可创建 4 到 15 秒的视频片段。
  • 多种宽高比:可选择 21:9、16:9、9:16、1:1、4:3 和 3:4。
  • 可选生成音效:默认启用音效,也可在需要无声结果时将其禁用。
  • 无 Seed 参数:Seedance V2.0 Mini 模型不支持 Seed 控制。

如何使用 Seedance V2.0 Mini Reference-to-Video

  1. 编写提示词:描述预期的场景、动作、镜头表现、时间安排以及所提供参考素材之间的关系。
  2. 添加视觉参考素材:上传至少一张图像或一个视频。你可以提供 1-9 张图像和 0-3 个视频;只有在提供参考视频时,图像列表才可以为空。
  3. 添加可选的音频参考素材:当你希望声音、节奏、语音或时间安排影响输出时,最多可上传 3 个音频片段。
  4. 在提示词中引用媒体素材:通过 API 文档中展示的 API 占位符语法,使用图像 1、视频 1 和音频 1 等带编号的占位符。
  5. 配置输出:选择 480p 或 720p、4-15 秒的时长,以及六种受支持宽高比中的一种。
  6. 选择是否生成音效:保留默认启用的音效,或将其禁用以生成无声视频。
  7. 提交请求:向视频任务 API 发送请求,并使用返回的任务标识符查询生成状态。

上传一个或多个参考视频时,生成费用会统一翻倍一次。无论上传的参考视频数量或时长如何,倍数都相同。

Seedance V2.0 Mini Reference-to-Video 的最佳使用场景

  • 角色和产品一致性:使用参考图像或视频片段,在新场景中保持可识别且一致的视觉方向。
  • 社交媒体视频:为常见的发布格式制作竖屏、方形、横屏或电影感视频片段。
  • 动作和镜头引导:使用参考视频传达动作、节奏、构图或镜头表现。
  • 音频引导创作:让生成的画面与提供的音乐、语音、音效或时间提示保持一致。
  • 快速创意探索:在投入更高分辨率制作之前,先以 480p 或 720p 测试多模态创意。

注意:每个请求必须包含至少一个图像或视频参考素材。上传的每个视频和音频片段时长必须介于 2 到 15 秒之间。不支持仅使用音频的请求。

Seedance V2.0 Mini Reference-to-Video 与竞品对比

  • 与 Seedance V2.0 Reference-to-Video 相比:两者均支持图像、视频和音频引导,而 Mini 模型侧重经济实惠的 480p 和 720p 输出,不提供标准模型的更高分辨率选项。
  • 与 Wan 2.7 Reference-to-Video 相比:Seedance V2.0 Mini 支持独立的图像、视频和音频参考素材数组以及生成音效,但不提供 Seed 控制。
  • 与 Vidu Q3 Reference-to-Video 相比:Seedance V2.0 Mini 可接收视频和音频输入,将参考素材引导从图像扩展到更多媒体类型。
  • 与 Seedance V2.0 Mini Text-to-Video 相比:Text-to-Video 仅根据提示词生成,而 Reference-to-Video 增加了图像、视频和可选音频输入,用于多模态引导。
  • 与 Runway 的视频模型相比:Seedance V2.0 Mini 提供直接的 Reference-to-Video API,适合希望在单个请求中使用图像、视频和音频引导的团队。

使用 Flaq AI 探索多种创意工具

在浏览器中探索多种 AI 创作工具,用于快速图像和视频工作流,然后通过 Flaq AI 可用于生产的模型 API 扩展成功创意。Flaq AI 为所有模型提供统一 API 层,让你的工作流更容易使用和扩展。

更多关于 Seedance 2.0 Mini Reference to Video 的文章