Docs / 模型能力边界
模型能力与参数边界
RelayDance 上所有视频模型都用同一种请求形状调用(model、prompt、seconds、image、metadata),但模型 ID 背后的各个系列能接受的输入差别很大。本页就是契约: 逐个系列写清哪些字段会生效、哪些原样透传、哪些会被静默忽略、哪些会让请求在计费前直接失败。凡是没有列为"支持"的字段,请默认它不起作用。
#能力矩阵
| 系列 | 时长 | 分辨率 | 宽高比 | 音频输出 | 计费 |
|---|---|---|---|---|---|
Seedance 2.5 | 4 到 30 秒,可省略由模型自选 | 480p / 720p,由 SKU 锁定 | 16:9、9:16、1:1、4:3、3:4、21:9、adaptive | 可选(generate_audio) | 按 token,按实际产出结算 |
Seedance 2.0 | 5 到 15 秒 | 480p / 720p / 1080p / 4K,由 SKU 锁定 | 与 2.5 相同 | 可选(generate_audio);1.5 Pro 拆成含音频 / 无声两个 SKU | 按 token,按实际产出结算 |
Kling | 只有 5 或 10 秒 | 720p(标准)或 1080p(专业),由 SKU 锁定 | 文生视频 16:9、9:16、1:1;有图时跟随图片 | 无 | 按秒,提交时一次性扣费 |
MiniMax H3 | 4 到 15 秒(整数) | 768P 或 2K,由 SKU 锁定 | 文生视频必填;adaptive 只在有参考图时可用 | 始终生成(原生立体声) | 按秒 |
Grok Video | 6、8、10、12 或 15 秒 | 720p | aspect_ratio 必填: 16:9、9:16 或 1:1 | 无 | 按秒,提交时一次性扣费 |
HappyHorse | 整数秒,默认 5 | 模型默认 | 模型默认 | 无 | 按秒,提交时一次性扣费 |
| 系列 | 首帧 | 尾帧 | 参考图 | 参考视频 | 参考音频 |
|---|---|---|---|---|---|
Seedance 2.5 | 支持 | 支持 | 最多 30 张,用 @imageN 引用 | 最多 10 段 | 最多 10 段,允许纯音频参考 |
Seedance 2.0 | 支持 | 支持 | 最多 9 张,用 @imageN 引用 | 支持 | 支持,须与图或视频一起提供 |
Kling | 支持(仅一张) | 可选 | 无(参考图会被当作首帧) | 不支持,直接拒绝 | 不支持,直接拒绝 |
MiniMax H3 | 无 | 无 | 一张 | 无 | 无 |
Grok Video | 支持(必填,仅一张) | 无 | 无 | 无 | 无 |
HappyHorse | i2v: 一张图 | 无 | r2v: 一张图 | video-edit: 源视频放在 image | 无 |
metadata.resolution 会被忽略,低价 SKU 不可能产出高价分辨率);失败的任务一律不计费;结果 url 是临时下载链接,请及时下载而不要长期保存该 URL。#Seedance 2.5
模型 ID: doubao-seedance-2-5-720p、doubao-seedance-2-5-480p。能力最全的系列: 片段最长、参考素材最多,也是唯一能在一次请求里同时使用角色参考图和动作参考视频的系列。
生效字段
| 字段 | 取值 | 说明 |
|---|---|---|
seconds | "4" 到 "30",或省略 | 省略(或传 "-1")时由模型自选,最长 30 秒。预扣按最大时长冻结,最终按实际产出扣费。 |
metadata.ratio | 16:9、9:16、1:1、4:3、3:4、21:9、adaptive | adaptive 跟随第一份参考素材。首尾帧模式、视频续写和视频编辑必须用 adaptive。 |
metadata.generate_audio | true | false | 有无音频 token 单价相同 |
metadata.seed | 整数 | 透传 |
metadata.camera_fixed | true | false | 透传 |
metadata.watermark | true | false | 透传 |
metadata.output_format | "mp4" | "mov" | mov 仅 Seedance 2.5 支持(H.264 + yuv444p + PCM),其他系列一律拒绝 |
metadata.callback_url | URL | 完成时回调 |
metadata.content[] | 带 role 的 image_url / video_url / audio_url 条目 | 最多 50 条: 30 张图、10 段视频、10 段音频 |
参考素材的 role
| 条目 | role | 含义 |
|---|---|---|
image_url | first_frame | 片段从这张图开始 |
image_url | last_frame | 片段以这张图结束 |
image_url | reference_image | 身份或风格参考,在提示词里按 content 顺序用 @image1 到 @imageN 引用 |
video_url | reference_video | 动作或运镜参考;视频输入按视频输入 token 单价计费 |
audio_url | reference_audio | 声音参考;2.5 允许只给音频参考 |
ratio: "adaptive"(编辑还须省略 seconds);普通参考生视频的提示词请避开这类措辞。提示词点名具体歌曲或歌手时,音轨可能过不了输出审核,该失败不计费。{
"model": "doubao-seedance-2-5-720p",
"prompt": "@image1 rises onto tiptoes, holds for a beat, then lowers the heels, matching the motion of the reference video",
"seconds": "5",
"metadata": {
"ratio": "adaptive",
"generate_audio": false,
"content": [
{ "type": "image_url", "role": "reference_image", "image_url": { "url": "https://your-cdn.example.com/character.png" } },
{ "type": "video_url", "role": "reference_video", "video_url": { "url": "https://your-cdn.example.com/motion.mp4" } }
]
}
}#Seedance 2.0
模型 ID: doubao-seedance-2-0-480p、doubao-seedance-2-0-720p、doubao-seedance-2-0-1080p、doubao-seedance-2-0-4k、doubao-seedance-2-0-fast-260128(720p,更快)、doubao-seedance-2-0-mini-480p、doubao-seedance-2-0-mini-720p,以及 seedance-1-5-pro-with-audio 与 seedance-1-5-pro-no-audio。请求形状和 metadata 字段与 2.5 相同,只是限制更紧。
| 字段 | 取值 | 说明 |
|---|---|---|
seconds | "5" 到 "15" | 省略时预扣按 15 秒冻结 |
metadata.ratio | 与 2.5 相同,含 adaptive | 首尾帧模式必须 adaptive |
metadata.generate_audio | true | false | 2.0 上免费;1.5 Pro 由 SKU 决定,字段会被覆盖 |
seed、camera_fixed、watermark、callback_url | 与 2.5 一样透传 | |
metadata.output_format | "mp4" | 2.0 系列拒绝 mov |
metadata.content[] | role 与 2.5 相同 | 最多 9 张参考图;参考音频必须与图或视频一起提供 |
doubao-seedance-2-0-4k);Fast 只有 720p 一档,Mini 最高 720p。想放大已有片段而不是重新生成,请用超分辨率。#Kling
模型 ID: kling-v2-6、kling-v2-6-pro、kling-v3、kling-v3-pro、kling-v3-omni、kling-v3-omni-pro。带 -pro 后缀的是 1080p 档,不带的是 720p。Kling 是文生视频和首帧图生视频路由,能力面刻意收窄: 不接受参考图、参考视频、音频或任何动作迁移输入。带了这些的请求会在计费前被拒绝,而不是悄悄降级成文生视频。
生效字段
| 字段 | 取值 | 说明 |
|---|---|---|
seconds | "5" | "10" | 其他值会被归一: 5 及以下按 5,大于 5 按 10,并按归一后的时长计费 |
metadata.aspect_ratio(或 metadata.ratio) | 16:9 | 9:16 | 1:1 | 仅文生视频有效。有图时忽略(输出跟随图片)。无法识别的值(含无图时的 adaptive)回落到 16:9。 |
image(顶层)或 images[0] | 公网 https URL | 作为首帧 |
metadata.content[] | role 为 first_frame 或 reference_image 的 image_url | 作为首帧;role 为 last_frame 或 end_frame 的作为尾帧(须同时有首帧) |
metadata.callback_url | URL | 完成时回调 |
会被拒绝(HTTP 400,不计费)
metadata.content里的video_url或audio_url条目: 这条路由没有参考视频、动作控制或视频编辑模式- 多于一张首帧图,或只有尾帧没有首帧
- 以 base64 data URL 或
asset://形式给出的图片: Kling 需要公网可访问的 https URL
会被忽略
generate_audio(Kling 输出没有音轨)、seed、camera_fixed、watermark、output_format、resolution(由 SKU 锁定)。Seedance 的 @imageN 语法对 Kling 没有意义,会从提示词中剥离。
输出与计费
mp4,24 fps,无音频。标准档输出 1280×720(或对应的竖版 / 方形),专业档输出 1080p;有首帧时输出保持图片的宽高比。通常 1 到 3 分钟出片。按归一后的时长逐秒计费,提交时一次性扣除,事后不再调整;失败任务全额退款。请在 24 小时内下载结果。Kling 的并发额度有限: 返回 HTTP 429 表示队列已满,请稍等后重试。
{
"model": "kling-v3-omni",
"prompt": "The boy rises onto his toes, holds briefly, then lowers his heels. Static camera, full body in frame.",
"seconds": "5",
"image": "https://your-cdn.example.com/character.png"
}#MiniMax H3
模型 ID: minimax-h3-768p、minimax-h3-2k。每条视频都自带原生生成的立体声音频;没有静音选项,generate_audio 不起作用。
| 字段 | 取值 | 说明 |
|---|---|---|
seconds | "4" 到 "15"(整数) | 超出范围会被裁到边界;默认 5 |
ratio(顶层)或 metadata.ratio | 16:9、9:16、1:1 等;adaptive 只在有参考图时可用 | 文生视频必填;缺失或非法时回落 16:9 |
image 或 image_url(顶层) | 公网 https URL | 一张参考图(role reference_image)。不支持 asset:// 引用。 |
metadata.content[] | text 与 image_url 条目 | 若提供则原样透传,并替代 prompt + image 的自动组合 |
metadata.callback_url | URL | 完成时回调 |
忽略: resolution(由 SKU 锁定)、seed、camera_fixed、watermark、output_format、尾帧以及视频 / 音频参考。按秒计费;失败任务不计费。
#Grok Video
模型 ID: grok-video-1.5、grok-image-video(轻量、更便宜)。仅支持图生视频: 没有图片的请求会被拒绝。输出 720p,无音频。
| 字段 | 取值 | 说明 |
|---|---|---|
image(顶层) | https URL 或 base64 data URL | 必填。也可以通过 POST /v1/videos 的 multipart/form-data 上传文件。 |
seconds | "6" | "8" | "10" | "12" | "15" | 其他值会被拒绝 |
metadata.aspect_ratio | 16:9 | 9:16 | 1:1 | 必填 |
metadata.resolution | "720p" | 必填 |
忽略: generate_audio、seed、camera_fixed、watermark、尾帧、第一张以外的参考图、视频和音频参考。按请求时长逐秒计费,提交时扣除;失败任务退款。
#HappyHorse
模型 ID: happyhorse-1.0-t2v、happyhorse-1.0-i2v、happyhorse-1.0-r2v、happyhorse-1.0-video-edit。变体决定唯一的 image 字段怎么解释: i2v 是首帧,r2v 是参考图,video-edit 是源视频 URL。t2v 只用提示词。水印始终关闭。其他 metadata 键原样透传。按秒计费,提交时扣除;失败任务退款。
#模型不支持的字段会怎样
| 系列 | 未知 metadata 键 | 不支持的参考素材 | 分辨率不匹配 |
|---|---|---|---|
Seedance 2.5 / 2.0 | 静默丢弃 | 透传;模型可能拒绝任务 | 按 SKU 覆盖 |
Kling | 静默丢弃 | 计费前以 HTTP 400 拒绝 | 按 SKU 覆盖 |
MiniMax H3 | 静默丢弃 | 静默丢弃 | 按 SKU 覆盖 |
Grok Video | 透传 | 多余图片丢弃;视频和音频忽略 | 仅 720p |
HappyHorse | 透传 | 静默丢弃 | 模型默认 |
如果你的客户端会在不同系列之间切换,请按系列来构造请求,而不是假设共享的请求形状在哪都一样: 一份对 Seedance 2.5 完美的请求体,在 MiniMax 上会变成纯文生视频,在 Kling 上则直接报错。
#怎么选模型
- 参考图定角色、参考视频定动作: Seedance 2.5
- 超过 15 秒的片段,或超过 9 张参考图: Seedance 2.5
- 原生 4K: Seedance 2.0 Pro,或对已有片段做超分辨率
- 生成配乐: Seedance 2.5 / 2.0 开 generate_audio,或 MiniMax H3(始终生成)
- 让一张静态图动起来,固定 5 或 10 秒,成本最低: Kling 标准档
- 6 到 15 秒的快速图生视频,不需要音频: Grok Video
#后续步骤
相关指南
- Seedance 2.5 视频 API 调用指南(30 秒长片、50 个参考素材): 2.5 的新能力、准确模型名、按秒定价与可直接复制的示例。
- 如何调用 Seedance 2.0 视频生成 API: Seedance 2.0 的提交+轮询请求形状,逐个参数讲解。
- 图生视频 API:如何用 RelayDance 让静态图动起来: 用参考图把一张静态图变成一段动态视频。