视频模型支持矩阵
这张表汇总当前视频模型系列的主入口、常见模式和参考素材传递方式。模型总表
| 模型家族 | 代表模型 | 文档页面 | 推荐入口 | 常用模式 | 参考素材传法 |
|---|---|---|---|---|---|
| Sora | sora-2 | 概览 | /v1/videos | 文生视频、首帧生视频 | JSON input_reference |
| Veo | veo_3_1、veo_3_1-fast | 概览 | /v1/videos | 文生视频、首尾帧、参考生视频 | JSON input_reference |
| Grok Imagine | grok-imagine-video、grok-imagine-video-1.5-preview | 概览 | /v1/videos | 文生视频、图生视频、参考图视频 | JSON image / images;参考图最多 7 张,1.5 Preview 使用 images |
| Omni | omni-fast、omni-fast-v2v | 概览 | /v1/videos | 文生视频、图生视频、首尾帧、多参考图、参考视频编辑 | JSON first_image_url / last_image_url / images / video |
| MiniMax H3 | MiniMax-H3(兼容 minimax-h3 历史名称) | 概览 | /v1/videos | 文生视频、首帧、尾帧、首尾帧、参考图片、参考视频、参考音频 | JSON content[];固定 768P,duration 为 1-15 秒 |
| manxue-2.5 | manxue-2.5 | 概览 | /v1/videos | 仅参考生视频 | JSON model / prompt / seconds / ratio / images;参考图必填,最多 30 张 |
| mini-2.0 | mini-2.0 | 概览 | /v1/videos | 文生视频、参考图生视频 | JSON model / prompt / duration / ratio / resolution / images;参考图最多 9 张 |
| Wan 3.0 | wan3.0-video、wan3.0-video-prime | 概览 | /v1/videos | 文生视频、首帧、首尾帧、多图参考、参考视频、参考音频 | JSON image / images / input_reference / metadata;高级场景可用原生 input.media |
| 国产视频模型(AIGC) | Vidu-*、Kling-*、GV-*、OS-*、Hunyuan-*、Mingmou-*、Hailuo-*、SV-*、JV-* | 概览 | /v1/videos | 文生、图生、参考图、参考视频、首尾帧、动作控制、数字人、对口型、模板特效 | JSON image / images / input_reference / metadata |
| 特惠渠道系列 | manxue-2.0 | 概览 | /v1/videos | 文生视频、首帧生视频、首尾帧、参考图、参考音频 | JSON content[].image_url / content[].audio_url |
| Seedance 2.0 | doubao-seedance-2-0-260128、doubao-seedance-2-0-fast-260128 | 概览 | /v1/videos | 文生视频、首帧、尾帧、参考图、参考视频、参考音频 | JSON URL 字段 |
| Seedance 1.5 | doubao-seedance-1-5-pro_480p、doubao-seedance-1-5-pro_720p、doubao-seedance-1-5-pro_1080p | 概览 | /v1/videos | 文生视频、首帧生视频、首尾帧 | multipart URL 字段 |
分家族说明
Sora
| 项目 | 说明 |
|---|---|
| 模型示例 | sora-2 |
| 推荐入口 | POST /v1/videos |
| 文档页面 | Sora 视频概览 |
| 常见字段 | prompt、size、seconds、input_reference |
| 参考图 | JSON input_reference |
| 尺寸 | 通过顶层 size 传入,例如 1280x720、720x1280 |
| 时长 | 通过 seconds 提交;具体可用值以当前上游和渠道配置为准 |
Veo
| 项目 | 说明 |
|---|---|
| 模型示例 | veo_3_1、veo_3_1-fast |
| 推荐入口 | POST /v1/videos |
| 文档页面 | Veo 视频概览 |
| 常见模式 | 文生视频、首尾帧、参考生视频 |
| 参考图 | JSON input_reference,由服务端转换为 Veo 请求结构 |
| 注意事项 | 参考生视频模式下,会优先约束为横屏思路,避免上游不兼容 |
国产视频模型(AIGC)
| 项目 | 说明 |
|---|---|
| 模型示例 | Vidu-*、Kling-*、GV-*、OS-*、Hunyuan-*、Mingmou-*、Hailuo-*、SV-*、JV-* |
| 推荐入口 | POST /v1/videos |
| 文档页面 | 国产视频模型概览 |
| 常见字段 | model、prompt、seconds、duration、size、image、images、metadata |
| 参考图 | 支持 image、images、input_reference,高级场景也可通过 metadata.file_infos 传入 |
| 典型场景 | 文生视频、图生视频、参考图、参考视频、首尾帧、动作控制、数字人、对口型、模板特效 |
Grok Imagine
| 项目 | 说明 |
|---|---|
| 模型示例 | grok-imagine-video、grok-imagine-video-1.5-preview |
| 推荐入口 | POST /v1/videos |
| 文档页面 | Grok 视频概览 |
| 常见字段 | prompt、seconds、aspect_ratio、resolution、image、images |
| 参考图 | JSON image / images,最多 7 张;其中 grok-imagine-video-1.5-preview 使用 images |
| 时长规则 | seconds 支持 4 到 15 秒 |
Omni
| 项目 | 说明 |
|---|---|
| 模型示例 | omni-fast、omni-fast-v2v |
| 推荐入口 | POST /v1/videos |
| 文档页面 | Omni 视频模型概览 |
omni-fast | JSON;支持文生、首帧图生、首尾帧、多参考图;images 最多 5 张 |
omni-fast-v2v | 在 omni-fast 基础上支持 video / video_url / input_video 参考视频,最大 15MB |
| 下载建议 | 任务完成后优先使用 GET /v1/videos/{task_id}/content 下载 MP4 |
MiniMax H3
| 项目 | 说明 |
|---|---|
| 模型 | MiniMax-H3;插件兼容 minimax-h3、minimax-h3-pro 等历史名称并统一归一化 |
| 推荐入口 | POST /v1/videos |
| 文档页面 | MiniMax H3 视频概览 |
| 请求体 | JSON model / content / resolution / duration / ratio |
| 清晰度 | 固定 768P,不提供 2K |
| 时长规则 | duration 支持 1 到 15 秒,整数秒,按输出秒数统计用量 |
| 画幅比例 | 当前项目支持 16:9、9:16、1:1、21:9、4:3、3:4 |
| 参考素材 | content[].image_url / content[].video_url / content[].audio_url,全部使用公网 HTTPS URL;媒体总数最多 12 个 |
| 当前边界 | 不透传 adaptive、2K、Base64 或 data URI;关键帧角色不能与 reference_* 角色混用 |
manxue-2.5
| 项目 | 说明 |
|---|---|
| 模型示例 | manxue-2.5 |
| 推荐入口 | POST /v1/videos |
| 文档页面 | manxue-2.5 视频概览 |
| 请求格式 | application/json |
| 常见字段 | model、prompt、seconds、ratio、images |
| 时长规则 | seconds 仅支持 30 秒 |
| 画幅比例 | 1:1、3:4、4:3、9:16、16:9、21:9 |
| 生成模式 | 仅参考生视频;images 必填,最多 30 张 |
| 不支持 | 纯文生视频、首帧/首尾帧、参考视频、参考音频 |
mini-2.0
| 项目 | 说明 |
|---|---|
| 模型示例 | mini-2.0 |
| 推荐入口 | POST /v1/videos |
| 文档页面 | mini-2.0 视频概览 |
| 请求格式 | application/json |
| 常见字段 | model、prompt、duration、ratio、resolution、images |
| 时长规则 | duration 支持 4 到 15 秒的整数 |
| 画幅比例 | 仅支持 16:9、9:16 |
| 清晰度 | resolution 固定为 480p |
| 参考图 | 可选 images 数组,最多 9 张公网图片 URL |
Wan 3.0
| 项目 | 说明 |
|---|---|
| 模型示例 | wan3.0-video、wan3.0-video-prime |
| 推荐入口 | POST /v1/videos |
| 文档页面 | 概览 |
| 常见字段 | prompt、seconds、size、aspect_ratio、image、images、mode、metadata |
| 查询接口 | GET /v1/videos/{task_id} |
| 下载接口 | GET /v1/videos/{task_id}/content |
| 分辨率 | 480P、720P、1080P,默认 1080P |
| 时长规则 | seconds 支持 2 到 30 秒,默认 5 |
| 画幅比例 | 16:9、9:16、1:1、4:3、3:4、adaptive |
| 参考素材 | 参考图最多 10 张,参考视频最多 5 个,参考音频最多 5 个 |
| 客户端域名 | https://magic666.top |
特惠渠道系列
| 项目 | 说明 |
|---|---|
| 模型示例 | manxue-2.0 |
| 推荐入口 | POST /v1/videos |
| 文档页面 | 特惠渠道系列概览 |
manxue-2.0 | JSON 请求;seconds 支持 4 到 15 秒;resolution 支持 480P、720P;参考图放在 content[].image_url.url,用 role 标记 first_frame、last_frame 或 reference_image;参考音频放在 content[].audio_url.url,用 role: "reference_audio" 标记 |
| 字段约束 | 使用 application/json 提交,不接收 Base64 data URI 作为参考图输入 |
Seedance 2.0
| 项目 | 说明 |
|---|---|
| 模型示例 | doubao-seedance-2-0-260128、doubao-seedance-2-0-fast-260128 |
| 推荐入口 | POST /v1/videos |
| 文档页面 | Seedance 2.0 概览 |
| 常见字段 | prompt、duration、aspect_ratio、first_image、last_image、reference_image_urls、reference_video_url、reference_video_urls、reference_audios、reference_audio_urls、audio_url |
| 请求格式 | application/json |
| 特别说明 | 素材字段传公网 URL 或 asset://{asset_id};本地文件先转成服务端可访问的 URL |
Seedance 1.5
| 项目 | 说明 |
|---|---|
| 模型示例 | doubao-seedance-1-5-pro_480p、doubao-seedance-1-5-pro_720p、doubao-seedance-1-5-pro_1080p |
| 推荐入口 | POST /v1/videos |
| 文档页面 | Seedance 1.5 概览 |
| 常见字段 | prompt、seconds、size |
| 参考图 | multipart first_frame_image、last_frame_image,字段值为图片 URL |
| 时长规则 | 当前时长限制在 4 到 11 秒之间 |
| 注意事项 | 不适合“参考生视频”模式 |
阿里 wan2.6
| 项目 | 说明 |
|---|---|
| 模型示例 | wan2.6-t2v:1280*720、wan2.6-t2v:1920*1080、wan2.6-i2v:1280*720、wan2.6-i2v:1920*1080 |
| 推荐入口 | POST /v1/videos |
| 文档页面 | 国产视频模型概览 |
| 常见模式 | t2v 文生视频、i2v 图生视频 |
| 分辨率 | 模型名里已经带固定分辨率档位 |
| 参考图 | i2v 常见是单图输入 |
Vidu
| 项目 | 说明 |
|---|---|
| 模型示例 | Vidu-q3-pro、Vidu-q3-turbo |
| 推荐入口 | POST /v1/videos |
| 文档页面 | 国产视频模型概览 |
| 请求风格 | JSON |
| 首帧图 | image |
| 首尾帧 | image + metadata.last_frame_url |
| 参考生视频 | images 最多常见 3 张 |
Kling
| 项目 | 说明 |
|---|---|
| 模型示例 | Kling-3.0、Kling-3.0-Omni |
| 推荐入口 | POST /v1/videos 或官方兼容路由 /kling/v1/videos/* |
| 文档页面 | 国产视频模型概览 |
| 请求风格 | JSON |
| 常见字段 | prompt、seconds、metadata.output_config |
| 参考图 | image |
| 音频 | 可通过 metadata.output_config.audio_generation 控制 |
Hailuo
| 项目 | 说明 |
|---|---|
| 模型示例 | Hailuo-2.3、Hailuo-2.3-fast |
| 推荐入口 | POST /v1/videos |
| 文档页面 | 国产视频模型概览 |
| 请求风格 | JSON |
| 常见字段 | prompt、seconds、metadata.output_config.resolution |
| 参考图 | image |
| 注意事项 | 不应依赖 aspect_ratio;当前更适合文生视频和首帧生视频 |
生成模式支持
| 模型家族 | 文生视频 | 首帧生视频 | 首尾帧 | 参考生视频 | 音频开关 |
|---|---|---|---|---|---|
| Sora | 支持 | 支持 | 部分场景依赖上游 | 部分场景通过多图参考实现 | 支持 |
| Veo | 支持 | 可通过参考图实现 | 支持 | 支持 | 依赖上游 |
| Grok Imagine | 支持 | 支持 | 依赖上游 | 支持 | 依赖上游 |
| Omni | 支持 | 支持 | 支持 | omni-fast 支持参考图;omni-fast-v2v 支持参考视频 | 模型相关 |
| MiniMax H3 | 支持 | 支持 | 支持 | 支持参考图片、最多 3 段参考视频和最多 3 段参考音频;关键帧角色不能与 reference_* 角色混用 | 原生音频能力,插件强制启用 |
| manxue-2.5 | 不支持 | 不支持 | 不支持 | 仅支持参考生视频,最多 30 张参考图 | 不支持 |
| mini-2.0 | 支持 | 支持 | 不支持专用首尾帧字段 | 支持最多 9 张参考图 | 模型相关 |
| Wan 3.0 | 支持 | 支持 | 支持 | 支持多图、参考视频和参考音频;高级场景可直接传 input.media | 可通过 metadata.parameters.audio 请求有声视频 |
| 特惠渠道系列 | 支持 | 支持 | 支持 | manxue-2.0 支持参考图和参考音频 | 模型相关 |
| Seedance 2.0 | 支持 | 支持 | 支持 | 支持参考图、参考视频和参考音频 | 模型相关 |
| Seedance 1.5 | 支持 | 支持 | 支持 | 建议使用首帧或首尾帧 | 依赖上游 |
| 阿里 wan2.6 | 支持 | i2v 支持 | 依赖上游 | 依赖上游 | 依赖上游 |
| Vidu | 支持 | 支持 | 支持 | 支持 | 依赖上游 |
| Kling | 支持 | 支持 | 当前不建议作为标准能力承诺 | 不建议 | 支持 |
| Hailuo | 支持 | 支持 | 不建议 | 不建议 | 依赖上游 |
常见 model 值速查
下面这张表补充前端模型描述和渠道模型映射里常见的具体 model 值,便于直接复制到请求体中。
model | 归属 | 说明 |
|---|---|---|
manxue-2.0 | 特惠渠道系列 | JSON 请求;seconds 支持 4 到 15 秒;resolution 支持 480P、720P;参考图通过 content[].image_url.url 传入,参考音频通过 content[].audio_url.url 传入。 |
manxue-2.5 | manxue-2.5 | JSON 请求;仅支持参考生视频;seconds 仅支持 30 秒;ratio 支持 1:1、3:4、4:3、9:16、16:9、21:9;参考图通过必填的 images 数组传入,最多 30 张。 |
mini-2.0 | mini-2.0 | JSON 请求;duration 支持 4 到 15 秒;ratio 仅支持 16:9 / 9:16;resolution 固定为 480p;参考图通过可选的 images 数组传入,最多 9 张。 |
wan3.0-video | Wan 3.0 | 通义万相 Wan 3.0 标准版;JSON 请求;seconds 支持 2 到 30 秒;size 支持 480P、720P、1080P;支持首帧、首尾帧、多图参考、参考视频和参考音频。 |
wan3.0-video-prime | Wan 3.0 | 通义万相 Wan 3.0 优速版;参数格式与 wan3.0-video 一致,适合需要更快端到端处理的任务。 |
doubao-seedance-2-0-260128 | Seedance 2.0 | Seedance 2.0 标准档位;支持 JSON URL 字段。 |
doubao-seedance-2-0-fast-260128 | Seedance 2.0 | Seedance 2.0 fast 档位;适合更快提交的视频任务。 |
doubao-seedance-1-5-pro_480p | Seedance 1.5 | Seedance 1.5 480p;multipart 请求;seconds 范围 4 到 11;首尾帧图片 URL 使用 first_frame_image / last_frame_image 传入。 |
doubao-seedance-1-5-pro_720p | Seedance 1.5 | Seedance 1.5 720p;multipart 请求;size 传宽高比。 |
doubao-seedance-1-5-pro_1080p | Seedance 1.5 | Seedance 1.5 1080p;multipart 请求;适合需要更高清晰度的任务。 |
wan2.6-t2v:1280*720 | 阿里 wan2.6 | 阿里万象 wan2.6 文生视频;常见字段 prompt / size / seconds;该条目对应 1280*720 低价档位。 |
wan2.6-t2v:1920*1080 | 阿里 wan2.6 | 阿里万象 wan2.6 文生视频;常见字段 prompt / size / seconds;该条目对应 1920*1080 高价档位。 |
wan2.6-i2v:1280*720 | 阿里 wan2.6 | 阿里万象 wan2.6 图生视频;常见字段 prompt / size / seconds;支持首帧生视频;该条目对应 1280*720 低价档位。 |
wan2.6-i2v:1920*1080 | 阿里 wan2.6 | 阿里万象 wan2.6 图生视频;常见字段 prompt / size / seconds;支持首帧生视频;该条目对应 1920*1080 高价档位。 |
Vidu-q3-pro | 国产视频模型 | Vidu q3-pro(基础模型)。 |
Vidu-q3-turbo | 国产视频模型 | Vidu q3-turbo(基础模型)。 |
Kling-3.0 | 国产视频模型 | 可灵 3.0(基础模型)。 |
Kling-3.0-Omni | 国产视频模型 | 可灵 3.0 Omni(基础模型)。 |
omni-fast | Omni | 文生视频、首帧图生视频、首尾帧和多参考图视频;JSON 请求;参考图最多 5 张;时长 4 到 30 秒。 |
omni-fast-v2v | Omni | 在 omni-fast 基础上额外支持参考视频编辑或延长;参考视频字段为 video / video_url / input_video,最大 15MB。 |
grok-imagine-video | Grok Imagine | Grok Imagine Video;JSON 请求;seconds 支持 4 到 15 秒;单图传 image,多图传 images,参考图最多 7 张;resolution 支持 480P / 720P;prompt 最多 4096 个字符。 |
grok-imagine-video-1.5-preview | Grok Imagine | Grok Imagine 1.5 Preview;JSON 请求;seconds 支持 4 到 15 秒;使用 images 传参考图,最多 7 张;resolution 支持 480P / 720P;prompt 最多 4096 个字符。 |
MiniMax-H3 | MiniMax H3 | JSON content[] 请求;固定 768P;duration 支持 1 到 15 秒;支持文生、关键帧和图片/视频/音频参考。 |
Hailuo-2.3 | 国产视频模型 | 海螺 2.3(基础模型)。 |
Hailuo-2.3-fast | 国产视频模型 | 海螺 2.3 fast(基础模型)。 |
推荐阅读
- Grok 视频概览
- MiniMax H3 视频概览
- manxue-2.5 视频概览
- mini-2.0 视频概览
- Wan 3.0 视频概览
- Omni 视频模型概览
- Veo 视频概览
- 如果你要做图生视频,先确认目标模型需要的是
image、images、input_reference、referenceImages还是first_frame_image/last_frame_image。 - 如果你明确是 Kling 官方格式接入,再看
/kling/v1/videos/*这一组路由。