视频生成万相
万相2.7-参考生视频
POST /api/v1/services/aigc/video-generation/video-synthesis — wan2.7 参考生视频(角色/音色一致性)
万相 2.7 参考生视频模型:支持多模态输入(图片、视频、音频),生成保持角色形象与音色一致性的视频,适用于单角色表演或多角色互动场景。
支持的模型
| 模型 | 说明 |
|---|---|
wan2.7-r2v | 万相 2.7 参考生视频 |
创建任务
POST
/api/v1/services/aigc/video-generation/video-synthesiscurl https://api.modelsite.ai/api/v1/services/aigc/video-generation/video-synthesis \
-H "Authorization: Bearer $MODELSITE_API_KEY" -H "Content-Type: application/json" \
-d '{
"model": "wan2.7-r2v",
"input": {
"prompt": "视频1抱着图2,弹奏一支舒缓的民谣;图1手里拿着图3,路过并放下",
"media": [
{ "type": "reference_image", "url": "https://example.com/girl.jpg",
"reference_voice": "https://example.com/girl-voice.mp3" },
{ "type": "reference_video", "url": "https://example.com/role2.mp4" },
{ "type": "reference_image", "url": "https://example.com/prop.png" }
]
},
"parameters": { "resolution": "720P", "ratio": "16:9", "duration": 10 }
}'请求体
| 字段 | 类型 | 说明 |
|---|---|---|
model | string(必填) | wan2.7-r2v |
input.prompt | string(必填) | ≤5000 字符。用「图1 / 图2 / 视频1 / 视频2」指代 media 数组中对应顺序的素材(图和视频分别计数);仅一个素材时可写「参考图片」 |
input.negative_prompt | string(可选) | ≤500 字符(在 input 里) |
input.media | array(必填) | reference_image + reference_video 合计 1~5 个;可选再加至多 1 个 first_frame 联合控制 |
parameters | object(可选) | 见下表 |
media 元素字段
| 字段 | 说明 |
|---|---|
type | reference_image(主体/场景参考)/ reference_video(主体+音色参考,不建议空镜)/ first_frame(首帧联合控制,≤1 张) |
url | 素材 URL 或 Base64。图 ≤20MB、宽高 [240, 8000]px;视频 mp4/mov,1~30s,≤100MB |
reference_voice | 仅 reference 项可用:音色参考音频 URL(wav/mp3,1~10s,≤15MB)。只参考音色、与说话内容无关;同时传含音频的 reference_video 时,本字段优先 |
parameters 参数
| 参数 | 类型 | 说明 |
|---|---|---|
resolution | string | 720P / 1080P(默认)。可售档位以价格配置为准 |
ratio | string | 16:9(默认)/ 9:16 / 1:1 / 4:3 / 3:4。传了 first_frame 时被忽略(跟随首帧) |
duration | integer | 默认 5。参考素材含视频时取值 [2, 10],不含视频时 [2, 15] |
prompt_extend | boolean | 默认 true |
watermark | boolean | 默认 false |
seed | integer | [0, 2147483647] |
参考主体为人物/动物/物体时,每张素材只包含单一角色;计费时长 = 输入视频时长 + 输出视频时长(轮询响应的 usage.duration)。
轮询与结果
GET
/api/v1/tasks/{task_id}curl "https://api.modelsite.ai/api/v1/tasks/$TASK_ID" \
-H "Authorization: Bearer $MODELSITE_API_KEY"响应字段
| 字段 | 说明 |
|---|---|
output.task_id | 任务 ID(与创建时返回的一致) |
output.task_status | PENDING 排队 / RUNNING 处理中 / SUCCEEDED 成功 / FAILED 失败 |
output.video_url | 生成视频的 URL,仅 SUCCEEDED 时返回,尽快下载转存 |
output.code / output.message | 仅失败时返回,失败原因 |
usage | 用量统计(时长、分辨率档位等),仅成功时计数 |
request_id | 请求唯一标识,排查问题时请提供 |
状态流转:PENDING → RUNNING → SUCCEEDED / FAILED。
计费
按实际生成时长(秒)计费——含参考视频时,输入视频时长一并计入;任务失败不计费。单价见 模型页。
错误处理
创建阶段错误返回 {"code": "...", "message": "..."};任务内失败看轮询的 output.code / output.message。通用错误码见错误处理。