快速开始
在你的 Comfy 工作区中创建一个密钥,并将其导出为COMFY_API_KEY。Python 和 TypeScript 代码片段使用 Comfy SDK(pip install comfy-sdk、npm install @comfyorg/sdk);cURL 代码片段是通过原生 HTTP 进行的相同调用。
模型 ID: wan/happyhorse-1.1-t2v
端点: POST https://api.comfy.org/v2/models/wan/happyhorse-1.1-t2v
- Wait for the result
- Queue and collect later
数据结构
输入
object
必填
填写基础信息,例如提示词等。
string
音频文件下载网址。支持的格式:mp3 和 wav。不能与 reference_video_urls 同时使用。
string
首帧图片网址或 Base64 编码数据。I2V 模型必填。图片格式:JPEG、JPG、PNG、BMP、WEBP。分辨率:360-2000 像素。文件大小:最大 10MB。
object[]
wan2.7 和 wan3.0 模型的媒体资产列表。用于指定视频生成的参考素材(图像、音频、视频)。每个元素包含 type 和 url 字段。
支持的 type 取值因模型而异:
- wan2.7-i2v:first_frame、last_frame、driving_audio、first_clip
- wan2.7-r2v:reference_image、reference_video
- wan2.7-videoedit:video、reference_image
- wan3.0-video:first_frame(最多 1 个)、last_frame(最多 1 个)、reference_image(最多 10 个)、 reference_video(最多 5 段,总时长 <= 15 秒)、reference_audio(最多 5 段, 总时长 <= 15 秒)、file(最多 1 个,不能与 link 同时使用)、link(最多 1 个,不能 与 file 同时使用)。在同一次请求中,reference_*/file/link 类型与 first_frame/last_frame 类型 互斥。数组顺序决定了素材在提示词中的引用顺序(Image 1、Video 1、Audio 1……)。
string
必填
媒体资产类型可选值:
first_frame、last_frame、driving_audio、first_clip、reference_image、reference_video、reference_audio、video、file、linkstring
必填
媒体文件的 URL(公开的 HTTP/HTTPS 网址或 OSS 临时网址)
string
反向提示词,用于描述你不希望在视频画面中看到的内容
string
文本提示词。支持中文和英文,长度不超过 800 个字符
(wan3.0-video 最多 20,000 个字符;超出限制的内容会被截断)。
对于带多个参考视频的 wan2.6-r2v,请按参考视频的顺序使用 “character1”“character2” 等来指代主体。
例如:“Character1 在路边唱歌,Character2 在一旁跳舞”
对于 wan3.0-video 参考模式,请使用 “Image 1”“Video 1”“Audio 1” 等,按 media 数组中
的对应顺序来指代媒体资产。
string[]
仅用于 wan2.6-r2v 模型的参考视频网址。由 1-3 个视频网址组成的数组。
输入限制:
- 格式:mp4、mov
- 数量:1-3 个视频
- 单个视频时长:2-30 秒
- 单个文件大小:最大 30MB
- 不能与 audio_url 同时使用 参考时长:单个视频最长 5s,两个视频各最长 2.5s,三个视频则按比例更短。 计费:按实际使用的参考时长计算。
string
视频效果模板名称。可选。目前支持:squish、flying、carousel。使用时,prompt 参数会被忽略。
string
要调用的模型 ID。本组件不对此进行约束:Comfy Router 会从
POST /v2/models/wan/{model} 的 {model} 路径段中填充它,因此 Router 调用方可以省略。直接通过 v1 调用 POST /proxy/wan/api/v1/services/aigc/video-generation/video-synthesis 则必须提供该字段,可接受的拼写枚举定义在该操作自身的组件 WanVideoGenerationRequest 上。object
视频处理参数
boolean
默认值:"true"
是否为视频添加音频
string
默认值:"\"auto\""
wan2.7-videoedit 模型的视频音频设置。
- auto(默认):模型根据提示词内容智能判断
-
origin:强制保留输入视频的原始音频
可选值:
auto、origin
integer
默认值:"5"
生成视频的时长,单位为秒:
- wan2.5 模型:5 或 10 秒
- wan2.6-t2v、wan2.6-i2v:5、10 或 15 秒
- wan2.6-r2v:仅支持 5 或 10 秒(不支持 15s)
- wan2.7-i2v、wan2.7-t2v:[2, 15] 范围内的整数
- wan2.7-r2v、wan2.7-videoedit:[2, 10] 范围内的整数
-
wan3.0-video:无视频输入时为 [2, 30] 范围内的整数;有视频输入时,
输入视频总时长 + 输出视频时长不得超过 30 秒;-1 表示启用
智能时长模式,由模型选择合适的时长
范围:
-1到30
boolean
默认值:"true"
是否启用提示词智能改写。默认为 true
string
生成视频的画面比例。仅适用于 wan2.7 和 wan3.0 模型。
对于 wan2.7 模型,若未提供,则根据分辨率档位确定默认值。
对于 wan3.0-video,adaptive(默认值)会根据输入媒体的比例和意图
自动推荐合适的画面比例。可选值:
adaptive、16:9、9:16、1:1、4:3、3:4string
分辨率档位。支持的取值因模型而异:
- wan2.5-i2v-preview:480P、720P、1080P
- wan2.6-i2v:仅支持 720P、1080P(不支持 480P)
- wan2.7 模型(i2v、t2v、r2v、videoedit):720P、1080P(默认 1080P)
-
wan3.0-video、wan3.0-video-prime:480P、720P、1080P(上游默认 1080P)
本代理会拒绝既未提供 resolution 也未提供 size 的视频生成请求,
因为分辨率档位决定了计费费率。
可选值:
480P、720P、1080P
integer
随机数种子,用于控制模型生成内容的随机性范围:
0 到 2147483647string
默认值:"\"single\""
智能多镜头控制。仅在启用 prompt_extend 时生效。
适用于 wan2.6 和 wan2.7-r2v 模型。
- single:单镜头视频(默认)
-
multi:多镜头视频
可选值:
multi、single
string
视频分辨率,格式为 宽度高度。支持的分辨率因模型而异:
对于 wan2.5 T2V:480P(480832、832480、624624)、720P、1080P 尺寸
对于 wan2.6 T2V/R2V(不支持 480P):
720P:1280720、7201280、960960、1088832、8321088
1080P:19201080、10801920、14401440、16321248、12481632
boolean
默认值:"false"
是否添加水印标识,水印位于右下角
GET /v2/models/wan/happyhorse-1.1-t2v/openapi.json 所提供的 schema 生成,这也是它在请求到达提供商之前用于校验调用的同一份文档。
输出
object
必填
string
智能重写后的实际提示词(用于视频任务)
string
带音频生成的 I2V 任务的音频网址
string
失败请求的错误代码(请求成功时不返回)
string
任务完成时间
string
失败请求的详细信息(请求成功时不返回)
string
原始输入提示词(用于视频任务)
object[]
图像生成任务的任务结果列表
string
智能重写后的实际提示词(如果已启用)
string
图像错误代码(部分任务失败时返回)
string
图像错误信息(部分任务失败时返回)
string
原始输入提示词
string
已生成图像的网址地址
string
任务执行时间
string
任务提交时间
string
必填
任务 ID
object
图像生成任务的任务结果统计
integer
失败任务的数量
integer
成功任务的数量
integer
任务总数
string
必填
任务状态可能的值:
PENDING、RUNNING、SUCCEEDED、FAILED、CANCELED、UNKNOWNstring
已完成视频生成任务的视频网址。连线有效期 24 小时
string
必填
唯一请求标识符
object
输出信息统计。仅统计成功的结果
integer
视频分辨率级别(I2V 和 wan3.0-video 任务)
number
已生成视频的时长,单位为秒(I2V 和 wan3.0-video 任务)
integer
已生成视频的帧率(wan3.0-video 任务)
integer
已生成图像的数量(T2I 和 I2I 任务)
number
输入视频的时长,单位为秒;无视频输入时为 0.0(wan3.0-video 任务)
number
输出视频的时长,单位为秒(wan3.0-video 任务)
string
已生成视频的比例,例如 16:9(wan3.0-video 任务)
string
图像分辨率(T2I 和 I2I 任务)
integer
已生成视频的数量(T2V 任务)
number
已生成视频的时长,单位为秒(T2V 任务)
string
视频分辨率比例(T2V 任务)
string
失败请求的错误代码,在信封的根层级报告,而不是在
output 下(请求成功时不返回)。string
失败请求的详细信息,在信封的根层级报告,而不是在
output 下(请求成功时不返回)。在回退到 output.message 之前请先阅读此项。示例
输入
输出
发布前须知
SDK 会生成Idempotency-Key 并在自动重试中复用它。手动重试时,请复用原始 key。Router 最长可保持连接 10 分钟。
请求失败时,Router 会发送 X-Comfy-Error-Type 响应头说明原因。422 表示 Router 在调用提供商之前就拒绝了输入。生成的资源请及时下载,因为结果链接会过期。
请求头
身份验证、幂等性、请求 ID、错误分类、重试节奏、消费限额。
使用 Router API
模型发现、校验错误、重试与计费。
限制
Router 目前不支持的功能,以及替代方案。