> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-chore-sync-comfy-api-v2-spec.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# WanSCAILToVideo - ComfyUI Built-in Node Documentation

> WanSCAILToVideo 节点为使用 SCAIL 和 SCAIL-2 视频模型进行的视频生成准备条件和空潜空间。

WanSCAILToVideo 节点为使用 SCAIL 和 SCAIL-2 视频模型进行的视频生成准备条件和空潜空间。它会处理各种可选输入，例如参考图像、姿态视频、CLIP 视觉输出、彩色身份掩码和上一帧分块，并将它们嵌入到正向和负向条件中。该节点输出修改后的条件以及具有指定视频尺寸的空白潜空间张量，可直接用于采样。

## 输入

| 参数                     | 描述                                                                                                         | 数据类型                 | 必需 | 范围                    |
| ---------------------- | ---------------------------------------------------------------------------------------------------------- | -------------------- | -- | --------------------- |
| `正向`                   | 正向条件输入。                                                                                                    | CONDITIONING         | 是  | -                     |
| `负向`                   | 负向条件输入。                                                                                                    | CONDITIONING         | 是  | -                     |
| `vae`                  | 用于编码图像和视频帧的 VAE 模型。                                                                                        | VAE                  | 是  | -                     |
| `宽度`                   | 输出视频的宽度（以像素为单位）（默认值：512）。值按 32 递增。                                                                         | INT                  | 是  | 32 to MAX\_RESOLUTION |
| `高度`                   | 输出视频的高度（以像素为单位）（默认值：896）。值按 32 递增。                                                                         | INT                  | 是  | 32 to MAX\_RESOLUTION |
| `长度`                   | 视频帧数（默认值：81）。值按 4 递增。                                                                                      | INT                  | 是  | 1 to MAX\_RESOLUTION  |
| `批量大小`                 | 每批要生成的视频数量（默认值：1）。                                                                                         | INT                  | 是  | 1 到 4096              |
| `姿态视频`                 | 用于姿态条件的视频。将被缩小到主视频分辨率的一半。                                                                                  | IMAGE                | 否  | -                     |
| `pose_video_mask`      | 仅限 SCAIL-2。与 `pose_video` 分辨率相同的按身份着色的 SAM3 掩码视频。                                                          | IMAGE                | 否  | -                     |
| `replacement_mode`     | 仅限 SCAIL-2。False = 动画模式（`pose_video_mask` 应具有黑色背景）。True = 替换模式（`pose_video_mask` 应具有白色背景）。（默认值：False）      | BOOLEAN              | 否  | -                     |
| `姿态强度`                 | 姿态潜空间的强度。（默认值：1.0）                                                                                         | FLOAT                | 是  | 0.0 到 10.0            |
| `姿态起始步`                | 姿态条件的起始步骤。（默认值：0.0）                                                                                        | FLOAT                | 是  | 0.0 到 1.0             |
| `姿态结束步`                | 姿态条件的结束步骤。（默认值：1.0）                                                                                        | FLOAT                | 是  | 0.0 到 1.0             |
| `参考图像`                 | 参考图像。第一张图像是主要参考（将所有身份合成到该图像上）。SCAIL-2：批次中的额外图像用作附加视角（背面、特写、遮挡背景），每张都需要一个使用该身份颜色匹配的 `reference_image_mask`。 | IMAGE                | 否  | -                     |
| `reference_image_mask` | 仅限 SCAIL-2。彩色参考掩码，批次与 `reference_image` 匹配（第一张 = 主要参考掩码，其余 = 额外 `reference_image` 的身份掩码）。                  | IMAGE                | 否  | -                     |
| `clip视觉输出`             | 用于条件的 CLIP 视觉特征。模型训练时使用拉伸缩放以适应宽高比。                                                                         | CLIP\_VISION\_OUTPUT | 否  | -                     |
| `video_frame_offset`   | 此分块开始的累计输出帧序号。连接到上一分块的 `video_frame_offset` 输出。（默认值：0）                                                     | INT                  | 是  | 0 to MAX\_RESOLUTION  |
| `previous_frame_count` | 用于锚定的 `previous_frames` 尾部帧数。SCAIL-2 以 5 进行训练（81 帧分块，76 帧步长）。（默认值：5）                                       | INT                  | 是  | 1 to MAX\_RESOLUTION  |
| `previous_frames`      | 仅限 SCAIL-2。上一分块的完整解码输出。仅使用最后 `previous_frame_count` 帧作为扩展锚点。                                               | IMAGE                | 否  | -                     |

**注意：** `pose_video` 和 `pose_video_mask` 输入会一起被截断到两者中较短的长度，并且仅对前 `length` 帧进行处理。如果任一输入的长度小于或等于 `video_frame_offset`，则完全忽略该输入。`pose_video` 在编码前会被缩小到主视频分辨率的一半；编码后的姿态潜空间会乘以 `pose_strength`，并且仅在 `pose_start` 到 `pose_end` 之间的时间步内应用于条件。如果提供了 `pose_video_mask`，彩色掩码视频会被缩小到一半分辨率，并转换为 28 通道驱动掩码，该掩码会同时添加到正向和负向条件中。

**注意：** 当提供 `reference_image` 时，批次中的每张图像都会单独编码为一个潜空间，并嵌入到正向和负向条件中。第一张图像是主要参考；附加图像用作附加视角，每张都需要一个匹配的 `reference_image_mask`。`reference_image_mask` 仅在同时提供 `reference_image` 时使用；当两者都提供时，还会根据这些掩码构建一个 28 通道参考掩码，用于将参考帧与身份绑定，并添加到条件中。在替换模式（`replacement_mode=True`）下，参考图像会以参考图像掩码作为 alpha 遮罩合成到黑色背景上。当提供 `clip_vision_output` 时，它会同时应用到正向和负向条件中。

**注意：** 当提供 `previous_frames` 时，仅使用最后 `previous_frame_count` 帧作为扩展锚点，并且 `video_frame_offset` 会相应调整（减去已锚定的帧数，下限为 0）。锚定的帧会被编码并写入输出潜空间的开头，同时包含一个噪声掩码，以便在生成过程中保持这些帧不变。

## 输出

| 输出名称                 | 描述                                                                                                                                   | 数据类型         |
| -------------------- | ------------------------------------------------------------------------------------------------------------------------------------ | ------------ |
| `正向`                 | 修改后的正向条件，可能包含嵌入的参考图像潜空间、CLIP 视觉输出、姿态视频潜空间、驱动掩码、参考掩码或上一帧潜空间。                                                                          | CONDITIONING |
| `负向`                 | 修改后的负向条件，可能包含嵌入的参考图像潜空间、CLIP 视觉输出、姿态视频潜空间、驱动掩码、参考掩码或上一帧潜空间。                                                                          | CONDITIONING |
| `latent`             | 形状为 `[batch_size, 16, ((length - 1) // 4) + 1, height // 8, width // 8]` 的空潜空间张量。当提供 `previous_frames` 时，该潜空间会被部分填充为已编码的上一帧，并包含噪声掩码。 | LATENT       |
| `video_frame_offset` | 调整后的偏移量 + 长度。连接到下一个分块以实现顺序视频生成。                                                                                                      | INT          |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/WanSCAILToVideo/zh.md)

***

**Source fingerprint (SHA-256):** `4a1a2201dfa94bd2f1330db02ec18a5e0a6aae9e9ac5ae97d456b7af1aa84b7b`
