> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-chore-sync-comfy-api-v2-spec.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# LTXVConcatAVLatent - ComfyUI Built-in Node Documentation

> 此节点将视频潜空间和音频潜空间合并为单个联合音视频（AV）潜空间，可供 LTXV 或 MiniMax H3 等 AV 模型使用。

此节点将视频潜空间和音频潜空间合并为单个联合音视频（AV）潜空间，可供 LTXV 或 MiniMax H3 等 AV 模型使用。如果视频输入已经是 AV 潜空间，则保留其视频流，仅将音频流替换为所提供的音频潜空间。

## 输入

| 参数             | 描述                                                              | 数据类型   | 是否必填 | 范围 |
| -------------- | --------------------------------------------------------------- | ------ | ---- | -- |
| `video_latent` | 视频数据的潜空间表示。当它已同时包含视频流和音频流时，节点会保留其视频流，并替换为来自 `audio_latent` 的音频。 | LATENT | 是    |    |
| `audio_latent` | 音频数据的潜空间表示。其长度会被调整以适配视频流：较长的音频会被裁剪，较短的音频会用零填充。                  | LATENT | 是    |    |

**注意：** 两个输入的样本会以嵌套张量中的视频流和音频流对的形式组合在一起。如果任一输入包含 `noise_mask`，输出将包含合并后的掩码；缺失的掩码会替换为与其样本形状匹配的全 1 掩码。当较短的音频被填充时，填充区域保持未掩码状态，以便模型生成该区域。如果音频潜空间无法适配到视频潜空间，节点会报错，例如当两个潜空间在多个维度上不同，或在批次或通道维度上不同时。

## 输出

| 输出名称     | 描述                                                                   | 数据类型   |
| -------- | -------------------------------------------------------------------- | ------ |
| `latent` | 包含视频和音频样本打包为两个流的潜空间，并且当至少一个输入提供 `noise_mask` 时，还包含合并后的 `noise_mask`。 | LATENT |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/LTXVConcatAVLatent/zh.md)

***

**Source fingerprint (SHA-256):** `0231f9db2ce73132d8555fbb33f295b68aa68a0c1c54e4a0c5d2e1f67b5611cb`
