> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-chore-sync-comfy-api-v2-spec.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# ElevenLabsSpeechToSpeech - ComfyUI Built-in Node Documentation

> ElevenLabs 语音转语音节点可将输入音频文件从一种语音转换为另一种语音。

ElevenLabs 语音转语音节点可将输入音频文件从一种语音转换为另一种语音。它使用 ElevenLabs API 转换语音，同时保留原始音频的内容和情感语调。

## 输入

### 通用输入

| 参数       | 描述                                               | 数据类型           | 必需 | 范围                                                        |
| -------- | ------------------------------------------------ | -------------- | -- | --------------------------------------------------------- |
| `模型`     | 用于语音转语音转换的模型。所选模型决定下方可用的语音设置。                    | DYNAMIC\_COMBO | 是  | `eleven_multilingual_sts_v2`<br />`eleven_english_sts_v2` |
| `目标语音`   | 转换的目标语音。从语音选择器或即时语音克隆连接。                         | CUSTOM         | 是  | -                                                         |
| `源音频`    | 要转换的源音频。                                         | AUDIO          | 是  | -                                                         |
| `稳定性`    | 语音稳定性。较低的值提供更广泛的情感范围，较高的值产生更一致但可能单调的语音（默认值：0.5）。 | FLOAT          | 是  | 0.0 - 1.0                                                 |
| `输出格式`   | 音频输出格式（默认值："mp3\_44100\_192"）。                   | COMBO          | 是  | `"mp3_44100_192"`<br />`"opus_48000_192"`                 |
| `随机种子`   | 用于可复现性的随机种子（默认值：0）。                              | INT            | 是  | 0 - 4294967295                                            |
| `去除背景噪音` | 使用音频隔离从输入音频中消除背景噪音（默认值：False）。                   | BOOLEAN        | 是  | -                                                         |

### eleven\_multilingual\_sts\_v2 和 eleven\_english\_sts\_v2 输入

两个模型都提供以下相同的语音设置。

| 参数                  | 描述                                     | 数据类型    | 必需 | 范围        |
| ------------------- | -------------------------------------- | ------- | -- | --------- |
| `speed`             | 语速。1.0 为正常，\<1.0 较慢，>1.0 较快（默认值：1.0）。  | FLOAT   | 是  | 0.7 - 1.3 |
| `similarity_boost`  | 相似度增强。较高的值使语音与原始声音更相似（默认值：0.75）。       | FLOAT   | 是  | 0.0 - 1.0 |
| `use_speaker_boost` | 增强与原始说话人声音的相似度（默认值：False）。             | BOOLEAN | 是  | -         |
| `style`             | 风格夸张程度。较高的值会增加风格表现力，但可能降低稳定性（默认值：0.0）。 | FLOAT   | 是  | 0.0 - 0.2 |

## 输出

| 输出名称    | 描述                  | 数据类型  |
| ------- | ------------------- | ----- |
| `audio` | 转换后的音频文件，采用指定的输出格式。 | AUDIO |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/ElevenLabsSpeechToSpeech/zh.md)

***

**Source fingerprint (SHA-256):** `a3cd602181d134b9ab517bfac092ea30b62ef5a9942a905c0c3e6959b34370ca`
