> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-comfy-docs-comfyapi-search.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# LTXVReferenceAudio - ComfyUI Built-in Node Documentation

> LTXV Reference Audio 将说话人的语音身份从参考音频片段迁移到生成的音频中。

LTXV Reference Audio 将说话人的语音身份从参考音频片段迁移到生成的音频中。它将参考音频编码到条件化数据中，并可选地通过身份引导来修补模型，该引导会在每一步执行一次不包含参考音频的额外前向传递，以增强说话人身份效果。

## 输入

| 参数                        | 描述                                                                    | 数据类型         | 必需 | 范围          |
| ------------------------- | --------------------------------------------------------------------- | ------------ | -- | ----------- |
| `model`                   | 要使用身份引导进行修补的模型。                                                       | MODEL        | 是  | -           |
| `positive`                | 正向条件化输入。                                                              | CONDITIONING | 是  | -           |
| `negative`                | 负向条件化输入。                                                              | CONDITIONING | 是  | -           |
| `reference_audio`         | 要迁移其说话人身份的参考音频片段。建议约 5 秒（训练时长）。过短或过长的片段可能会降低语音身份迁移效果。                 | AUDIO        | 是  | -           |
| `audio_vae`               | 用于编码的 LTXV Audio VAE。                                                 | VAE          | 是  | -           |
| `identity_guidance_scale` | 身份引导的强度。每一步都会执行一次不包含参考音频的额外前向传递，以增强说话人身份。设置为 0 可禁用（不执行额外传递）。（默认值：3.0） | FLOAT        | 是  | 0.0 - 100.0 |
| `start_percent`           | 身份引导生效的 sigma 范围的起始值。（默认值：0.0）                                        | FLOAT        | 是  | 0.0 - 1.0   |
| `end_percent`             | 身份引导生效的 sigma 范围的结束值。（默认值：1.0）                                        | FLOAT        | 是  | 0.0 - 1.0   |

注意：仅当 `identity_guidance_scale` 大于 0 且当前采样步骤位于 `start_percent` 和 `end_percent` 定义的范围内时，才会应用身份引导。如果参考音频与音频 VAE 的采样率不同，则会将参考音频重采样为音频 VAE 的采样率。

注意：`start_percent` 和 `end_percent` 是高级参数，仅当界面中启用了高级选项时才会显示。

## 输出

| 输出名称       | 描述                      | 数据类型         |
| ---------- | ----------------------- | ------------ |
| `model`    | 已使用身份引导函数修补的模型。         | MODEL        |
| `positive` | 正向条件化数据，现在包含编码后的参考音频数据。 | CONDITIONING |
| `negative` | 负向条件化数据，现在包含编码后的参考音频数据。 | CONDITIONING |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/LTXVReferenceAudio/zh.md)

***

**Source fingerprint (SHA-256):** `ae15c5838656324667d099614b325b863341f05afda43054658999574522dd49`
