输入
注意:
seconds 值会四舍五入到最近的音频帧,并限制为最少 1 帧、最多 MAX_AUDIO_FRAMES 帧,因此实际潜变量长度可能与输入的确切值略有不同。
输出
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
Source fingerprint (SHA-256):
77e6a69702a837c958c2954bba061c979152f034bc7774a5b6c97ea8d57bda4bDocumentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
此节点为 MiniMax Music3 模型创建一个空的(零填充)音频潜变量。
| 参数 | 描述 | 数据类型 | 必填 | 范围 |
|---|---|---|---|---|
seconds | 音频潜变量的时长,单位为秒(默认值:120.0)。该值会转换为音频帧,并限制在模型支持的时长范围内。 | FLOAT | 是 | 0.04 to (MAX_AUDIO_FRAMES / AUDIO_FRAMES_PER_SECOND), step 0.04 |
batch_size | 在一个批次中生成的音频潜变量数量(默认值:1)。 | INT | 是 | 1 到 4096 |
seconds 值会四舍五入到最近的音频帧,并限制为最少 1 帧、最多 MAX_AUDIO_FRAMES 帧,因此实际潜变量长度可能与输入的确切值略有不同。
| 输出名称 | 描述 | 数据类型 |
|---|---|---|
LATENT | 一个形状为 (batch_size, 128, latent_length) 的零填充音频潜变量张量。包含元数据,将样本标记为音频数据,时间下采样比率为 512。 | LATENT |
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
77e6a69702a837c958c2954bba061c979152f034bc7774a5b6c97ea8d57bda4b