入力
出力
このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集
Source fingerprint (SHA-256):
c3fbfd189d0358ebf081dd4f9c32be9231a9d0b97fd767401ea4b7955224c25cDocumentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
MiniMax Music3 Text Encode は、MiniMax Music3 CLIP モデルを使用して、テキストキャプションと歌詞を音楽生成用の音響コンディショニングシーケンスに変換します。
| Parameter | Description | Data Type | Required | Range |
|---|---|---|---|---|
clip | MiniMax Music3 CLIP モデル。テキストエンコードおよびコンディショニングシーケンスの生成に使用されます。 | CLIP | はい | - |
caption | 生成する音楽を説明するテキスト。複数行のテキストおよび動的プロンプトをサポートします。 | STRING | はい | - |
歌詞 | 音楽の生成に使用する歌詞テキスト。複数行のテキストおよび動的プロンプトをサポートします。 | STRING | はい | - |
seed | 生成プロセス用の再現可能なランダムシード。デフォルト:0。生成後に制御できるウィジェットが提供されています。 | INT | はい | 0 ~ 18446744073709551615 (0xffffffffffffffff) |
max_duration | 最大長(秒)。モデルは曲をこれより早く終了させることがあります。デフォルト:120.0。 | FLOAT | はい | 0.04 ~ モデルの最大音声長(MAX_AUDIO_FRAMES / AUDIO_FRAMES_PER_SECOND)、ステップ 0.04 |
cfg_scale | 分類器フリーガイダンスのスケール。デフォルト:モデル定数 CFG_SCALE。詳細設定パラメータ。 | FLOAT | はい | 0.0 ~ 100.0、ステップ 0.1(小数点以下2桁を保持) |
top_k | 音響トークンの選択に使用される Top-k サンプリング値。デフォルト:モデル定数 CFG_TOP_K。詳細設定パラメータ。 | INT | はい | 1 ~ モデルの語彙サイズ(C0_VOCAB_SIZE) |
| Output Name | Description | Data Type |
|---|---|---|
conditioning | 生成された音響コンディショニングシーケンス。後続の音楽生成を誘導するために使用されます。 | CONDITIONING |
seconds | コンディショニングシーケンスの実際の長さ(秒)。 | FLOAT |
このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集
c3fbfd189d0358ebf081dd4f9c32be9231a9d0b97fd767401ea4b7955224c25c