入力
出力
このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集
Source fingerprint (SHA-256):
ce27a3bdea2d9e3cf8875c24236a2a0a1429e9bc13a58581e372fb669d2c0018Documentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
このノードは音声クリップを分析し、動画生成モデルを誘導するための特徴量セットに変換します。
| パラメータ | 説明 | データ型 | 必須 | 範囲 |
|---|---|---|---|---|
audio | 分析およびエンコードする音声入力。音声が複数チャンネルの場合、特徴抽出前にチャンネルをモノラルに平均化します。 | AUDIO | はい | - |
video_frames | 対象動画のフレーム数。同期用のフレームレート計算に使用されます(デフォルト: 149)。 | INT | はい | 最小: 1、最大: 16384 (MAX_RESOLUTION)、ステップ: 4 |
audio_inject_scale | 動画モデルに注入する際の音声特徴量のスケール(デフォルト: 1.0)。 | FLOAT | はい | 最小: 0.0、最大: 10.0、ステップ: 0.01 |
| 出力名 | 説明 | データ型 |
|---|---|---|
audio_encoder_output | 処理済みの音声特徴量、計算されたフレームレート(fps)、音声注入スケールを含む辞書。この出力は動画生成モデルの条件付けに使用されます。 | AUDIO_ENCODER_OUTPUT |
fps_string | 音声長と動画フレーム数に基づいて計算されたフレームレート(fps)を表すテキスト文字列。この文字列は動画モデルのプロンプトで使用することを想定しています。参照パイプラインに合わせて中国語でフォーマットされています。 | STRING |
このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集
ce27a3bdea2d9e3cf8875c24236a2a0a1429e9bc13a58581e372fb669d2c0018