Skip to main content
TomePatchModel は、推論時の計算コストを削減するために、拡散モデルに Token Merging(ToMe)を適用します。これは、モデルのアテンション機構内で類似したトークンをマージすることで機能し、モデルがより少ないトークンを処理するようにしつつ、出力品質をほぼ維持します。

入力

注: アテンションブロック内のトークン数が少なく、ダウンサンプリングが不要な場合、マージ関数は何もしない処理に置き換えられ、そのブロックではモデルは変更されずに実行されます。

出力

このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集

Source fingerprint (SHA-256): 1202c0df17f357440cd156fa0920f70c18a318e32c41dc04cecff11613f0072f