weva
🔎Webアプリを探す
🎨 ローカルAIEfficient-Large-Modelのロゴ

SANA 1.6Bの必要VRAM

FP16・FP8・GGUF・解像度別の早見表

SANA 1.6B(NVIDIA / MIT HAN Lab / 本体 1.6B / 高速(少ステップ))をローカルで動かすのに必要なVRAMを、本体+テキストエンコーダ+作業領域から計算しました。 諸元は配布元の公開データから取得しています。

あなたのPCで動くか

あなたのPC検出中…GPUを自動検出中…VRAM 8GBメモリ 16GBWindows
他のPCで試す
解像度1024×1024px
あなたの環境(VRAM 8GB)での判定
  • AFP16/BF165.5GB快適に動く
  • SFP83.9GB余裕で動く

テキストエンコーダは本体と入れ替えで載せる前提(ComfyUI 等の既定の動作)で計算しています。S〜F のランクの意味はトップページに一覧があります。

他のモデルも一括で判定するならローカル画像生成チェッカーへ。

必要VRAMの早見表

重みの持ち方512px1024px(標準)1536px2048px
FP16/BF1616bit/重み5.5GB5.5GB7.0GB9.2GB
FP88bit/重み3.0GB3.9GB5.5GB7.7GB

テキストエンコーダは本体と入れ替えで載せる前提(ComfyUI 等の既定の動作)で計算しています。全部を同時に載せる場合は、この表に テキストエンコーダ分(2.4GB、8bit時)がおおむね上乗せされます。 SANA 1.6B は GGUF 版の配布が見つからなかったため、GGUF の行は載せていません。

モデルの構成

  • 本体: DiT(Transformer) / 1,604,462,752 パラメータ(1.6B)
  • テキストエンコーダ: Gemma 2 2B(2.6B)
  • VAE: 312M
  • 標準の生成解像度: 1024×1024px
  • ライセンス: apache-2.0

潜在空間を強く圧縮する独自のVAE(DC-AE)を使い、高解像度でも計算量を抑える設計。

出典: Efficient-Large-Model/Sana_1600M_1024px_diffusers(各 safetensors ファイルのヘッダに記録されたテンソルの形から要素数を数えた値)。ライセンスや利用条件は配布元をご確認ください。

同じ用途の他のモデル

  • FLUX.2 [klein] 4B本体 3.9B
  • Z-Image-Turbo本体 6.2B
  • FLUX.2 [klein] 9B本体 9.1B
  • FLUX.1 [schnell]本体 11.9B
← 他のモデルもまとめて判定する文章生成AI(ローカルLLM)が動くかを調べる(同じPC構成が引き継がれます)
weva
Webアプリを探す話題のニュース仕事探し個人開発ニュース
運営者情報お問い合わせ利用規約プライバシーポリシー
© 2026 Weva.dark_typeA_115x57.png