weva
🔎Webアプリを探す
🎨 ローカルAIBlack Forest Labsのロゴ

FLUX.1 Kontext [dev]の必要VRAM

FP16・FP8・GGUF・解像度別の早見表

FLUX.1 Kontext [dev](Black Forest Labs / 本体 11.9B / 画像編集)をローカルで動かすのに必要なVRAMを、本体+テキストエンコーダ+作業領域から計算しました。 諸元は配布元の公開データから取得しています。

あなたのPCで動くか

あなたのPC検出中…GPUを自動検出中…VRAM 8GBメモリ 16GBWindows
他のPCで試す
解像度1024×1024px
あなたの環境(VRAM 8GB)での判定
  • FFP16/BF1624.2GB載らない
  • DFP813.1GBかなり遅い
  • DQ8_013.8GBかなり遅い
  • CQ5_K_S9.7GB動くが遅い
  • CQ4_K_S8.5GB動くが遅い

テキストエンコーダは本体と入れ替えで載せる前提(ComfyUI 等の既定の動作)で計算しています。S〜F のランクの意味はトップページに一覧があります。

他のモデルも一括で判定するならローカル画像生成チェッカーへ。

必要VRAMの早見表

重みの持ち方512px1024px(標準)1536px2048px
FP16/BF1616bit/重み23.2GB24.2GB25.8GB28.0GB
FP88bit/重み12.2GB13.1GB14.7GB16.9GB
Q8_08.53bit/重み12.9GB13.8GB15.4GB17.6GB
Q5_K_S5.55bit/重み8.8GB9.7GB11.3GB13.5GB
Q4_K_S4.66bit/重み7.5GB8.5GB10.0GB12.2GB

テキストエンコーダは本体と入れ替えで載せる前提(ComfyUI 等の既定の動作)で計算しています。全部を同時に載せる場合は、この表に テキストエンコーダ分(4.5GB、8bit時)がおおむね上乗せされます。

モデルの構成

  • 本体: DiT(Transformer) / 11,901,477,020 パラメータ(11.9B)
  • テキストエンコーダ: CLIP ViT-L(123M) + T5-XXL エンコーダ(4.8B) = 合計 4.9B
  • VAE: 84M
  • 標準の生成解像度: 1024×1024px
  • ライセンス: FLUX.1 [dev] Non-Commercial License
  • GGUF 版の配布: QuantStack/FLUX.1-Kontext-dev-GGUF

指示文で画像を編集するモデル。入力画像も潜在表現として処理するため、作業領域は生成だけの場合より増える。

出典: black-forest-labs/FLUX.1-Kontext-dev(配布が承諾制のため、ファイル一覧のバイト数 ÷ 1要素のバイト数で数えた値)。ライセンスや利用条件は配布元をご確認ください。

同じ用途の他のモデル

  • Qwen-Image-Edit-2509本体 20.4B
← 他のモデルもまとめて判定する文章生成AI(ローカルLLM)が動くかを調べる(同じPC構成が引き継がれます)
weva
Webアプリを探す話題のニュース仕事探し個人開発ニュース
運営者情報お問い合わせ利用規約プライバシーポリシー
© 2026 Weva.dark_typeA_115x57.png