Datasheet for local AI49 models98 GPUsData read 2026-09-25
No adsNo tracking
Check my GPU →
Datasheet No. 01 · Local AI on your own GPUCalculated from 839 real model files

Will it run
on your GPU?

FLUX, Qwen-Image, Krea 2, Wan, LTX, MiniMax H3 and 43 more. Which file to download, how much VRAM it really needs, and what your card can handle. Every number says where it came from.

I have and I want to run .

…
Loading the answer.
Fig. 1 — LiveStep 01/20σ 1.000Seed —
Memory map · RTX 5060 Ti 16 GB · FLUX.1 dev FP8 · Sampling14.2 GB / 16 GB
08 GB16 GB
Weights FP8 · 11.9 GBWorking memory · 1.5 GBReserve · 0.8 GBFree · 1.8 GB
49image & video models
98desktop & laptop GPUs
839model files, sized to the byte
2453answer pages
01The memory ruler

Every model on one scale. Drag the red line to your VRAM.

Each dot is one file of a model, placed at the VRAM it needs. Everything left of the line fits.
Your VRAM
16GB
0 of 49 models fit entirely.
Model
081624324048
Verdict · file
Image models
FLUX.1 dev12B · imageQ2_KQ3_K_SQ4_K_SQ5_K_SQ6_KFP8Q8_016-bitFLUX.1 schnell12B · imageQ2_KQ3_K_SQ4_K_SQ5_K_SQ6_KFP8Q8_016-bitFLUX.1 Kontext12B · imageQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KFP8Q8_016-bitFLUX.1 Krea12B · imageQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KFP8Q8_016-bitFLUX.1 Fill12B · imageQ3_K_SQ4_K_SQ5_K_SQ6_KQ8_016-bitFLUX.2 dev32B · imageQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KQ8_0FP8FLUX.2 klein 9B9B · imageQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KFP8Q8_016-bitFLUX.2 klein 4B4B · imageQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KFP8Q8_016-bitKrea 212.8B · imageQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KFP8INT8Q8_016-bitQwen-Image20B · imageQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KFP8Q8_016-bitQwen-Image-Edit20B · imageQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KFP8Q8_016-bitQwen-Image 2.17.1B · imageQ3_K_MQ4_K_MQ5_K_MQ6_KINT8Q8_016-bitZ-Image Turbo6B · imageQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KINT8Q8_016-bitZ-Image6.15B · imageQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KINT8Q8_016-bitIdeogram 49.3B · imageQ4_1Q5_1FP8INT8Q8_0Boogu-Image10.29B · imageQ4_1Q5_1FP8INT8Q8_016-bitERNIE-Image8.03B · imageQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KQ8_016-bitHiDream-O18.8B · imageFP816-bitMage-Flow4.12B · imageINT816-bitLumina 2.02.61B · imageQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KQ8_016-bitHiDream-I1 Full17B · imageQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KFP8Q8_016-bitHiDream-I117B · imageQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KFP8Q8_016-bitSD 3.5 Large8.1B · imageQ4_1Q5_1Q8_016-bitSD 3.5 Medium2.5B · imageQ3_K_MQ4_K_MQ5_K_MQ6_KQ8_016-bitChroma1-HD8.9B · imageQ2_KQ3_K_SQ4_K_MQ5_K_MQ6_KFP8Q8_016-bitSDXL3.5B · image16-bitIllustrious / Pony3.5B · imageQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KQ8_0FP816-bitSD 1.50.98B · image16-bitHunyuanImage 2.117B · imageQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KFP8Q8_016-bit
Video models
Wan 2.1 14B14B · videoQ3_K_MQ4_K_MQ5_K_MQ6_KFP8Q8_016-bitWan 2.1 1.3B1.3B · videoQ3_K_MQ4_K_MQ5_K_MQ6_KQ8_016-bitWan 2.1 I2V 480P16.4B · videoQ3_K_MQ4_K_MQ5_K_MQ6_KFP8Q8_016-bitWan 2.1 I2V 720P16.4B · videoQ3_K_MQ4_K_MQ5_K_MQ6_KFP8Q8_016-bitWan VACE 14B17.3B · videoQ3_K_SQ4_K_MQ5_K_MQ6_KQ8_016-bitWan 2.2 T2V14B · videoQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KFP8Q8_016-bitWan 2.2 I2V14B · videoQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KFP8Q8_016-bitWan 2.2 5B5B · videoQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KQ8_016-bitWan 2.2 Animate17.3B · videoQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KFP8INT8Q8_016-bitWan Animate 214B · videoQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KINT8Q8_016-bitWan 2.2 S2V16.3B · videoQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KFP8Q8_016-bitSCAIL-216B · videoQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KINT8FP8Q8_016-bitHunyuanVideo 13B13B · videoQ3_K_MQ4_K_MQ5_K_MQ6_KFP8Q8_016-bitLTX-Video 13B13B · videoQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KQ8_0FP816-bitHunyuanVideo 1.58.3B · videoQ4_K_MQ5_K_MQ6_KFP8Q8_016-bitLTX-219B · videoQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KQ8_016-bitLTX-2.322B · videoQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KQ8_016-bitLTX-2.522B · videoQ2_KQ3_K_MQ4_K_MQ5_K_MQ6_KQ8_016-bitMiniMax H333.1B · videoQ3_K_MQ4_K_MQ5_K_MQ6_KINT8Q8_0MiniMax H3 Prunedpruned 33B · videoQ3_K_MQ4_K_MQ5_K_MQ6_KFP8INT8Q8_016-bit
A file of this model (VRAM it needs)Fits in your VRAMBest file that fitsYour VRAM
05No guesses without a label

Where every number comes from

calculated

From real file sizes

Every model file is sized to the byte from Hugging Face. Add the model's working memory and a small system reserve, and you get the verdict of what fits entirely.

measured

On my own GPU

I make AI images with FLUX in ComfyUI on an RTX 5060 Ti 16 GB. A benchmark script times each model and logs peak VRAM; those results are being added.

reported

From other people

69 real-world results from GitHub, Hugging Face and first-hand blogs, copied as published with a link to each. See them all or send yours.