§01·spec · /gpus
RTX 4080
nvidia40 series16GB VRAM
52 open-weights AI models run on the RTX 4080 — see which fit, how fast they go, and the VRAM each needs.
§02·models that run on this GPU
52 totalLLM · 13
| Model | Best speed | Min VRAM | Works | Evidence | |
|---|---|---|---|---|---|
| gpt-oss 20B | 136.5tokens/s | 16GB | ✓ | 2benchesrecipe | check ↗ |
| Qwen3-8B | 102.7tokens/s | 6GB | ✓ | 2benchesrecipe | check ↗ |
| Qwen3 14B | 62tokens/s | 16GB | ✓ | 2benchesrecipe | check ↗ |
| Apodex 1.1 mini | 16GB | ✓ | recipe | check ↗ | |
| Devstral Small 2 (24B) | 16GB | ✓ | recipe | check ↗ | |
| Gemma 4 12B | 16GB | ✓ | recipe | check ↗ | |
| Llama 3.1 8B | 10GB | ✓ | recipe | check ↗ | |
| Mistral Nemo 12B | 16GB | ✓ | recipe | check ↗ | |
| Mistral Small 3.2 24B | 16GB | ✓ | recipe | check ↗ | |
| Nanbeige4.2 3B | 16GB | ✓ | recipe | check ↗ | |
| North Mini Code 1.0 | 16GB | ✓ | recipe | check ↗ | |
| Ornith 1.0 9B | 12GB | ✓ | recipe | check ↗ | |
| Phi-4 | 16GB | ✓ | recipe | check ↗ |
- Best speed
- 136.5tokens/s
- Min VRAM
- 16GB
- Evidence
- 2benches
- Best speed
- 102.7tokens/s
- Min VRAM
- 6GB
- Evidence
- 2benches
- Best speed
- 62tokens/s
- Min VRAM
- 16GB
- Evidence
- 2benches
- Best speed
- Min VRAM
- 16GB
- Best speed
- Min VRAM
- 16GB
- Best speed
- Min VRAM
- 16GB
- Best speed
- Min VRAM
- 10GB
- Best speed
- Min VRAM
- 16GB
- Best speed
- Min VRAM
- 16GB
- Best speed
- Min VRAM
- 16GB
- Best speed
- Min VRAM
- 16GB
- Best speed
- Min VRAM
- 12GB
- Best speed
- Min VRAM
- 16GB
Multimodal · 7
| Model | Best speed | Min VRAM | Works | Evidence | |
|---|---|---|---|---|---|
| Fara1.5-4B | 16GB | ✓ | recipe | check ↗ | |
| Fara1.5-9B | 16GB | ✓ | recipe | check ↗ | |
| Gemma 4 E4B-IT | 6GB | ✓ | recipe | check ↗ | |
| MiniMind-O | 4GB | ✓ | recipe | check ↗ | |
| MOSS-Audio | 12GB | ✓ | recipe | check ↗ | |
| Qwen3.8 27B | 16GB | ✓ | recipe | check ↗ | |
| Voxtral Mini 3B | 10GB | ✓ | recipe | check ↗ |
Image · 12
| Model | Best speed | Min VRAM | Works | Evidence | |
|---|---|---|---|---|---|
| Anima | 7GB | ✓ | recipe | check ↗ | |
| Chroma V48 | 16GB | ✓ | recipe | check ↗ | |
| ERNIE-Image-Turbo | 12GB | ✓ | recipe | check ↗ | |
| Flux.2-Klein-4B | 13GB | ✓ | recipe | check ↗ | |
| HiDream-O1-Image | 10GB | ✓ | recipe | check ↗ | |
| Juggernaut Z | 16GB | ✓ | recipe | check ↗ | |
| Krea 2 | 16GB | ✓ | recipe | check ↗ | |
| LongCat Image | 16GB | ✓ | recipe | check ↗ | |
| Qwen-Image | 13GB | ✓ | recipe | check ↗ | |
| Qwen-Image-2.1 | 12GB | ✓ | recipe | check ↗ | |
| SenseNova U1 | 12GB | ✓ | recipe | check ↗ | |
| Z-Image Turbo | 16GB | ✓ | recipe | check ↗ |
- Best speed
- Min VRAM
- 7GB
- Best speed
- Min VRAM
- 16GB
- Best speed
- Min VRAM
- 12GB
- Best speed
- Min VRAM
- 13GB
- Best speed
- Min VRAM
- 10GB
- Best speed
- Min VRAM
- 16GB
- Best speed
- Min VRAM
- 16GB
- Best speed
- Min VRAM
- 16GB
- Best speed
- Min VRAM
- 13GB
- Best speed
- Min VRAM
- 12GB
- Best speed
- Min VRAM
- 12GB
- Best speed
- Min VRAM
- 16GB
Video · 6
3D · 3
| Model | Best speed | Min VRAM | Works | Evidence | |
|---|---|---|---|---|---|
| Hunyuan3D | 10GB | ✓ | recipe | check ↗ | |
| TRELLIS image-large | 16GB | ✓ | recipe | check ↗ | |
| Waypoint 1.5 | 12GB | ✓ | recipe | check ↗ |
TTS · 6
Music · 3
| Model | Best speed | Min VRAM | Works | Evidence | |
|---|---|---|---|---|---|
| ACE-Step 1.5 XL | 12GB | ✓ | recipe | check ↗ | |
| Foundation-1 | 8GB | ✓ | recipe | check ↗ | |
| YuE2-3B | 16GB | ✓ | recipe | check ↗ |
§03·tested recipes
showing 6 of 52- imageintermediate12GB+recipe
Qwen-Image-2.1 on RTX 4080: ComfyUI int8 template in 16 GB, encoder and DiT take turns
- musicintermediate16GB+recipe
YuE2-3B on RTX 4080: the measured 16GB fit, carried across to Ada
- llmadvanced16GB+recipe
Apodex 1.1 mini on RTX 4080: a 36B agent in 16 GB via llama.cpp expert offload
- multimodaladvanced16GB+recipe
Qwen3.8-27B on RTX 4080: a vision-capable 27B inside 16 GB with llama.cpp
- videoadvanced16GB+recipe
LTX-2.5 on RTX 4080: 22B audio-video in 16 GB via a community Q3_K_M GGUF on Ada
- llmintermediate16GB+recipe
Nanbeige4.2-3B on RTX 4080: 96K Context, and What Each Token Costs in Bytes