§01·spec · /gpus
RTX 4090
nvidia40 series24GB VRAM
45 open-weights AI models run on the RTX 4090 — see which fit, how fast they go, and the VRAM each needs.
RTX 4090D, the China-market export version, ships the same 24 GB of GDDR6X on the same 384-bit bus — so every “fits / doesn’t fit” verdict on this page applies to it unchanged. It has 14,592 CUDA cores instead of 16,384, so the speeds here are an upper bound for it rather than a match. Nothing on the RTX 4090D has been measured yet — send a run if you have one.
§02·models that run on this GPU
45 totalLLM · 16
| Model | Best speed | Min VRAM | Works | Evidence | |
|---|---|---|---|---|---|
| Llama 3.3 70B | 17.79tokens/s | 24GB | ✓ | 1benchrecipe | check ↗ |
| DeepSeek R1 Distill 14B | 10GB | ✓ | recipe | check ↗ | |
| Devstral Small 2 (24B) | 24GB | ✓ | recipe | check ↗ | |
| Gemma 4 12B | 24GB | ✓ | recipe | check ↗ | |
| gpt-oss 20B | 16GB | ✓ | recipe | check ↗ | |
| Laguna XS 2.1 | 24GB | ✓ | recipe | check ↗ | |
| Llama 3.1 8B | 10GB | ✓ | recipe | check ↗ | |
| Mistral Nemo 12B | 24GB | ✓ | recipe | check ↗ | |
| Mistral Small 3.2 24B | 24GB | ✓ | recipe | check ↗ | |
| Nanbeige4.2 3B | 24GB | ✓ | recipe | check ↗ | |
| North Mini Code 1.0 | 24GB | ✓ | recipe | check ↗ | |
| Ornith 1.0 35B | 24GB | ✓ | recipe | check ↗ | |
| Phi-4 | 24GB | ✓ | recipe | check ↗ | |
| Qwen3 14B | 10GB | ✓ | recipe | check ↗ | |
| Qwen3 32B | 22GB | ✓ | recipe | check ↗ | |
| Qwen3-8B | 6GB | ✓ | recipe | check ↗ |
- Best speed
- 17.79tokens/s
- Min VRAM
- 24GB
- Evidence
- 1benchrecipe
- Best speed
- Min VRAM
- 10GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 24GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 24GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 16GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 24GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 10GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 24GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 24GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 24GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 24GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 24GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 24GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 10GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 22GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 6GB
- Evidence
- recipe
Multimodal · 8
| Model | Best speed | Min VRAM | Works | Evidence | |
|---|---|---|---|---|---|
| Bonsai 27B | 10GB | ✓ | recipe | check ↗ | |
| Fara1.5-27B | 24GB | ✓ | recipe | check ↗ | |
| Fara1.5-4B | 16GB | ✓ | recipe | check ↗ | |
| Fara1.5-9B | 24GB | ✓ | recipe | check ↗ | |
| Gemma 4 E4B-IT | 20GB | ✓ | recipe | check ↗ | |
| Gemma 4 26B MoE | 18GB | ✓ | recipe | check ↗ | |
| Muse Glimmer 30B | 24GB | ✓ | recipe | check ↗ | |
| Qwen3.8 27B | 24GB | ✓ | recipe | check ↗ |
- Best speed
- Min VRAM
- 10GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 24GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 16GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 24GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 20GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 18GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 24GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 24GB
- Evidence
- recipe
Image · 9
| Model | Best speed | Min VRAM | Works | Evidence | |
|---|---|---|---|---|---|
| Z-Image Turbo | 2.3s | 13GB | ✓ | 1benchrecipe | check ↗ |
| Flux.1 Dev | 1.85it/s | 24.564GB | ✓ | 1benchrecipe | check ↗ |
| Chroma V48 | 24GB | ✓ | recipe | check ↗ | |
| Flux.2-Klein-4B | 20GB | ✓ | 1benchrecipe | check ↗ | |
| HiDream-O1-Image | 20GB | ✓ | recipe | check ↗ | |
| Juggernaut Z | 16GB | ✓ | recipe | check ↗ | |
| Krea 2 | 16GB | ✓ | recipe | check ↗ | |
| LongCat Image | 18GB | ✓ | recipe | check ↗ | |
| Qwen-Image | 21GB | ✓ | recipe | check ↗ |
- Best speed
- 2.3s
- Min VRAM
- 13GB
- Evidence
- 1benchrecipe
- Best speed
- 1.85it/s
- Min VRAM
- 24.564GB
- Evidence
- 1benchrecipe
- Best speed
- Min VRAM
- 24GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 20GB
- Evidence
- 1benchrecipe
- Best speed
- Min VRAM
- 20GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 16GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 16GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 18GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 21GB
- Evidence
- recipe
Video · 11
| Model | Best speed | Min VRAM | Works | Evidence | |
|---|---|---|---|---|---|
| Wan 2.2 14B | 4.33min | 24GB | ✓ | 1benchrecipe | check ↗ |
| Wan 2.1 | 4min | 8.19GB | ✓ | 1benchrecipe | check ↗ |
| CogVideoX 1.5 | 14GB | ✓ | recipe | check ↗ | |
| HunyuanVideo 1.5 | 14GB | ✓ | recipe | check ↗ | |
| LightX2V | 24GB | ✓ | recipe | check ↗ | |
| LTX-2 | 24GB | ✓ | recipe | check ↗ | |
| LTX-2.5 | 24GB | ✓ | recipe | check ↗ | |
| LTX-2.3 | 20GB | ✓ | recipe | check ↗ | |
| MiniMax H3 (Hailuo 3) | 12GB | ✓ | recipe | check ↗ | |
| Mochi 1 | 20GB | ✓ | recipe | check ↗ | |
| Wan 2.2 TI2V-5B | 24GB | ✓ | recipe | check ↗ |
- Best speed
- 4.33min
- Min VRAM
- 24GB
- Evidence
- 1benchrecipe
- Best speed
- 4min
- Min VRAM
- 8.19GB
- Evidence
- 1benchrecipe
- Best speed
- Min VRAM
- 14GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 14GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 24GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 24GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 24GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 20GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 12GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 20GB
- Evidence
- recipe
- Best speed
- Min VRAM
- 24GB
- Evidence
- recipe
3D · 1
| Model | Best speed | Min VRAM | Works | Evidence | |
|---|---|---|---|---|---|
| Waypoint 1.5 | 12GB | ✓ | recipe | check ↗ |
§03·tested recipes
showing 6 of 47- multimodalintermediate24GB+recipe
Muse Glimmer 30B on RTX 4090: vision and DFlash in llama.cpp at full 131K context
- multimodalintermediate24GB+recipe
Qwen3.8-27B on RTX 4090: 128K-context vision chat via llama.cpp Q4_K_M
- videoadvanced24GB+recipe
LTX-2.5 on RTX 4090: Fitting the 22B Audio-Video DiT in 24 GB via ComfyUI int8
- llmintermediate24GB+recipe
Nanbeige4.2-3B on RTX 4090: the full 256K context on an sm_89 llama.cpp build
- videoadvanced12GB+recipe
MiniMax H3 on RTX 4090: 24 GB video+audio, and where Ada's FP8 shows up
- multimodaladvanced24GB+recipe
Fara1.5-9B on RTX 4090: BF16 Computer-Use Agent with Vision on Ada sm_89