§01·spec · /gpus
RTX 3090
nvidia30 series24GB VRAM
48 open-weights AI models run on the RTX 3090 — see which fit, how fast they go, and the VRAM each needs.
§02·models that run on this GPU
48 totalLLM · 18
| Model | Best speed | Min VRAM | Works | Evidence | |
|---|---|---|---|---|---|
| Qwen3 30B-A3B | 153.6tokens/s | 24GB | ✓ | 2benchesrecipe | check ↗ |
| gpt-oss 20B | 147.5tokens/s | 16GB | ✓ | 2benchesrecipe | check ↗ |
| Qwen3-8B | 115.3tokens/s | 6GB | ✓ | 2benchesrecipe | check ↗ |
| Qwen3 14B | 70tokens/s | 10GB | ✓ | 2benchesrecipe | check ↗ |
| Qwen3 32B | 35.1tokens/s | 22GB | ✓ | 2benchesrecipe | check ↗ |
| Apodex 1.1 mini | 24GB | ✓ | recipe | check ↗ | |
| DeepSeek R1 Distill 14B | 12GB | ✓ | recipe | check ↗ | |
| Devstral Small 2 (24B) | 24GB | ✓ | recipe | check ↗ | |
| Gemma 4 12B | 24GB | ✓ | recipe | check ↗ | |
| KAT-Coder V2.5 Dev | 24GB | ✓ | recipe | check ↗ | |
| Laguna XS 2.1 | 24GB | ✓ | recipe | check ↗ | |
| Llama 3.1 8B | 10GB | ✓ | recipe | check ↗ | |
| Mistral Nemo 12B | 24GB | ✓ | recipe | check ↗ | |
| Mistral Small 3.2 24B | 24GB | ✓ | recipe | check ↗ | |
| Nanbeige4.2 3B | 24GB | ✓ | recipe | check ↗ | |
| North Mini Code 1.0 | 24GB | ✓ | recipe | check ↗ | |
| Ornith 1.0 35B | 24GB | ✓ | recipe | check ↗ | |
| Phi-4 | 24GB | ✓ | recipe | check ↗ |
- Best speed
- 153.6tokens/s
- Min VRAM
- 24GB
- Evidence
- 2benches
- Best speed
- 147.5tokens/s
- Min VRAM
- 16GB
- Evidence
- 2benches
- Best speed
- 115.3tokens/s
- Min VRAM
- 6GB
- Evidence
- 2benches
- Best speed
- 70tokens/s
- Min VRAM
- 10GB
- Evidence
- 2benches
- Best speed
- 35.1tokens/s
- Min VRAM
- 22GB
- Evidence
- 2benches
- Best speed
- Min VRAM
- 24GB
- Best speed
- Min VRAM
- 12GB
- Best speed
- Min VRAM
- 24GB
- Best speed
- Min VRAM
- 24GB
- Best speed
- Min VRAM
- 24GB
- Best speed
- Min VRAM
- 24GB
- Best speed
- Min VRAM
- 10GB
- Best speed
- Min VRAM
- 24GB
- Best speed
- Min VRAM
- 24GB
- Best speed
- Min VRAM
- 24GB
- Best speed
- Min VRAM
- 24GB
- Best speed
- Min VRAM
- 24GB
- Best speed
- Min VRAM
- 24GB
Multimodal · 11
| Model | Best speed | Min VRAM | Works | Evidence | |
|---|---|---|---|---|---|
| Gemma 4 26B MoE | 119.4tokens/s | 18GB | ✓ | 2benchesrecipe | check ↗ |
| Qwen3.5 35B | 111.2tokens/s | 24GB | ✓ | 2benchesrecipe | check ↗ |
| Gemma4 31B | 34.7tokens/s | 24GB | ✓ | 2benchesrecipe | check ↗ |
| Qwen3.5 27B | 33.5tokens/s | 24GB | ✓ | 2benchesrecipe | check ↗ |
| Agents-A1 35B-A3B | 24GB | ✓ | recipe | check ↗ | |
| Fara1.5-27B | 24GB | ✓ | recipe | check ↗ | |
| Fara1.5-4B | 16GB | ✓ | recipe | check ↗ | |
| Fara1.5-9B | 24GB | ✓ | recipe | check ↗ | |
| Gemma 4 E4B-IT | 20GB | ✓ | recipe | check ↗ | |
| Muse Glimmer 30B | 24GB | ✓ | recipe | check ↗ | |
| Qwen3.8 27B | 24GB | ✓ | recipe | check ↗ |
- Best speed
- 119.4tokens/s
- Min VRAM
- 18GB
- Evidence
- 2benches
- Best speed
- 111.2tokens/s
- Min VRAM
- 24GB
- Evidence
- 2benches
- Best speed
- 34.7tokens/s
- Min VRAM
- 24GB
- Evidence
- 2benches
- Best speed
- 33.5tokens/s
- Min VRAM
- 24GB
- Evidence
- 2benches
- Best speed
- Min VRAM
- 24GB
- Best speed
- Min VRAM
- 24GB
- Best speed
- Min VRAM
- 16GB
- Best speed
- Min VRAM
- 24GB
- Best speed
- Min VRAM
- 20GB
- Best speed
- Min VRAM
- 24GB
- Best speed
- Min VRAM
- 24GB
Image · 9
| Model | Best speed | Min VRAM | Works | Evidence | |
|---|---|---|---|---|---|
| Z-Image Turbo | 9s | 16GB | ✓ | 1benchrecipe | check ↗ |
| Krea 2 | 14.75s/img | 18.75GB | ✓ | 1benchrecipe | check ↗ |
| Chroma V48 | 24GB | ✓ | recipe | check ↗ | |
| Flux.2-Klein-4B | 13GB | ✓ | recipe | check ↗ | |
| HiDream-O1-Image | 20GB | ✓ | recipe | check ↗ | |
| Juggernaut Z | 16GB | ✓ | recipe | check ↗ | |
| LongCat Image | 18GB | ✓ | recipe | check ↗ | |
| Qwen-Image | 13GB | ✓ | recipe | check ↗ | |
| Qwen-Image-2.1 | 12GB | ✓ | recipe | check ↗ |
- Best speed
- 9s
- Min VRAM
- 16GB
- Evidence
- 1bench
- Best speed
- 14.75s/img
- Min VRAM
- 18.75GB
- Evidence
- 1bench
- Best speed
- Min VRAM
- 24GB
- Best speed
- Min VRAM
- 13GB
- Best speed
- Min VRAM
- 20GB
- Best speed
- Min VRAM
- 16GB
- Best speed
- Min VRAM
- 18GB
- Best speed
- Min VRAM
- 13GB
- Best speed
- Min VRAM
- 12GB
Video · 8
| Model | Best speed | Min VRAM | Works | Evidence | |
|---|---|---|---|---|---|
| Wan 2.2 14B | 7.17min | 24GB | ✓ | 1benchrecipe | check ↗ |
| CogVideoX 1.5 | 14GB | ✓ | recipe | check ↗ | |
| HunyuanVideo 1.5 | 24GB | ✓ | recipe | check ↗ | |
| LightX2V | 14GB | ✓ | recipe | check ↗ | |
| LTX-2.5 | 24GB | ✓ | recipe | check ↗ | |
| MiniMax H3 (Hailuo 3) | 12GB | ✓ | recipe | check ↗ | |
| Mochi 1 | 22GB | ✓ | recipe | check ↗ | |
| Wan 2.2 TI2V-5B | 24GB | ✓ | recipe | check ↗ |
- Best speed
- 7.17min
- Min VRAM
- 24GB
- Evidence
- 1bench
- Best speed
- Min VRAM
- 14GB
- Best speed
- Min VRAM
- 24GB
- Best speed
- Min VRAM
- 14GB
- Best speed
- Min VRAM
- 24GB
- Best speed
- Min VRAM
- 12GB
- Best speed
- Min VRAM
- 22GB
- Best speed
- Min VRAM
- 24GB
3D · 1
| Model | Best speed | Min VRAM | Works | Evidence | |
|---|---|---|---|---|---|
| Waypoint 1.5 | 12GB | ✓ | recipe | check ↗ |
§03·tested recipes
showing 6 of 48- imageintermediate12GB+recipe
Qwen-Image-2.1 on RTX 3090: int8 ComfyUI setup, 24 GB fit per OS, third-party 3090 timings
- musicintermediate16GB+recipe
YuE2-3B on RTX 3090: full songs on Ampere without the FP8 path
- llmintermediate24GB+recipe
Apodex 1.1 mini on RTX 3090: 128K-Context Agent Model in Q4_K_M GGUF
- multimodalintermediate24GB+recipe
Qwen3.8-27B on RTX 3090: 128K-context vision chat via llama.cpp GGUF
- multimodalintermediate24GB+recipe
Muse Glimmer 30B on RTX 3090: vision + DFlash speculation at full 131K context
- videoadvanced24GB+recipe
LTX-2.5 on RTX 3090: 22B audio-video on Ampere via the official ComfyUI INT8 checkpoint