Autor: Jakub Rusinowski · Ostatnia aktualizacja: 26 czerwca 2026
These are the strongest local models that fit entirely in 24 GB of VRAM, ranked by capability, with the quantization level and estimated tokens/sec needed to fit.
| Qwen 2.5 Family — Qwen 2.5 Coder 32B | Q4_K_M · 19.32 GB · ~28 tok/s on AMD Radeon RX 7900 XTX |
| Llama 3.3 — Llama 3.3 70B Instruct | Q2_K_XS (Tight) · 20.212500000000002 GB · ~26 tok/s on AMD Radeon RX 7900 XTX |
| Qwen 3 — Qwen 3 32B | Q4_K_M · 19.802999999999997 GB · ~27 tok/s on AMD Radeon RX 7900 XTX |
| DeepSeek R1 — DeepSeek R1 Distill Qwen 32B | Q4_K_M · 19.32 GB · ~28 tok/s on AMD Radeon RX 7900 XTX |
| Qwen 2.5 Family — Qwen 2.5 14B Instruct | Q4_K_M · 8.4525 GB · ~55 tok/s on AMD Radeon RX 7900 XTX |
| Gemma 4 (Legacy Listing — Unverified) — Gemma 4 27B ⭐ | Q4_K_M · 16.30125 GB · ~32 tok/s on AMD Radeon RX 7900 XTX |
| Qwen 3 — Qwen 3 14B | Q4_K_M · 8.935500000000001 GB · ~53 tok/s on AMD Radeon RX 7900 XTX |
| Qwen 3.7 — Qwen 3.7 35B-A3B | Q4_K_M · 21.13125 GB · ~126 tok/s on AMD Radeon RX 7900 XTX |
| Codestral — Codestral 22B | Q4_K_M · 13.40325 GB · ~38 tok/s on AMD Radeon RX 7900 XTX |
| Qwen 3.6 — Qwen 3.6 35B-A3B | Q4_K_M · 21.13125 GB · ~126 tok/s on AMD Radeon RX 7900 XTX |
| DeepSeek R1 — DeepSeek R1 Distill Qwen 14B | Q4_K_M · 8.4525 GB · ~55 tok/s on AMD Radeon RX 7900 XTX |
| Phi-4 Family — Phi-4 (14B) | Q4_K_M · 8.4525 GB · ~54 tok/s on AMD Radeon RX 7900 XTX |
| Gemma 4 — Gemma 4 31B | Q4_K_M · 18.71625 GB · ~29 tok/s on AMD Radeon RX 7900 XTX |
| Qwen 3.5 (Legacy Listing — Unverified) — Qwen 3.5 32B | Q4_K_M · 19.32 GB · ~28 tok/s on AMD Radeon RX 7900 XTX |
| Gemma 3 — Gemma 3 27B Instruct | Q4_K_M · 16.30125 GB · ~28 tok/s on AMD Radeon RX 7900 XTX |
or compare on Vast.ai from $0.35/hr (typical low · varies)
As an Amazon Associate we earn from qualifying purchases. Cloud GPU links are referral links — we may earn a commission at no extra cost to you.
Qwen 2.5 Family, Llama 3.3, Qwen 3, DeepSeek R1, Qwen 2.5 Family all fit in 24 GB VRAM.
AMD Radeon RX 7900 XTX, Apple M2, Apple M3, NVIDIA GeForce RTX 3090.