Best LLMs for 24 GB VRAM

Autor: Jakub Rusinowski · Ostatnia aktualizacja: 26 czerwca 2026

These are the strongest local models that fit entirely in 24 GB of VRAM, ranked by capability, with the quantization level and estimated tokens/sec needed to fit.

GPUs at This Tier

Ranked Models

Qwen 2.5 Family — Qwen 2.5 Coder 32BQ4_K_M · 19.32 GB · ~28 tok/s on AMD Radeon RX 7900 XTX
Llama 3.3 — Llama 3.3 70B InstructQ2_K_XS (Tight) · 20.212500000000002 GB · ~26 tok/s on AMD Radeon RX 7900 XTX
Qwen 3 — Qwen 3 32BQ4_K_M · 19.802999999999997 GB · ~27 tok/s on AMD Radeon RX 7900 XTX
DeepSeek R1 — DeepSeek R1 Distill Qwen 32BQ4_K_M · 19.32 GB · ~28 tok/s on AMD Radeon RX 7900 XTX
Qwen 2.5 Family — Qwen 2.5 14B InstructQ4_K_M · 8.4525 GB · ~55 tok/s on AMD Radeon RX 7900 XTX
Gemma 4 (Legacy Listing — Unverified) — Gemma 4 27B ⭐Q4_K_M · 16.30125 GB · ~32 tok/s on AMD Radeon RX 7900 XTX
Qwen 3 — Qwen 3 14BQ4_K_M · 8.935500000000001 GB · ~53 tok/s on AMD Radeon RX 7900 XTX
Qwen 3.7 — Qwen 3.7 35B-A3BQ4_K_M · 21.13125 GB · ~126 tok/s on AMD Radeon RX 7900 XTX
Codestral — Codestral 22BQ4_K_M · 13.40325 GB · ~38 tok/s on AMD Radeon RX 7900 XTX
Qwen 3.6 — Qwen 3.6 35B-A3BQ4_K_M · 21.13125 GB · ~126 tok/s on AMD Radeon RX 7900 XTX
DeepSeek R1 — DeepSeek R1 Distill Qwen 14BQ4_K_M · 8.4525 GB · ~55 tok/s on AMD Radeon RX 7900 XTX
Phi-4 Family — Phi-4 (14B)Q4_K_M · 8.4525 GB · ~54 tok/s on AMD Radeon RX 7900 XTX
Gemma 4 — Gemma 4 31BQ4_K_M · 18.71625 GB · ~29 tok/s on AMD Radeon RX 7900 XTX
Qwen 3.5 (Legacy Listing — Unverified) — Qwen 3.5 32BQ4_K_M · 19.32 GB · ~28 tok/s on AMD Radeon RX 7900 XTX
Gemma 3 — Gemma 3 27B InstructQ4_K_M · 16.30125 GB · ~28 tok/s on AMD Radeon RX 7900 XTX
Buy This HardwareAMD Radeon RX 7900 XTX 24GB — 24 GB VRAM · 355 W board powerDeploy in the Cloud NowRTX 4090 on RunPod — from $0.34/hr · rate checked 2026-07

or compare on Vast.ai from $0.35/hr (typical low · varies)

As an Amazon Associate we earn from qualifying purchases. Cloud GPU links are referral links — we may earn a commission at no extra cost to you.

FAQ

What LLMs run well with 24 GB VRAM?

Qwen 2.5 Family, Llama 3.3, Qwen 3, DeepSeek R1, Qwen 2.5 Family all fit in 24 GB VRAM.

Which GPUs have 24 GB VRAM?

AMD Radeon RX 7900 XTX, Apple M2, Apple M3, NVIDIA GeForce RTX 3090.

Can-I-Run Pages Near 24 GB

Adjacent VRAM Tiers

No discrete GPU?

Buying Guide

← All VRAM Tiers | Check Your Hardware