Ce que votre machine fait vraiment tourner : IA locale et jeu vidéo, chiffres à l'appui.

NVIDIA · Carte graphique

Occasion

GeForce RTX 3090 24 Go et IA locale

Les modèles qui tournent dessus, et à quelle vitesse.

La carte préférée de la communauté IA locale : 24 Go et près de 1 To/s pour le prix d'une carte milieu de gamme. Uniquement en occasion, donc sans lien marchand — mais c'est le meilleur rapport capacité/prix du moment si vous acceptez ce marché.

Notre verdict

24,0 Go
Modèles20/21

20 des 21 modèles de notre sélection tournent correctement sur cette machine, en quantification recommandée avec 8k de contexte. Le plus gros est Ornith-1.5 35B-A3B (MoE). Au-delà, ce n'est pas la vitesse qui bloque mais la mémoire : 24,0 Go utilisables.

Caractéristiques

VRAM
24 Go
Allouable au modèle
24,0 Go
Bande passante
936 Go/s
Disponibilité
Occasion

Caractéristiques vérifiées le 2026-09-01 · Fiche technique NVIDIA

Occasion uniquement, pas de lien partenaire.

Modèle par modèle

En quantification recommandée, avec 8k de contexte. Une vitesse n'est affichée que si le modèle tient réellement en mémoire.

ModèleQuantificationRequisTok/sVerdict
Ornith-1.5 35B-A3B (MoE)Q4_K_M22,3 Go394Recommandé
Qwen2.5 (32B)Q4_K_M21,9 Go36Recommandé
Qwen3 (32B)Q4_K_M21,9 Go36Recommandé
DeepSeek-R1 Distill Qwen (32B)Q4_K_M21,9 Go36Recommandé
Qwen3 30B-A3B (MoE)Q4_K_M19,3 Go358Recommandé
Gemma 3 (27B)Q4_K_M17,9 Go43Recommandé
Mistral Small 3 (24B)Q4_K_M15,9 Go50Recommandé
gpt-oss 20B (MoE)Q4_K_M13,3 Go328Recommandé
Qwen2.5 (14B)Q4_K_M11,1 Go80Recommandé
Phi-4 (14B)Q4_K_M11,1 Go80Recommandé
Gemma 3 (12B)Q4_K_M9,0 Go97Recommandé
Gemma 2 (9B)Q4_K_M8,4 Go128Recommandé
Qwen3 (8B)Q4_K_M7,0 Go144Recommandé
Llama 3.1 (8B)Q4_K_M6,8 Go147Recommandé
DeepSeek-R1 Distill Llama (8B)Q4_K_M6,8 Go147Recommandé
Qwen2.5 (7B)Q4_K_M6,0 Go155Recommandé
DeepSeek-R1 Distill Qwen (7B)Q4_K_M6,0 Go155Recommandé
Mistral 7B (v0.3)Q4_K_M6,3 Go163Recommandé
Gemma 3 (4B)Q4_K_M3,9 Go275Recommandé
Llama 3.2 (3B)Q4_K_M3,9 Go368Recommandé
Llama 3.3 (70B)Q4_K_M44,0 GoInsuffisant

Génération d'images

Questions fréquentes

Les réponses courtes

Quels modèles d'IA tournent sur GeForce RTX 3090 24 Go ?
20 des 21 modèles de notre sélection, en quantification recommandée avec 8k de contexte. Le plus gros est Ornith-1.5 35B-A3B (MoE), à environ 394 tokens par seconde.
Combien de mémoire de GeForce RTX 3090 24 Go est réellement utilisable ?
Les 24 Go sont adressables, mais l'affichage en consomme déjà près de 0,8 Go — il reste donc environ 23,2 Go pour le modèle. Notre calcul ajoute cette réserve au besoin du modèle plutôt que de la retrancher de la carte, ce qui revient au même.
GeForce RTX 3090 24 Go suffit-elle pour un modèle d'environ 30 milliards de paramètres ?
Oui. Qwen3 30B-A3B (MoE) (30,5 Md) y tourne avec 4,7 Go de marge, à environ 358 tokens par seconde.

À comparer