Ce que votre machine fait vraiment tourner : IA locale et jeu vidéo, chiffres à l'appui.

NVIDIA · Carte graphique

Fin de vie

GeForce RTX 3060 12 Go et IA locale

Les modèles qui tournent dessus, et à quelle vitesse.

Longtemps le ticket d'entrée de l'IA locale grâce à ses 12 Go. Fin de production : sur Amazon elle passe par des vendeurs tiers, souvent au-dessus du prix d'une carte récente et plus rapide. Excellente si vous l'avez déjà, mauvaise affaire à l'achat.

Notre verdict

12,0 Go
Modèles12/21

12 des 21 modèles de notre sélection tournent correctement sur cette machine, en quantification recommandée avec 8k de contexte. Le plus gros est Qwen2.5 (14B). Au-delà, ce n'est pas la vitesse qui bloque mais la mémoire : 12,0 Go utilisables.

Caractéristiques

VRAM
12 Go
Allouable au modèle
12,0 Go
Bande passante
360 Go/s
Disponibilité
Fin de vie

Caractéristiques vérifiées le 2026-09-01 · Fiche technique NVIDIA

Cette configuration se commande chez le constructeur, pas chez nos partenaires.

Modèle par modèle

En quantification recommandée, avec 8k de contexte. Une vitesse n'est affichée que si le modèle tient réellement en mémoire.

ModèleQuantificationRequisTok/sVerdict
Qwen2.5 (14B)Q4_K_M11,1 Go31Recommandé
Phi-4 (14B)Q4_K_M11,1 Go31Recommandé
Gemma 3 (12B)Q4_K_M9,0 Go37Recommandé
Gemma 2 (9B)Q4_K_M8,4 Go49Recommandé
Qwen3 (8B)Q4_K_M7,0 Go55Recommandé
Llama 3.1 (8B)Q4_K_M6,8 Go57Recommandé
DeepSeek-R1 Distill Llama (8B)Q4_K_M6,8 Go57Recommandé
Qwen2.5 (7B)Q4_K_M6,0 Go60Recommandé
DeepSeek-R1 Distill Qwen (7B)Q4_K_M6,0 Go60Recommandé
Mistral 7B (v0.3)Q4_K_M6,3 Go63Recommandé
Gemma 3 (4B)Q4_K_M3,9 Go106Recommandé
Llama 3.2 (3B)Q4_K_M3,9 Go142Recommandé
Llama 3.3 (70B)Q4_K_M44,0 GoInsuffisant
Ornith-1.5 35B-A3B (MoE)Q4_K_M22,3 GoInsuffisant
Qwen2.5 (32B)Q4_K_M21,9 GoInsuffisant
Qwen3 (32B)Q4_K_M21,9 GoInsuffisant
DeepSeek-R1 Distill Qwen (32B)Q4_K_M21,9 GoInsuffisant
Qwen3 30B-A3B (MoE)Q4_K_M19,3 GoInsuffisant
Gemma 3 (27B)Q4_K_M17,9 GoInsuffisant
Mistral Small 3 (24B)Q4_K_M15,9 GoInsuffisant
gpt-oss 20B (MoE)Q4_K_M13,3 GoInsuffisant

Génération d'images

Questions fréquentes

Les réponses courtes

Quels modèles d'IA tournent sur GeForce RTX 3060 12 Go ?
12 des 21 modèles de notre sélection, en quantification recommandée avec 8k de contexte. Le plus gros est Qwen2.5 (14B), à environ 31 tokens par seconde.
Combien de mémoire de GeForce RTX 3060 12 Go est réellement utilisable ?
Les 12 Go sont adressables, mais l'affichage en consomme déjà près de 0,8 Go — il reste donc environ 11,2 Go pour le modèle. Notre calcul ajoute cette réserve au besoin du modèle plutôt que de la retrancher de la carte, ce qui revient au même.
GeForce RTX 3060 12 Go suffit-elle pour un modèle d'environ 30 milliards de paramètres ?
Non, pas confortablement : Qwen3 30B-A3B (MoE) (30,5 Md) demande 19,3 Go en quantification recommandée, soit 7,3 Go de trop. Il faudrait descendre en Q3 ou raccourcir le contexte.

À comparer