Ce que votre machine fait vraiment tourner : IA locale et jeu vidéo, chiffres à l'appui.

NVIDIA · Carte graphique

GeForce RTX 5060 Ti 8 Go et IA locale

Les modèles qui tournent dessus, et à quelle vitesse.

Même puce et même bande passante que la 5060 Ti 16 Go, pour la moitié de la mémoire. En jeu l'écart est discutable ; en IA locale il est décisif, et les 200 € d'écart avec la version 16 Go sont le meilleur euro que vous puissiez dépenser. À ne prendre que si vous l'avez déjà.

Notre verdict

8,0 Go
Modèles8/21

8 des 21 modèles de notre sélection tournent correctement sur cette machine, en quantification recommandée avec 8k de contexte. Le plus gros est Qwen3 (8B). Au-delà, ce n'est pas la vitesse qui bloque mais la mémoire : 8,0 Go utilisables.

Caractéristiques

VRAM
8 Go
Allouable au modèle
8,0 Go
Bande passante
448 Go/s
Disponibilité
En vente

Caractéristiques vérifiées le 2026-09-01 · Fiche technique NVIDIA

Cette configuration se commande chez le constructeur, pas chez nos partenaires.

Modèle par modèle

En quantification recommandée, avec 8k de contexte. Une vitesse n'est affichée que si le modèle tient réellement en mémoire.

ModèleQuantificationRequisTok/sVerdict
Qwen3 (8B)Q4_K_M7,0 Go69Recommandé
Llama 3.1 (8B)Q4_K_M6,8 Go70Recommandé
DeepSeek-R1 Distill Llama (8B)Q4_K_M6,8 Go70Recommandé
Qwen2.5 (7B)Q4_K_M6,0 Go74Recommandé
DeepSeek-R1 Distill Qwen (7B)Q4_K_M6,0 Go74Recommandé
Mistral 7B (v0.3)Q4_K_M6,3 Go78Recommandé
Gemma 3 (4B)Q4_K_M3,9 Go132Recommandé
Llama 3.2 (3B)Q4_K_M3,9 Go176Recommandé
Llama 3.3 (70B)Q4_K_M44,0 GoInsuffisant
Ornith-1.5 35B-A3B (MoE)Q4_K_M22,3 GoInsuffisant
Qwen2.5 (32B)Q4_K_M21,9 GoInsuffisant
Qwen3 (32B)Q4_K_M21,9 GoInsuffisant
DeepSeek-R1 Distill Qwen (32B)Q4_K_M21,9 GoInsuffisant
Qwen3 30B-A3B (MoE)Q4_K_M19,3 GoInsuffisant
Gemma 3 (27B)Q4_K_M17,9 GoInsuffisant
Mistral Small 3 (24B)Q4_K_M15,9 GoInsuffisant
gpt-oss 20B (MoE)Q4_K_M13,3 GoInsuffisant
Qwen2.5 (14B)Q4_K_M11,1 GoInsuffisant
Phi-4 (14B)Q4_K_M11,1 GoInsuffisant
Gemma 3 (12B)Q4_K_M9,0 GoInsuffisant
Gemma 2 (9B)Q4_K_M8,4 GoInsuffisant

Génération d'images

Questions fréquentes

Les réponses courtes

Quels modèles d'IA tournent sur GeForce RTX 5060 Ti 8 Go ?
8 des 21 modèles de notre sélection, en quantification recommandée avec 8k de contexte. Le plus gros est Qwen3 (8B), à environ 69 tokens par seconde.
Combien de mémoire de GeForce RTX 5060 Ti 8 Go est réellement utilisable ?
Les 8 Go sont adressables, mais l'affichage en consomme déjà près de 0,8 Go — il reste donc environ 7,2 Go pour le modèle. Notre calcul ajoute cette réserve au besoin du modèle plutôt que de la retrancher de la carte, ce qui revient au même.
GeForce RTX 5060 Ti 8 Go suffit-elle pour un modèle d'environ 30 milliards de paramètres ?
Non, pas confortablement : Qwen3 30B-A3B (MoE) (30,5 Md) demande 19,3 Go en quantification recommandée, soit 11,3 Go de trop. Il faudrait descendre en Q3 ou raccourcir le contexte.

À comparer