Ce que votre machine fait vraiment tourner : IA locale et jeu vidéo, chiffres à l'appui.

NVIDIA · Carte graphique

GeForce RTX 5080 16 Go et IA locale

Les modèles qui tournent dessus, et à quelle vitesse.

Excellente en jeu, mais toujours 16 Go : elle ne fait tourner aucun modèle qu'une 5060 Ti à 660 € ne fait pas déjà tourner. Elle le fait plus vite, c'est tout.

Notre verdict

16,0 Go
Modèles13/21

13 des 21 modèles de notre sélection tournent correctement sur cette machine, en quantification recommandée avec 8k de contexte. Le plus gros est gpt-oss 20B (MoE). Au-delà, ce n'est pas la vitesse qui bloque mais la mémoire : 16,0 Go utilisables.

Caractéristiques

VRAM
16 Go
Allouable au modèle
16,0 Go
Bande passante
960 Go/s
Disponibilité
En vente

Caractéristiques vérifiées le 2026-09-01 · Fiche technique NVIDIA

Où l'acheter

GeForce RTX 5080 16 Go

1 440 € constaté le 2026-09-01

Voir sur Amazon

Modèle par modèle

En quantification recommandée, avec 8k de contexte. Une vitesse n'est affichée que si le modèle tient réellement en mémoire.

ModèleQuantificationRequisTok/sVerdict
gpt-oss 20B (MoE)Q4_K_M13,3 Go337Recommandé
Qwen2.5 (14B)Q4_K_M11,1 Go82Recommandé
Phi-4 (14B)Q4_K_M11,1 Go82Recommandé
Gemma 3 (12B)Q4_K_M9,0 Go99Recommandé
Gemma 2 (9B)Q4_K_M8,4 Go131Recommandé
Qwen3 (8B)Q4_K_M7,0 Go148Recommandé
Llama 3.1 (8B)Q4_K_M6,8 Go151Recommandé
DeepSeek-R1 Distill Llama (8B)Q4_K_M6,8 Go151Recommandé
Qwen2.5 (7B)Q4_K_M6,0 Go159Recommandé
DeepSeek-R1 Distill Qwen (7B)Q4_K_M6,0 Go159Recommandé
Mistral 7B (v0.3)Q4_K_M6,3 Go167Recommandé
Gemma 3 (4B)Q4_K_M3,9 Go282Recommandé
Llama 3.2 (3B)Q4_K_M3,9 Go377Recommandé
Mistral Small 3 (24B)Q4_K_M15,9 Go51Limite
Llama 3.3 (70B)Q4_K_M44,0 GoInsuffisant
Ornith-1.5 35B-A3B (MoE)Q4_K_M22,3 GoInsuffisant
Qwen2.5 (32B)Q4_K_M21,9 GoInsuffisant
Qwen3 (32B)Q4_K_M21,9 GoInsuffisant
DeepSeek-R1 Distill Qwen (32B)Q4_K_M21,9 GoInsuffisant
Qwen3 30B-A3B (MoE)Q4_K_M19,3 GoInsuffisant
Gemma 3 (27B)Q4_K_M17,9 GoInsuffisant

Génération d'images

Questions fréquentes

Les réponses courtes

Quels modèles d'IA tournent sur GeForce RTX 5080 16 Go ?
13 des 21 modèles de notre sélection, en quantification recommandée avec 8k de contexte. Le plus gros est gpt-oss 20B (MoE), à environ 337 tokens par seconde.
Combien de mémoire de GeForce RTX 5080 16 Go est réellement utilisable ?
Les 16 Go sont adressables, mais l'affichage en consomme déjà près de 0,8 Go — il reste donc environ 15,2 Go pour le modèle. Notre calcul ajoute cette réserve au besoin du modèle plutôt que de la retrancher de la carte, ce qui revient au même.
GeForce RTX 5080 16 Go suffit-elle pour un modèle d'environ 30 milliards de paramètres ?
Non, pas confortablement : Qwen3 30B-A3B (MoE) (30,5 Md) demande 19,3 Go en quantification recommandée, soit 3,3 Go de trop. Il faudrait descendre en Q3 ou raccourcir le contexte.

À comparer