AMD · Carte graphique
Radeon RX 9070 XT 16 Go et IA locale
Les modèles qui tournent dessus, et à quelle vitesse.
16 Go en neuf à un prix que NVIDIA ne propose qu'en 12 Go, et la seule carte AMD actuelle de ce catalogue. Sa bande passante la place derrière une RTX 5070 Ti à mémoire égale, et son vrai coût n'est pas là : ROCm marche, mais demande plus de patience que CUDA et plusieurs outils supposent encore NVIDIA. À prendre si le prix par gigaoctet prime sur le confort d'installation.
Notre verdict
16,0 Go13 des 21 modèles de notre sélection tournent correctement sur cette machine, en quantification recommandée avec 8k de contexte. Le plus gros est gpt-oss 20B (MoE). Au-delà, ce n'est pas la vitesse qui bloque mais la mémoire : 16,0 Go utilisables.
Caractéristiques
- VRAM
- 16 Go
- Allouable au modèle
- 16,0 Go
- Bande passante
- 645 Go/s
- Disponibilité
- En vente
Caractéristiques vérifiées le 2026-09-01 · Fiche technique AMD
Où l'acheter
Radeon RX 9070 XT 16 Go
850 € constaté le 2026-09-01
Modèle par modèle
En quantification recommandée, avec 8k de contexte. Une vitesse n'est affichée que si le modèle tient réellement en mémoire.
| Modèle | Quantification | Requis | Tok/s | Verdict |
|---|---|---|---|---|
| gpt-oss 20B (MoE) | Q4_K_M | 13,3 Go | 226 | Recommandé |
| Qwen2.5 (14B) | Q4_K_M | 11,1 Go | 55 | Recommandé |
| Phi-4 (14B) | Q4_K_M | 11,1 Go | 55 | Recommandé |
| Gemma 3 (12B) | Q4_K_M | 9,0 Go | 67 | Recommandé |
| Gemma 2 (9B) | Q4_K_M | 8,4 Go | 88 | Recommandé |
| Qwen3 (8B) | Q4_K_M | 7,0 Go | 99 | Recommandé |
| Llama 3.1 (8B) | Q4_K_M | 6,8 Go | 101 | Recommandé |
| DeepSeek-R1 Distill Llama (8B) | Q4_K_M | 6,8 Go | 101 | Recommandé |
| Qwen2.5 (7B) | Q4_K_M | 6,0 Go | 107 | Recommandé |
| DeepSeek-R1 Distill Qwen (7B) | Q4_K_M | 6,0 Go | 107 | Recommandé |
| Mistral 7B (v0.3) | Q4_K_M | 6,3 Go | 112 | Recommandé |
| Gemma 3 (4B) | Q4_K_M | 3,9 Go | 189 | Recommandé |
| Llama 3.2 (3B) | Q4_K_M | 3,9 Go | 254 | Recommandé |
| Mistral Small 3 (24B) | Q4_K_M | 15,9 Go | 34 | Limite |
| Llama 3.3 (70B) | Q4_K_M | 44,0 Go | — | Insuffisant |
| Ornith-1.5 35B-A3B (MoE) | Q4_K_M | 22,3 Go | — | Insuffisant |
| Qwen2.5 (32B) | Q4_K_M | 21,9 Go | — | Insuffisant |
| Qwen3 (32B) | Q4_K_M | 21,9 Go | — | Insuffisant |
| DeepSeek-R1 Distill Qwen (32B) | Q4_K_M | 21,9 Go | — | Insuffisant |
| Qwen3 30B-A3B (MoE) | Q4_K_M | 19,3 Go | — | Insuffisant |
| Gemma 3 (27B) | Q4_K_M | 17,9 Go | — | Insuffisant |
Génération d'images
- Flux.1 Schnell
Passe en FP8, GGUF Q4.
- Flux.1 Dev
Passe en FP8, GGUF Q4.
- Stable Diffusion XL
Passe en FP16, FP16 + offload.
Questions fréquentes
Les réponses courtes
- Quels modèles d'IA tournent sur Radeon RX 9070 XT 16 Go ?
- 13 des 21 modèles de notre sélection, en quantification recommandée avec 8k de contexte. Le plus gros est gpt-oss 20B (MoE), à environ 226 tokens par seconde.
- Combien de mémoire de Radeon RX 9070 XT 16 Go est réellement utilisable ?
- Les 16 Go sont adressables, mais l'affichage en consomme déjà près de 0,8 Go — il reste donc environ 15,2 Go pour le modèle. Notre calcul ajoute cette réserve au besoin du modèle plutôt que de la retrancher de la carte, ce qui revient au même.
- Radeon RX 9070 XT 16 Go suffit-elle pour un modèle d'environ 30 milliards de paramètres ?
- Non, pas confortablement : Qwen3 30B-A3B (MoE) (30,5 Md) demande 19,3 Go en quantification recommandée, soit 3,3 Go de trop. Il faudrait descendre en Q3 ou raccourcir le contexte.
À comparer