Apple · Mémoire unifiée
Mac Mini M5 Pro (24 Go) et IA locale
Les modèles qui tournent dessus, et à quelle vitesse.
307 Go/s, près du double d'un M6 — mais 16,1 Go allouables seulement sur cette configuration de base, le plafond d'une carte de 16 Go pour trois fois le prix. L'intérêt du M5 Pro est ailleurs : il se configure jusqu'à 64 Go à la même bande passante, et c'est cette version-là qui avale les gros modèles. Elle se commande chez Apple, pas sur Amazon.
Notre verdict
16,1 Go14 des 21 modèles de notre sélection tournent correctement sur cette machine, en quantification recommandée avec 8k de contexte. Le plus gros est Mistral Small 3 (24B). Au-delà, ce n'est pas la vitesse qui bloque mais la mémoire : 16,1 Go utilisables.
Caractéristiques
- Mémoire unifiée
- 24 Go
- Allouable au modèle
- 16,1 Go
- Bande passante
- 307 Go/s
- Disponibilité
- En vente
Sur Mac, la mémoire est partagée entre le processeur et le GPU, et macOS n'en laisse qu'une partie au modèle — 16,1 Go ici. C'est plus souple qu'une carte graphique, mais la bande passante, elle, plafonne la vitesse de génération bien plus tôt.
Caractéristiques vérifiées le 2026-09-01 · Caractéristiques Apple du Mac mini
Où l'acheter
Mac Mini M5 Pro (24 Go)
2 000 € constaté le 2026-09-01
Modèle par modèle
En quantification recommandée, avec 8k de contexte. Une vitesse n'est affichée que si le modèle tient réellement en mémoire.
| Modèle | Quantification | Requis | Tok/s | Verdict |
|---|---|---|---|---|
| Mistral Small 3 (24B) | Q4_K_M | 15,1 Go | 16 | Recommandé |
| gpt-oss 20B (MoE) | Q4_K_M | 12,5 Go | 108 | Recommandé |
| Qwen2.5 (14B) | Q4_K_M | 10,3 Go | 26 | Recommandé |
| Phi-4 (14B) | Q4_K_M | 10,3 Go | 26 | Recommandé |
| Gemma 3 (12B) | Q4_K_M | 8,2 Go | 32 | Recommandé |
| Gemma 2 (9B) | Q4_K_M | 7,6 Go | 42 | Recommandé |
| Qwen3 (8B) | Q4_K_M | 6,2 Go | 47 | Recommandé |
| Llama 3.1 (8B) | Q4_K_M | 6,0 Go | 48 | Recommandé |
| DeepSeek-R1 Distill Llama (8B) | Q4_K_M | 6,0 Go | 48 | Recommandé |
| Qwen2.5 (7B) | Q4_K_M | 5,2 Go | 51 | Recommandé |
| DeepSeek-R1 Distill Qwen (7B) | Q4_K_M | 5,2 Go | 51 | Recommandé |
| Mistral 7B (v0.3) | Q4_K_M | 5,5 Go | 53 | Recommandé |
| Gemma 3 (4B) | Q4_K_M | 3,1 Go | 90 | Recommandé |
| Llama 3.2 (3B) | Q4_K_M | 3,1 Go | 121 | Recommandé |
| Llama 3.3 (70B) | Q4_K_M | 43,2 Go | — | Insuffisant |
| Ornith-1.5 35B-A3B (MoE) | Q4_K_M | 21,5 Go | — | Insuffisant |
| Qwen2.5 (32B) | Q4_K_M | 21,1 Go | — | Insuffisant |
| Qwen3 (32B) | Q4_K_M | 21,1 Go | — | Insuffisant |
| DeepSeek-R1 Distill Qwen (32B) | Q4_K_M | 21,1 Go | — | Insuffisant |
| Qwen3 30B-A3B (MoE) | Q4_K_M | 18,5 Go | — | Insuffisant |
| Gemma 3 (27B) | Q4_K_M | 17,1 Go | — | Insuffisant |
Génération d'images
- Flux.1 Schnell
Passe en FP8, GGUF Q4.
- Flux.1 Dev
Passe en FP8, GGUF Q4.
- Stable Diffusion XL
Passe en FP16, FP16 + offload.
Questions fréquentes
Les réponses courtes
- Quels modèles d'IA tournent sur Mac Mini M5 Pro (24 Go) ?
- 14 des 21 modèles de notre sélection, en quantification recommandée avec 8k de contexte. Le plus gros est Mistral Small 3 (24B), à environ 16 tokens par seconde.
- Combien de mémoire de Mac Mini M5 Pro (24 Go) est réellement utilisable ?
- 16,1 Go sur 24 Go : sur Mac, la mémoire est partagée avec le processeur et macOS n'en laisse qu'une partie au modèle.
- Mac Mini M5 Pro (24 Go) suffit-elle pour un modèle d'environ 30 milliards de paramètres ?
- Non, pas confortablement : Qwen3 30B-A3B (MoE) (30,5 Md) demande 18,5 Go en quantification recommandée, soit 2,4 Go de trop. Il faudrait descendre en Q3 ou raccourcir le contexte.
À comparer