Apple · Mémoire unifiée
Fin de vieMac Mini M4 Pro (64 Go) et IA locale
Les modèles qui tournent dessus, et à quelle vitesse.
48 Go allouables au modèle et 273 Go/s : il avalait un 70B qu'aucune carte grand public ne charge. Génération précédente, remplacée par le Mac Mini M5 Pro, plus rapide à mémoire égale.
Notre verdict
48,0 Go20 des 21 modèles de notre sélection tournent correctement sur cette machine, en quantification recommandée avec 8k de contexte. Le plus gros est Ornith-1.5 35B-A3B (MoE). Au-delà, ce n'est pas la vitesse qui bloque mais la mémoire : 48,0 Go utilisables.
Caractéristiques
- Mémoire unifiée
- 64 Go
- Allouable au modèle
- 48,0 Go
- Bande passante
- 273 Go/s
- Disponibilité
- Fin de vie
Sur Mac, la mémoire est partagée entre le processeur et le GPU, et macOS n'en laisse qu'une partie au modèle — 48,0 Go ici. C'est plus souple qu'une carte graphique, mais la bande passante, elle, plafonne la vitesse de génération bien plus tôt.
Caractéristiques vérifiées le 2026-09-01 · Caractéristiques Apple du Mac mini (2024)
Cette configuration se commande chez le constructeur, pas chez nos partenaires.
Modèle par modèle
En quantification recommandée, avec 8k de contexte. Une vitesse n'est affichée que si le modèle tient réellement en mémoire.
| Modèle | Quantification | Requis | Tok/s | Verdict |
|---|---|---|---|---|
| Ornith-1.5 35B-A3B (MoE) | Q4_K_M | 21,5 Go | 115 | Recommandé |
| Qwen2.5 (32B) | Q4_K_M | 21,1 Go | 11 | Recommandé |
| Qwen3 (32B) | Q4_K_M | 21,1 Go | 11 | Recommandé |
| DeepSeek-R1 Distill Qwen (32B) | Q4_K_M | 21,1 Go | 11 | Recommandé |
| Qwen3 30B-A3B (MoE) | Q4_K_M | 18,5 Go | 104 | Recommandé |
| Gemma 3 (27B) | Q4_K_M | 17,1 Go | 13 | Recommandé |
| Mistral Small 3 (24B) | Q4_K_M | 15,1 Go | 15 | Recommandé |
| gpt-oss 20B (MoE) | Q4_K_M | 12,5 Go | 96 | Recommandé |
| Qwen2.5 (14B) | Q4_K_M | 10,3 Go | 23 | Recommandé |
| Phi-4 (14B) | Q4_K_M | 10,3 Go | 23 | Recommandé |
| Gemma 3 (12B) | Q4_K_M | 8,2 Go | 28 | Recommandé |
| Gemma 2 (9B) | Q4_K_M | 7,6 Go | 37 | Recommandé |
| Qwen3 (8B) | Q4_K_M | 6,2 Go | 42 | Recommandé |
| Llama 3.1 (8B) | Q4_K_M | 6,0 Go | 43 | Recommandé |
| DeepSeek-R1 Distill Llama (8B) | Q4_K_M | 6,0 Go | 43 | Recommandé |
| Qwen2.5 (7B) | Q4_K_M | 5,2 Go | 45 | Recommandé |
| DeepSeek-R1 Distill Qwen (7B) | Q4_K_M | 5,2 Go | 45 | Recommandé |
| Mistral 7B (v0.3) | Q4_K_M | 5,5 Go | 48 | Recommandé |
| Gemma 3 (4B) | Q4_K_M | 3,1 Go | 80 | Recommandé |
| Llama 3.2 (3B) | Q4_K_M | 3,1 Go | 107 | Recommandé |
| Llama 3.3 (70B) | Q4_K_M | 43,2 Go | 5 | Limite |
Génération d'images
- Flux.1 Schnell
Passe en FP16, FP8, GGUF Q4.
- Flux.1 Dev
Passe en FP16, FP8, GGUF Q4.
- Stable Diffusion XL
Passe en FP16, FP16 + offload.
Questions fréquentes
Les réponses courtes
- Quels modèles d'IA tournent sur Mac Mini M4 Pro (64 Go) ?
- 20 des 21 modèles de notre sélection, en quantification recommandée avec 8k de contexte. Le plus gros est Ornith-1.5 35B-A3B (MoE), à environ 115 tokens par seconde.
- Combien de mémoire de Mac Mini M4 Pro (64 Go) est réellement utilisable ?
- 48,0 Go sur 64 Go : sur Mac, la mémoire est partagée avec le processeur et macOS n'en laisse qu'une partie au modèle.
- Mac Mini M4 Pro (64 Go) suffit-elle pour un modèle d'environ 30 milliards de paramètres ?
- Oui. Qwen3 30B-A3B (MoE) (30,5 Md) y tourne avec 29,5 Go de marge, à environ 104 tokens par seconde.
À comparer