Ce que votre machine fait vraiment tourner : IA locale et jeu vidéo, chiffres à l'appui.

Apple · Mémoire unifiée

Mac Mini M5 Pro (64 Go) et IA locale

Les modèles qui tournent dessus, et à quelle vitesse.

48 Go allouables au modèle : il avale un 70B qu'aucune carte grand public ne charge, et tient les modèles de 32 milliards de paramètres avec de la marge sur le contexte. 307 Go/s, soit une vitesse de lecture tranquille plutôt qu'un débit de carte dédiée. Cette configuration mémoire se commande chez Apple, pas sur Amazon.

Notre verdict

48,0 Go
Modèles20/21

20 des 21 modèles de notre sélection tournent correctement sur cette machine, en quantification recommandée avec 8k de contexte. Le plus gros est Ornith-1.5 35B-A3B (MoE). Au-delà, ce n'est pas la vitesse qui bloque mais la mémoire : 48,0 Go utilisables.

Caractéristiques

Mémoire unifiée
64 Go
Allouable au modèle
48,0 Go
Bande passante
307 Go/s
Disponibilité
En vente

Sur Mac, la mémoire est partagée entre le processeur et le GPU, et macOS n'en laisse qu'une partie au modèle — 48,0 Go ici. C'est plus souple qu'une carte graphique, mais la bande passante, elle, plafonne la vitesse de génération bien plus tôt.

Caractéristiques vérifiées le 2026-09-01 · Caractéristiques Apple du Mac mini

Cette configuration se commande chez le constructeur, pas chez nos partenaires.

Modèle par modèle

En quantification recommandée, avec 8k de contexte. Une vitesse n'est affichée que si le modèle tient réellement en mémoire.

ModèleQuantificationRequisTok/sVerdict
Ornith-1.5 35B-A3B (MoE)Q4_K_M21,5 Go129Recommandé
Qwen2.5 (32B)Q4_K_M21,1 Go12Recommandé
Qwen3 (32B)Q4_K_M21,1 Go12Recommandé
DeepSeek-R1 Distill Qwen (32B)Q4_K_M21,1 Go12Recommandé
Qwen3 30B-A3B (MoE)Q4_K_M18,5 Go117Recommandé
Gemma 3 (27B)Q4_K_M17,1 Go14Recommandé
Mistral Small 3 (24B)Q4_K_M15,1 Go16Recommandé
gpt-oss 20B (MoE)Q4_K_M12,5 Go108Recommandé
Qwen2.5 (14B)Q4_K_M10,3 Go26Recommandé
Phi-4 (14B)Q4_K_M10,3 Go26Recommandé
Gemma 3 (12B)Q4_K_M8,2 Go32Recommandé
Gemma 2 (9B)Q4_K_M7,6 Go42Recommandé
Qwen3 (8B)Q4_K_M6,2 Go47Recommandé
Llama 3.1 (8B)Q4_K_M6,0 Go48Recommandé
DeepSeek-R1 Distill Llama (8B)Q4_K_M6,0 Go48Recommandé
Qwen2.5 (7B)Q4_K_M5,2 Go51Recommandé
DeepSeek-R1 Distill Qwen (7B)Q4_K_M5,2 Go51Recommandé
Mistral 7B (v0.3)Q4_K_M5,5 Go53Recommandé
Gemma 3 (4B)Q4_K_M3,1 Go90Recommandé
Llama 3.2 (3B)Q4_K_M3,1 Go121Recommandé
Llama 3.3 (70B)Q4_K_M43,2 Go5Limite

Génération d'images

Questions fréquentes

Les réponses courtes

Quels modèles d'IA tournent sur Mac Mini M5 Pro (64 Go) ?
20 des 21 modèles de notre sélection, en quantification recommandée avec 8k de contexte. Le plus gros est Ornith-1.5 35B-A3B (MoE), à environ 129 tokens par seconde.
Combien de mémoire de Mac Mini M5 Pro (64 Go) est réellement utilisable ?
48,0 Go sur 64 Go : sur Mac, la mémoire est partagée avec le processeur et macOS n'en laisse qu'une partie au modèle.
Mac Mini M5 Pro (64 Go) suffit-elle pour un modèle d'environ 30 milliards de paramètres ?
Oui. Qwen3 30B-A3B (MoE) (30,5 Md) y tourne avec 29,5 Go de marge, à environ 117 tokens par seconde.

À comparer