Ce que votre machine fait vraiment tourner : IA locale et jeu vidéo, chiffres à l'appui.

Apple · Mémoire unifiée

Fin de vie

Mac Mini M4 (16 Go) et IA locale

Les modèles qui tournent dessus, et à quelle vitesse.

Silencieux et sobre, mais 120 Go/s : correct jusqu'à un 8B, pas au-delà. Génération précédente, remplacée par le Mac Mini M6.

Notre verdict

10,7 Go
Modèles10/21

10 des 21 modèles de notre sélection tournent correctement sur cette machine, en quantification recommandée avec 8k de contexte. Le plus gros est Gemma 3 (12B). Au-delà, ce n'est pas la vitesse qui bloque mais la mémoire : 10,7 Go utilisables.

Caractéristiques

Mémoire unifiée
16 Go
Allouable au modèle
10,7 Go
Bande passante
120 Go/s
Disponibilité
Fin de vie

Sur Mac, la mémoire est partagée entre le processeur et le GPU, et macOS n'en laisse qu'une partie au modèle — 10,7 Go ici. C'est plus souple qu'une carte graphique, mais la bande passante, elle, plafonne la vitesse de génération bien plus tôt.

Caractéristiques vérifiées le 2026-09-01 · Caractéristiques Apple du Mac mini (2024)

Où l'acheter

Mac Mini M4 (16 Go)

Prix non suivi, référence hors production

Voir sur Amazon

Modèle par modèle

En quantification recommandée, avec 8k de contexte. Une vitesse n'est affichée que si le modèle tient réellement en mémoire.

ModèleQuantificationRequisTok/sVerdict
Gemma 3 (12B)Q4_K_M8,2 Go12Recommandé
Gemma 2 (9B)Q4_K_M7,6 Go16Recommandé
Qwen3 (8B)Q4_K_M6,2 Go18Recommandé
Llama 3.1 (8B)Q4_K_M6,0 Go19Recommandé
DeepSeek-R1 Distill Llama (8B)Q4_K_M6,0 Go19Recommandé
Qwen2.5 (7B)Q4_K_M5,2 Go20Recommandé
DeepSeek-R1 Distill Qwen (7B)Q4_K_M5,2 Go20Recommandé
Mistral 7B (v0.3)Q4_K_M5,5 Go21Recommandé
Gemma 3 (4B)Q4_K_M3,1 Go35Recommandé
Llama 3.2 (3B)Q4_K_M3,1 Go47Recommandé
Qwen2.5 (14B)Q4_K_M10,3 Go10Limite
Phi-4 (14B)Q4_K_M10,3 Go10Limite
Llama 3.3 (70B)Q4_K_M43,2 GoInsuffisant
Ornith-1.5 35B-A3B (MoE)Q4_K_M21,5 GoInsuffisant
Qwen2.5 (32B)Q4_K_M21,1 GoInsuffisant
Qwen3 (32B)Q4_K_M21,1 GoInsuffisant
DeepSeek-R1 Distill Qwen (32B)Q4_K_M21,1 GoInsuffisant
Qwen3 30B-A3B (MoE)Q4_K_M18,5 GoInsuffisant
Gemma 3 (27B)Q4_K_M17,1 GoInsuffisant
Mistral Small 3 (24B)Q4_K_M15,1 GoInsuffisant
gpt-oss 20B (MoE)Q4_K_M12,5 GoInsuffisant

Génération d'images

Questions fréquentes

Les réponses courtes

Quels modèles d'IA tournent sur Mac Mini M4 (16 Go) ?
10 des 21 modèles de notre sélection, en quantification recommandée avec 8k de contexte. Le plus gros est Gemma 3 (12B), à environ 12 tokens par seconde.
Combien de mémoire de Mac Mini M4 (16 Go) est réellement utilisable ?
10,7 Go sur 16 Go : sur Mac, la mémoire est partagée avec le processeur et macOS n'en laisse qu'une partie au modèle.
Mac Mini M4 (16 Go) suffit-elle pour un modèle d'environ 30 milliards de paramètres ?
Non, pas confortablement : Qwen3 30B-A3B (MoE) (30,5 Md) demande 18,5 Go en quantification recommandée, soit 7,8 Go de trop. Il faudrait descendre en Q3 ou raccourcir le contexte.

À comparer