Jeu de données public · CSV
Données VRAM des modèles d'IA locale
Toutes les estimations du calculateur dans un fichier exploitable : 21 modèles, six quantifications et chaque longueur de contexte supportée. Les chiffres sont produits par le même code que les fiches, pas recopiés à la main.
Aperçu · réglages recommandés · contexte 8k
| Modèle | Quantification | Poids | Cache KV | Total |
|---|---|---|---|---|
| Llama 3.1 (8B) | Q4_K_M | 4,6 Go | 1,0 Go | 6,8 Go |
| Llama 3.3 (70B) | Q4_K_M | 40,3 Go | 2,5 Go | 44,0 Go |
| Qwen3 (32B) | Q4_K_M | 18,7 Go | 2,0 Go | 21,9 Go |
| Mistral Small 3 (24B) | Q4_K_M | 13,5 Go | 1,3 Go | 15,9 Go |
| Gemma 3 (12B) | Q4_K_M | 7,0 Go | 0,8 Go | 9,0 Go |
Ce que contient le fichier
Identifiant, éditeur, paramètres totaux et actifs, quantification, contexte, détail des quatre postes mémoire, total en GiB, date de vérification et URL de la configuration source.
Hypothèses fixes
Cache KV en FP16 et GPU utilisé aussi pour l'affichage, soit 0,8 GiB réservés. Le multi-GPU, l'offload CPU et l'entraînement ne sont pas modélisés.
Version des données : 2026-09-02 · UTF-8 · séparateur virgule · décimales avec point