POC · Catalogue initial
COMMUNAUTÉ FRANCOPHONE · IA LOCALE

Votre machine, vos possibilités.

La mémoire ouvre des possibilités. Les mesures précisent les performances.

Ces fiches décrivent des profils de mémoire, pas des machines certifiées. Deux GPU avec la même VRAM peuvent avoir des débits très différents.

Apple Silicon · 16 Go

Mémoire unifiée partagée avec macOS et les applications. Profil générique, sans prédiction de débit.

16Gio unifiés

Apple Silicon · 24 Go

Mémoire unifiée. La compatibilité mémoire ne garantit pas la vitesse ; celle-ci dépend notamment de la puce et du runtime.

24Gio unifiés

NVIDIA · 16 Go VRAM

Profil GPU CUDA générique. Le calcul vise un chargement intégral en VRAM, sans offload CPU.

16Gio VRAM

NVIDIA · 24 Go VRAM

Profil GPU générique de 24 Go de VRAM. La RAM système reste distincte de la VRAM.

24Gio VRAM

CPU · 32 Go RAM

Profil CPU générique avec RAM système. Une compatibilité mémoire ne signifie pas une génération rapide.

32Gio RAM

RTX 4060 · 8 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

8Gio VRAM

RTX 4060 Ti 8 Go · 8 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

8Gio VRAM

RTX 4060 Ti 16 Go · 16 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

16Gio VRAM

RTX 4070 · 12 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

12Gio VRAM

RTX 4070 SUPER · 12 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

12Gio VRAM

RTX 4070 Ti · 12 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

12Gio VRAM

RTX 4070 Ti SUPER · 16 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

16Gio VRAM

RTX 4080 · 16 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

16Gio VRAM

RTX 4080 SUPER · 16 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

16Gio VRAM

RTX 4090 · 24 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

24Gio VRAM

RTX 5050 · 8 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

8Gio VRAM

RTX 5060 · 8 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

8Gio VRAM

RTX 5060 Ti 8 Go · 8 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

8Gio VRAM

RTX 5060 Ti 16 Go · 16 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

16Gio VRAM

RTX 5070 · 12 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

12Gio VRAM

RTX 5070 Ti · 16 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

16Gio VRAM

RTX 5080 · 16 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

16Gio VRAM

RTX 5090 · 32 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

32Gio VRAM

H100 SXM · 80 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

80Gio VRAM

H100 PCIe · 80 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

80Gio VRAM

H200 · 141 Go VRAM

Mémoire nominale ; vérifier le backend et la mémoire libre réelle. Aucune prédiction de vitesse.

141Gio VRAM

NVIDIA DGX Spark · 128 Go unifiés

Mémoire système unifiée partagée entre CPU et GPU, distincte de la VRAM dédiée.

128Gio unifiés
LE MOTEUR DE COMPATIBILITÉ NVNC

Comment ça fonctionne ?

Votre besoin sélectionne des candidats. Votre matériel détermine la mémoire disponible. Le moteur et la quantification définissent le profil d’inférence.

Profil actuel : Ollama · Q4_K_M
4 096 tokens · 1 séquence(s) · 12 Gio disponibles selon le profil.

Une estimation explicite

Poids du modèle + cache KV FP16 + 0,75 Gio de runtime, puis 15 % de marge. Les poids utilisent une largeur moyenne approximative et une marge de 12 %.

Les variantes K_S, K_M et K_L peuvent mélanger plusieurs précisions. La taille exacte du package, les kernels et le backend doivent être vérifiés. Cette liste de profils ne garantit pas qu’un package existe pour chaque modèle.

La théorie et les mesures restent distinctes

La compatibilité mémoire ne prédit ni la vitesse ni la qualité. Les benchmarks déclarés précisent le contexte réel, sans être automatiquement certifiés.

Consulter la méthodologie complète

Comparer les modèles

Même quantification et même contexte. Aucune note de qualité supposée.

Critère
Paramètres
Contexte configuré
Mémoire estimée
Compatibilité
Licence
Usages