Gemma est une famille de modèles ouverts construits par Google DeepMind.
Explorer les modèles
Votre besoin. Votre matériel. Les modèles qui font le lien.
Un modèle compact orienté raisonnement.
Le généraliste Qwen dans une taille plus accessible.
Une variante spécialisée dans la génération, l’explication et la correction de code.
Un généraliste multilingue pour dialoguer, rédiger et travailler avec des documents.
Conversion GGUF du modèle Alibaba Qwen2.5 14B Instruct, avec plusieurs quantifications.
Quantifications GGUF d'empire-ai/Qwen3.8-35B-A3B-Distill - une distillation des modèles de frontière Qwen3.8 dans l'architecture Qwen3.6-35B-A3B Mixture-of-Experts - pour llama.cpp, Ollama, LM Studio, Jan, KoboldCpp et d'autres runtimes GGUF de stock. Cette carte concerne le choix d'un fichier et son exécution.
Cache KV et mémoire totale inconnus : aucune compatibilité théorique confirmée.
Fiches publiées dans le catalogue. Capacités déclarées par les éditeurs ; usages proposés par NVNC. Aucune note de qualité inventée.