Aller au contenu
WL

Wolof-Llama-3.1-8B

LLM wolof quantifié, Apache-2.0

Site officiel consultéIA : modèles

Dernière vérification : 1 octobre 2026

Version quantifiée GGUF de vonewman/Wolof-Llama-3.1-8B, un modèle Llama de 8 milliards de paramètres. Douze quantifications de 2 à 16 bits sont proposées (de 3,18 Go pour Q2_K à 16,1 Go pour f16). Elles s'exécutent en local avec llama.cpp, Ollama ou LM Studio. Licence Apache 2.0.

Services
  • Q4_K_S (4,69 Go) et Q4_K_M (4,92 Go), recommandés
  • Q8_0 (8,54 Go) et f16 pour la qualité maximale
  • Exécution locale via llama.cpp, Ollama, LM Studio, Jan
Conditions d’accès

Fichiers libres sur Hugging Face, licence Apache 2.0 ; uniquement des quantifications statiques.

Sources