Wolof-Llama-3.1-8B
LLM wolof quantifié, Apache-2.0
Site officiel consultéIA : modèles
Dernière vérification : 1 octobre 2026
Version quantifiée GGUF de vonewman/Wolof-Llama-3.1-8B, un modèle Llama de 8 milliards de paramètres. Douze quantifications de 2 à 16 bits sont proposées (de 3,18 Go pour Q2_K à 16,1 Go pour f16). Elles s'exécutent en local avec llama.cpp, Ollama ou LM Studio. Licence Apache 2.0.
Services
- Q4_K_S (4,69 Go) et Q4_K_M (4,92 Go), recommandés
- Q8_0 (8,54 Go) et f16 pour la qualité maximale
- Exécution locale via llama.cpp, Ollama, LM Studio, Jan
Conditions d’accès
Fichiers libres sur Hugging Face, licence Apache 2.0 ; uniquement des quantifications statiques.
Sources
- Wolof-Llama-3.1-8B (nouvel onglet), vérifié le 1 octobre 2026Site officiel consulté