Llama (Meta)
IA / LLM 🟡 MidDéfinition
Famille de modèles open-weights de Meta. La dernière génération publiée sur Hugging Face est Llama 4 : Llama-4-Scout-17B-16E-Instruct et Llama-4-Maverick-17B-128E-Instruct (mis à jour le 22 mai 2025), modèles multimodaux natifs à architecture MoE (16 ou 128 experts, 17 B paramètrès actifs). L'accès exige d'accepter la licence Llama et la politique d'usage : ce n'est pas de l'open source au sens OSI.
Analogie
Un moteur fourni gratuitement avec son plan, mais sous contrat d'utilisation.
Exemple de code
# Accepter la licence sur huggingface.co/meta-llama puis :
huggingface-cli login
# Servir Scout avec vLLM (API compatible OpenAI)
vllm serve meta-llama/Llama-4-Scout-17B-16E-Instruct \
--tensor-parallel-size 4 --max-model-len 131072
# Ou en local quantifié via Ollama
ollama pull llama4:scout
ollama run llama4:scout "Résume ce README"
Cas d'usage
Auto-hébergement souverain, fine-tuning maison, coûts maîtrisés à fort volume.
Anti-pattern
Croire que « open-weights » dispense de lire la licence : Llama impose des conditions d'usage.
Termes liés
Fiche mise à jour le 2026-09-27