Llama (Meta)

IA / LLM 🟡 Mid

Définition

Famille de modèles open-weights de Meta. La dernière génération publiée sur Hugging Face est Llama 4 : Llama-4-Scout-17B-16E-Instruct et Llama-4-Maverick-17B-128E-Instruct (mis à jour le 22 mai 2025), modèles multimodaux natifs à architecture MoE (16 ou 128 experts, 17 B paramètrès actifs). L'accès exige d'accepter la licence Llama et la politique d'usage : ce n'est pas de l'open source au sens OSI.

Analogie

Un moteur fourni gratuitement avec son plan, mais sous contrat d'utilisation.

Exemple de code

# Accepter la licence sur huggingface.co/meta-llama puis :
huggingface-cli login

# Servir Scout avec vLLM (API compatible OpenAI)
vllm serve meta-llama/Llama-4-Scout-17B-16E-Instruct \
  --tensor-parallel-size 4 --max-model-len 131072

# Ou en local quantifié via Ollama
ollama pull llama4:scout
ollama run llama4:scout "Résume ce README"

Cas d'usage

Auto-hébergement souverain, fine-tuning maison, coûts maîtrisés à fort volume.

Anti-pattern

Croire que « open-weights » dispense de lire la licence : Llama impose des conditions d'usage.
#ia#modeles#open-weights

Fiche mise à jour le 2026-09-27

← → au clavier pour passer d'une fiche à l'autre