Qwen (Alibaba Cloud)
IA / LLM 🟡 MidDéfinition
Famille de modèles open-weights d'Alibaba Cloud. Génération courante Qwen3.8, dont Qwen3.8-27B (licence Apache 2.0, publié en août 2026, 64 couches, contexte natif de 262 144 tokens extensible à 1 M), Qwen3.8-Flash-Next (180 B) et un modèle géant Qwen3.8-2.4T-A95B. Très présents dans Ollama et vLLM ; bons en multilingue et en code.
Analogie
Le fournisseur qui livre toutes les tailles du même modèle, du scooter au poids lourd, sous licence libre.
Exemple de code
# Local avec Ollama
ollama pull qwen3.8:27b
curl http://localhost:11434/v1/chat/completions -d '{
"model": "qwen3.8:27b",
"messages": [{"role":"user","content":"Écris un test Vitest pour slugify()"}]
}'
# Serveur GPU avec vLLM, contexte long
vllm serve Qwen/Qwen3.8-27B --max-model-len 262144
Cas d'usage
Modèle local de qualité pour agents de code hors ligne ; base de fine-tuning LoRA sous Apache 2.0.
Anti-pattern
Charger un 27B en bf16 sur un GPU de 24 Go : il faut la version quantifiée.
Termes liés
Fiche mise à jour le 2026-09-27