Qwen (Alibaba Cloud)

IA / LLM 🟡 Mid

Définition

Famille de modèles open-weights d'Alibaba Cloud. Génération courante Qwen3.8, dont Qwen3.8-27B (licence Apache 2.0, publié en août 2026, 64 couches, contexte natif de 262 144 tokens extensible à 1 M), Qwen3.8-Flash-Next (180 B) et un modèle géant Qwen3.8-2.4T-A95B. Très présents dans Ollama et vLLM ; bons en multilingue et en code.

Analogie

Le fournisseur qui livre toutes les tailles du même modèle, du scooter au poids lourd, sous licence libre.

Exemple de code

# Local avec Ollama
ollama pull qwen3.8:27b
curl http://localhost:11434/v1/chat/completions -d '{
  "model": "qwen3.8:27b",
  "messages": [{"role":"user","content":"Écris un test Vitest pour slugify()"}]
}'

# Serveur GPU avec vLLM, contexte long
vllm serve Qwen/Qwen3.8-27B --max-model-len 262144

Cas d'usage

Modèle local de qualité pour agents de code hors ligne ; base de fine-tuning LoRA sous Apache 2.0.

Anti-pattern

Charger un 27B en bf16 sur un GPU de 24 Go : il faut la version quantifiée.
#ia#modeles#open-weights

Fiche mise à jour le 2026-09-27

← → au clavier pour passer d'une fiche à l'autre