DeepSeek

IA / LLM 🟡 Mid

Définition

Laboratoire chinois connu pour ses modèles MoE open-weights sous licence MIT. DeepSeek-V4.1-Flash (fiche Hugging Face mise à jour en septembre 2026) : 552 B de paramètrès, 8 B activés par token en prefill et 16 B en décodage, contexte jusqu'à 1 M de tokens, multimodal, compression du cache KV à environ 890 octets par token. L'API propose deepseek-flash (servi par V4.1-Flash) et deepseek-v4-pro.

Analogie

Le constructeur qui publie ses plans complets : n'importe qui peut reconstruire le moteur dans son atelier.

Exemple de code

// API DeepSeek : compatible OpenAI
import OpenAI from 'openai';
const deepseek = new OpenAI({
  baseURL: 'https://api.deepseek.com',
  apiKey: process.env.DEEPSEEK_API_KEY,
});
const res = await deepseek.chat.completions.create({
  model: 'deepseek-flash',
  messages: [{ role: 'user', content: 'Explique le MoE en 2 phrases.' }],
});
console.log(res.choices[0].message.content);
// Poids MIT : huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash (auto-hébergeable)

Cas d'usage

Auto-hébergement sans restriction de licence ; rapport qualité/coût sur le raisonnement et le code.

Anti-pattern

Envoyer des données clients européennes à une API hébergée hors UE sans analyse de transfert.
#ia#modeles#open-weights

Fiche mise à jour le 2026-09-27

← → au clavier pour passer d'une fiche à l'autre