Aller au contenu

Parcours de lecture

Ce rapport se lit de plusieurs façons. Choisissez celle qui correspond à votre temps et à votre objectif.

Itinéraire 1 · La conclusion en dix minutes

Lisez le résumé exécutif. Il donne les chiffres, les quatre mécanismes, et ce qu'ils coûtent.

Itinéraire 2 · « Comment tiennent-ils un million de jetons ? » (1 h)

C'est la question centrale du modèle. Le chemin le plus court :

  1. Fondations · Le cache clé-valeur — pourquoi le contexte long coûte de la mémoire, et combien.
  2. Architecture · Vue d'ensemble — la carte des 40 couches.
  3. Architecture · CSA2 — le mécanisme qui divise le cache par quatre.
  4. Architecture · Le cache KV en FP4 — le calcul exact des 890 octets.
  5. Déploiement · SWA Bounded Replay — le compromis stockage/recalcul qui divise le cache persistant par huit.

Itinéraire 3 · Lecture complète, sans prérequis (4 à 6 h)

Dans l'ordre des parties :

Fondations → Architecture → Déploiement → Entraînement → Évaluations → Utilisation → Analyse critique.

Les fondations sont conçues pour être sautées si vous connaissez déjà les Transformers ; elles ne contiennent rien de spécifique à DeepSeek.

Itinéraire 4 · « Je veux l'utiliser » (45 min)

  1. Résumé exécutif.
  2. Utilisation · L'API et ses tarifs — le nom du modèle, le prix, les plafonds, le calendrier de bascule.
  3. Utilisation · Format de prompt — le format DSML, l'effort de raisonnement, les appels d'outils.
  4. Utilisation · Matériel et coûts — ce qu'il faut réellement pour faire tourner 552 G de paramètres.
  5. Entraînement · L'effort de raisonnement — le réglage 1–100 et son rapport coût/qualité mesuré.
  6. Évaluations · Limites des benchmarks — avant de croire les tableaux.

Itinéraire 5 · Lecture critique (1 h)

Pour évaluer le niveau de preuve plutôt que les mécanismes :

  1. Analyse critique · Ce qui est vérifié — le script de reconstruction et ses résultats.
  2. Analyse critique · Limites et questions ouvertes — y compris les limites que DeepSeek reconnaît explicitement.
  3. Évaluations · Limites des benchmarks.

Convention utilisée dans tout le rapport

Ce rapport distingue systématiquement trois statuts :

  • Vérifié — recalculé dans ce rapport depuis les fichiers publiés.
  • Revendiqué — affirmé par DeepSeek, non vérifiable de l'extérieur.
  • Mesuré par DeepSeek — un chiffre d'évaluation produit par le constructeur lui-même, dans son propre cadre.

Aucun chiffre de performance de ce rapport n'est une évaluation indépendante.