Parcours de lecture¶
Ce rapport se lit de plusieurs façons. Choisissez celle qui correspond à votre temps et à votre objectif.
Itinéraire 1 · La conclusion en dix minutes¶
Lisez le résumé exécutif. Il donne les chiffres, les quatre mécanismes, et ce qu'ils coûtent.
Itinéraire 2 · « Comment tiennent-ils un million de jetons ? » (1 h)¶
C'est la question centrale du modèle. Le chemin le plus court :
- Fondations · Le cache clé-valeur — pourquoi le contexte long coûte de la mémoire, et combien.
- Architecture · Vue d'ensemble — la carte des 40 couches.
- Architecture · CSA2 — le mécanisme qui divise le cache par quatre.
- Architecture · Le cache KV en FP4 — le calcul exact des 890 octets.
- Déploiement · SWA Bounded Replay — le compromis stockage/recalcul qui divise le cache persistant par huit.
Itinéraire 3 · Lecture complète, sans prérequis (4 à 6 h)¶
Dans l'ordre des parties :
Fondations → Architecture → Déploiement → Entraînement → Évaluations → Utilisation → Analyse critique.
Les fondations sont conçues pour être sautées si vous connaissez déjà les Transformers ; elles ne contiennent rien de spécifique à DeepSeek.
Itinéraire 4 · « Je veux l'utiliser » (45 min)¶
- Résumé exécutif.
- Utilisation · L'API et ses tarifs — le nom du modèle, le prix, les plafonds, le calendrier de bascule.
- Utilisation · Format de prompt — le format DSML, l'effort de raisonnement, les appels d'outils.
- Utilisation · Matériel et coûts — ce qu'il faut réellement pour faire tourner 552 G de paramètres.
- Entraînement · L'effort de raisonnement — le réglage 1–100 et son rapport coût/qualité mesuré.
- Évaluations · Limites des benchmarks — avant de croire les tableaux.
Itinéraire 5 · Lecture critique (1 h)¶
Pour évaluer le niveau de preuve plutôt que les mécanismes :
- Analyse critique · Ce qui est vérifié — le script de reconstruction et ses résultats.
- Analyse critique · Limites et questions ouvertes — y compris les limites que DeepSeek reconnaît explicitement.
- Évaluations · Limites des benchmarks.
Convention utilisée dans tout le rapport
Ce rapport distingue systématiquement trois statuts :
- Vérifié — recalculé dans ce rapport depuis les fichiers publiés.
- Revendiqué — affirmé par DeepSeek, non vérifiable de l'extérieur.
- Mesuré par DeepSeek — un chiffre d'évaluation produit par le constructeur lui-même, dans son propre cadre.
Aucun chiffre de performance de ce rapport n'est une évaluation indépendante.