Parcours de lecture¶
Cinq itinéraires selon votre niveau et votre objectif. Choisissez celui qui vous correspond, ou composez le vôtre.
Parcours A — Débutant complet¶
Objectif : comprendre comment fonctionne un LLM, puis comment fonctionne Kimi K3. Durée : 15 à 25 heures, étalées sur 3 à 6 semaines.
Semaine 1 ► Fondations 01 → 07
(LLM, jetons, vecteurs, réseaux, Transformer, attention linéaire, MoE)
Semaine 2 ► Fondations 08 → 13
(entraînement, post-entraînement, inférence, matériel, vision, agents)
Semaine 3 ► Présentation (les 4 chapitres)
Résumé exécutif
Semaine 4 ► Architecture 01 → 10
★ le cœur du sujet
Semaine 5 ► Entraînement 01 → 10
Semaine 6 ► Infrastructure · Évaluations · Analyse critique
Le conseil le plus utile
Ne sautez pas le chapitre 06 des Fondations (attention linéaire et récurrence). C'est le seul dont la maîtrise conditionne toute la compréhension de KDA — donc de 74 % de la profondeur du modèle.
Relisez-le deux fois s'il le faut. Tout le reste en découle.
Parcours B — Vous connaissez déjà les LLM¶
Objectif : comprendre ce que Kimi K3 apporte de nouveau. Durée : 6 à 10 heures.
| Ordre | Contenu | Pourquoi |
|---|---|---|
| 1 | Résumé exécutif | Vue d'ensemble |
| 2 | Fondations 06 | Même si vous connaissez les Transformers — l'attention linéaire à règle delta est moins courante |
| 3 | Architecture, les 10 chapitres | Le cœur |
| 4 | Entraînement 06 → 09 | RL, effort, MOPD, environnements |
| 5 | Infrastructure 02, 03, 08 | KCP, MoonEP, cache hybride — les plus originaux |
| 6 | Analyse critique | Le recul |
Parcours C — Express¶
Objectif : savoir de quoi il retourne. Durée : 20 minutes à 2 heures.
| Temps | Contenu |
|---|---|
| 20 min | Résumé exécutif |
| +20 min | Fiche technique |
| +30 min | Vue d'ensemble de l'architecture |
| +30 min | Résultats publics |
| +20 min | Forces et Limites |
Parcours D — Implémenter¶
Objectif : réimplémenter l'architecture et la vérifier. Durée : 6 semaines à ~10 h/semaine.
Suivez la feuille de route dédiée
Le chapitre Feuille de route de réimplémentation donne le plan semaine par semaine, avec un test de validation à chaque étape.
① Fondations 04, 05, 06, 07, 08
② Architecture 03 (KDA), 05 (AttnRes), 06 (LatentMoE), 07 (SiTU), 08 (QB)
③ Reproduire 01 → 06
④ Le script de vérification : assets/code/verif-kimi-k3.py
⑤ nano-K3 : 191 M de paramètres, un GPU 16 Go suffit
Le test à ne jamais sauter
L'identité de composition de KCP. Trois lignes de test qui valident que votre récurrence KDA est correcte. Sans lui, un bug subtil se propagera dans tout le reste, invisible pendant des semaines.
Parcours E — Juger¶
Objectif : évaluer sérieusement les revendications. Durée : 3 à 4 heures.
| Ordre | Contenu |
|---|---|
| 1 | Ce que Kimi K3 annonce |
| 2 | Comprendre les benchmarks — indispensable |
| 3 | Évaluations tierces — les sources fiables |
| 4 | Affirmations à vérifier — la notation par niveau de preuve |
| 5 | Limites et angles morts |
| 6 | Ce qui est public |
| 7 | Questions ouvertes |
Les cinq chapitres les plus importants¶
Si vous ne deviez en lire que cinq :
| # | Chapitre | Pourquoi |
|---|---|---|
| 1 | Attention linéaire et récurrence | Sans lui, KDA est incompréhensible |
| 2 | Kimi Delta Attention | 74 % de la profondeur du modèle |
| 3 | Stable LatentMoE | 98 % des paramètres |
| 4 | Comprendre les benchmarks | Sans lui, tous les scores induisent en erreur |
| 5 | Affirmations à vérifier | Le tri entre ce qui est établi et ce qui ne l'est pas |
Comment lire les encadrés¶
| Encadré | Signification |
|---|---|
| Intuition | Explication informelle, avant la formule |
| À retenir | Le point essentiel de la section |
| Erreur fréquente | Une confusion courante et sa correction |
| Limite importante | Une réserve qui change l'interprétation |
| Explication détaillée (repliable) | Développement facultatif — cliquez pour ouvrir |
Les sections Vérification de compréhension en fin de chapitre sont des questions à réponse repliable. Essayez de répondre avant d'ouvrir.
Conventions sur les affirmations¶
Ce wiki distingue systématiquement quatre statuts :
| Statut | Exemple |
|---|---|
| Fait vérifiable | « 93 couches, dont 24 MLA » — lisible dans config.json |
| Affirmation du constructeur | « ~2,5× d'efficacité d'échelle » — déclaré, non vérifiable |
| Interprétation | « probablement parce que… » — la nôtre, signalée comme telle |
| Inconnue | « le rapport ne dit pas » |
Le niveau de preuve de chaque revendication majeure est donné en Affirmations à vérifier.
Chapitre suivant : Résumé exécutif