Présentation : ce qu'est Kimi K3¶
Cette partie situe le modèle : qui l'a fait, dans quelle lignée, ce qu'il annonce, ce qu'on peut en faire concrètement et sous quelles conditions juridiques.
Elle ne contient aucune mathématique. Elle sert de socle factuel aux parties techniques qui suivent.
Ordre de lecture¶
| # | Chapitre | Contenu |
|---|---|---|
| 01 | Moonshot AI et la série Kimi | L'entreprise, la lignée K1.5 → K2 → Kimi Linear → K2.5 → K3 |
| 02 | Ce que Kimi K3 annonce | Les revendications du rapport, et leur statut |
| 03 | Fiche technique complète | Tous les chiffres, sourcés |
| 04 | Licence et disponibilité | Ce que la licence autorise, où obtenir le modèle, à quel prix |
En une phrase¶
Kimi K3
Un modèle Mixture-of-Experts de 2,78 billions de paramètres dont 104 milliards sont actifs par jeton, nativement multimodal (texte, image, vidéo), avec une fenêtre de contexte de 1 048 576 jetons, publié en poids ouverts le 27 juillet 2026 par Moonshot AI sous une licence propriétaire permissive-avec-conditions.
Le positionnement revendiqué¶
Le rapport ouvre sur un argument stratégique qui mérite d'être compris, car il explique tous les choix qui suivent.
Il existe deux axes de mise à l'échelle :
- Avant le déploiement : entraîner de plus gros modèles sur plus de données. C'est l'axe historique.
- Au moment du déploiement (test-time) : faire réfléchir le modèle plus longtemps, lui donner des outils, le laisser itérer. C'est l'axe ouvert par les modèles de raisonnement.
Le constat de Moonshot : l'écosystème ouvert a beaucoup avancé sur le second axe, mais stagne sur le premier. La plupart des modèles ouverts récents restent dans la classe du billion de paramètres. Le risque, énoncé explicitement : le progrès ouvert converge pendant que l'écart aux meilleurs systèmes propriétaires se creuse.
La thèse de Kimi K3
Pousser les deux axes ensemble : porter la fondation pré-entraînée à la classe des 3 billions de paramètres, tout en poussant le RL, l'effort de raisonnement et l'interaction longue à 1 M de contexte.
C'est ce qui justifie le sous-titre du rapport : Open Frontier Intelligence.
Ce que le rapport reconnaît lui-même¶
Honnêteté du rapport
Le résumé du papier dit textuellement que Kimi K3 « reste en retrait des modèles propriétaires les plus puissants, à savoir Claude Fable 5 et GPT-5.6 Sol », tout en devançant systématiquement les autres modèles ouverts et propriétaires de leur suite d'évaluation.
Ce n'est pas une revendication de supériorité absolue. C'est une revendication de frontière ouverte : le meilleur modèle dont les poids sont téléchargeables.
Où aller ensuite¶
Une fois cette partie lue :
- pour le fonctionnement interne → Architecture ;
- pour les chiffres et leur fiabilité → Évaluations ;
- pour l'esprit critique → Analyse critique.