Aller au contenu

Analyse critique

Cette partie sépare ce qui est démontré de ce qui est affirmé, et recense les questions que la publication laisse ouvertes.

Ce que vous allez apprendre

  • Ce qui est vérifié — le script de reconstruction complet, ses résultats, et ce qu'ils établissent.
  • Limites et questions ouvertes — le tableau des niveaux de preuve, les limites que DeepSeek reconnaît lui-même, et ce qui reste à savoir.

Le principe de classement

Chaque affirmation du rapport technique est rangée dans l'une de quatre catégories :

Niveau Signification
Vérifié Recalculé dans ce rapport depuis les fichiers publiés.
Corroboré Confirmé par une source indépendante de DeepSeek.
Revendiqué Affirmé par DeepSeek, cohérent, non vérifiable de l'extérieur.
Non étayé Affirmé sans mesure ni méthodologie.

Le résultat de ce classement est que l'essentiel de l'architecture est vérifiable et vérifié, tandis que l'essentiel des affirmations de qualité ne l'est pas.

C'est une situation courante et pas particulièrement défavorable à DeepSeek : publier config.json, le code d'inférence et les formats de quantification suffit à rendre les chiffres d'architecture reproductibles, ce que peu de laboratoires permettent.


Partie précédente : Utilisation