Aller au contenu

Annexes

Ces trois documents ne se lisent pas d'un bout à l'autre : ils se consultent. Ils rassemblent, hors du fil du cours, ce à quoi on revient — le vocabulaire, les chiffres, et l'origine de chaque affirmation.

Annexe À quoi ça sert
Glossaire Tous les termes du cours, par ordre alphabétique, définis en deux à quatre phrases
Tableau récapitulatif Le classement complet, la carte des segments et les hyperparamètres exacts du leader
Sources Nos rapports internes avec leurs chemins, les sources de données, la littérature citée

Comment lire les affirmations de ce cours

Le cours distingue systématiquement quatre statuts, et il vaut la peine de les avoir en tête en consultant les tableaux.

Fait mesuré chez nous. Un chiffre produit par un de nos scripts, sur nos données, consigné dans un rapport identifiable. Exemple : le Brier de 0.2041 du leader sur les 1 146 matchs du holdout. Ces chiffres sont reproductibles ; les chemins sont dans les sources.

Résultat de littérature. Un chiffre publié par quelqu'un d'autre, sur ses propres données. Exemple : le repère bookmaker à 0.198 de Brier et 68,7 % d'exactitude. Il n'est pas comparable directement aux nôtres — pool différent, période différente, niveau différent.

Hypothèse. Une explication proposée pour un fait mesuré, mais non testée. Exemple : « les matchs de LAN sont plus prévisibles parce que les plateaux de tournois sur invitation concentrent les écarts de niveau ». Ces énoncés sont toujours annoncés comme tels.

Limite. Une réserve qui change l'interprétation d'un résultat. Exemple : le segment Bo1 du holdout est composé à 87 % de matchs de LAN, donc il ne mesure pas un effet de format.

La limite la plus importante du cours

Tous nos chiffres sont mesurés sur un seul pool : 1 146 matchs de CS2 des 42 derniers jours, tier 1 à tier 3 mélangés. Chaque fois qu'ils sont comparés au repère bookmaker de 0.198, rappelez-vous que ce dernier vient d'un pool de tier 1 pur, où les affiches sont plus serrées.

La seule comparaison rigoureuse au sein de la campagne est interne : nos modèles les uns contre les autres, sur exactement les mêmes matchs, avec exactement la même fonction de mesure.

Une exception a été construite après la campagne : la partie Contre le marché compare notre modèle à des cotes réelles appariées à nos propres matchs, avec une fenêtre d'entraînement égalisée. C'est la seule comparaison externe du cours qui porte sur les mêmes rencontres — et elle remplace, sur ce point, le repère de littérature.

Les encadrés du cours

Encadré Signification
Intuition Une explication informelle, avant la formule
À retenir Le point essentiel d'une section
Erreur fréquente Une confusion courante et sa correction
Limite importante Une réserve qui change l'interprétation
Pour aller plus loin (repliable) Un développement facultatif

Retour aux parties

Le cours se compose de six parties, dans cet ordre de lecture :

  1. Fondations — le problème, les métriques, le protocole
  2. Les horloges de force — Elo, Glicko, TrueSkill, pi-ratings
  3. Features et données — intégrité temporelle, familles de features, acquisition
  4. Les modèles — logistique, gradient boosting, segments, et le cimetière des idées mortes
  5. La campagne — la chronologie, le palmarès, la carte de prévisibilité, les leçons
  6. Contre le marché — la vraie barre, les cotes retrouvées, le duel à armes égales et ses limites

Retour à l'accueil du cours