Contre le marché¶
Pendant toute la campagne, un chiffre a servi de horizon : 0.198 de Brier et 68,7 % d'exactitude, la performance attribuée aux bookmakers dans la littérature. C'était la cible du concours, la ligne d'arrivée de l'épilogue, et la justification de la dernière voie restée ouverte — « obtenir des cotes ».
Ce chiffre était un totem. Cette partie raconte ce qui s'est passé quand on a enfin pu le toucher.
Ce qui a changé¶
Deux choses, dans cet ordre — et l'ordre compte.
On a d'abord contesté la barre elle-même. Le 0.198 est mesuré sur d'autres
matchs, une autre période, une autre composition de niveaux. Avant de se
comparer, il fallait définir le pool sur lequel la comparaison a un sens — et
le définir avant de mesurer, pas après avoir vu les résultats. C'est le
chantier bookpool, et son résultat est contre-intuitif : le pool que les
bookmakers cotent est plus dur que notre pool global, pas plus facile.
Puis on a trouvé les cotes. Pas en achetant un flux, pas en contournant une protection : dans notre propre moisson, dans un champ JSON collecté des semaines plus tôt pour une tout autre raison et jamais ouvert. Zéro requête réseau. Le duel est devenu appariable match par match, sur nos matchs à nous.
À partir de là, quatre chantiers successifs ont mesuré, se sont contredits, puis se sont mis d'accord. La conclusion finale n'est ni celle du premier, ni celle du deuxième.
Ce que vous allez apprendre¶
- Pourquoi une référence de littérature n'est pas une barre tant qu'on n'a pas défini le pool comparable, et pourquoi cette définition doit être horodatée avant la mesure.
- Comment on lit une cote décimale, ce qu'est l'overround, et comment on en extrait une probabilité par dévigorisation.
- Le piège pédagogique le plus instructif de toute la campagne : une première mesure donnant 86,6 % d'exactitude au bookmaker, chiffre impossible qui cachait un mélange de marché d'avant-match et de marché en direct.
- Pourquoi une comparaison hors-échantillon peut être biaisée contre soi sans qu'aucune ligne de code ne soit fausse — et comment on chiffre ce biais.
- Ce qu'une mesure de qualité probabiliste dit, et surtout ce qu'elle ne dit pas sur la possibilité de gagner de l'argent.
Ordre de lecture¶
Les quatre chapitres racontent une enquête : ils se lisent dans l'ordre.
- La vraie barre — le pool comparable défini a priori, le résultat contre-intuitif (les matchs cotés sont plus durs), et ce que devient notre apport une fois la difficulté corrigée.
- Les cotes étaient là — la découverte dans notre propre cache, la dévigorisation expliquée pas à pas, et le piège du marché en direct.
- Le verdict — trois mesures qui se retournent, le biais de taille d'entraînement chiffré, et la mesure finale à armes égales.
- Ce que la mesure ne dit pas — les limites, la marge du bookmaker, et la différence entre bien prédire et gagner.
Les chiffres à garder en tête¶
Trois mesures différentes, sur trois pools différents. Elles ne se contredisent pas : elles répondent à des questions différentes.
| Mesure | n | Nous | Marché | Verdict |
|---|---|---|---|---|
Pool comparable défini a priori (bookpool, D4) |
226 | 0.2178 | 0.198 (littérature) | barre manquée, comparaison indirecte |
Pool coté élargi, entraînement inégal (oddsmax) |
1 159 | 0.2123 | 0.2097 | marché devant, mesure biaisée |
Armes égales, force maximale (fairfight, N = 6 000) |
804 | 0.2130 | 0.2127 | indiscernables |
Limite importante — la ligne 1 et les lignes 2-3 ne sont pas de même nature
La première ligne compare notre Brier à un chiffre mesuré ailleurs, sur d'autres matchs : c'est une comparaison entre deux échantillons disjoints, et aucun écart n'y prouve quoi que ce soit. Les deux autres comparent, match par match, notre probabilité et celle d'un opérateur réel sur les mêmes rencontres. C'est tout l'objet de cette partie : passer de la première nature de comparaison à la seconde.
Où sont les preuves¶
Six rapports d'expérience, tous reproductibles hors ligne, tous listés dans les
sources : bookpool, odds, vsmarket, oddsmax,
fairfight et maxacc. Le vocabulaire nouveau — cote décimale, overround,
dévigorisation, marché d'avant-match — est défini au fil du texte et rassemblé
dans le glossaire.
Intuition — pourquoi cette partie arrive après la campagne
L'épilogue de la campagne classait les cotes en « voie 1 : bloquée, aucune donnée en main ». Cette partie est ce qui s'est passé après. Elle ne réécrit pas la campagne : elle transforme sa dernière incertitude ouverte en mesure, et elle montre au passage que la réponse dépendait beaucoup plus du protocole de comparaison que du modèle lui-même.
Partie précédente : La campagne · Premier chapitre : La vraie barre · Retour à l'accueil du cours