Bibliothèque de recherches¶
Recherches approfondies, analyses techniques et cours progressifs, rédigés pour être lus en profondeur plutôt que survolés.
Domaines¶
Intelligence artificielle¶
Analyses de modèles, concepts fondamentaux, comparatifs — et l'apprentissage appliqué : des campagnes de ML réelles enseignées de bout en bout, dont le cours complet Prédire les matchs de CS2. Chaque analyse de modèle inclut un cours d'entrée permettant de la lire sans prérequis.
Finance décentralisée¶
Protocoles, mécanismes et stratégies de la DeFi — et les réseaux DePIN, qui paient pour de l'infrastructure physique réelle. Les explications mécaniques passent avant les considérations de rendement, et les affirmations de performance sont systématiquement distinguées des faits vérifiables.
Marchés financiers¶
Marchés organisés traditionnels : microstructure, carnets d'ordres, instruments dérivés, infrastructure d'exécution et stratégies systématiques. Même exigence de séparation entre mécanique et rendement.
Informatique¶
Systèmes, architecture matérielle, compilation, calcul haute performance. Les recherches qui portent sur la machine elle-même plutôt que sur ce qu'on lui fait calculer — de la programmation d'un processeur graphique à la conception d'un cluster de calcul et à la formation des ingénieurs du domaine.
Sciences humaines¶
Comportement humain, communication et cognition sociale. Le domaine où l'écart entre la littérature grand public et la littérature scientifique est le plus large de toute la bibliothèque — et où la séparation entre faits établis et folklore demande donc le plus de travail.
Mathématiques¶
Cours complets de mathématiques, écrits pour être travaillés plutôt que consultés : chaque cours part d'un niveau de départ explicitement annoncé, introduit tous ses prérequis, et se termine par des exercices corrigés à difficulté croissante.
Management¶
Gestion des organisations : ce qu'on y enseigne, ce qu'on y sait réellement, et ce qu'on y raconte. C'est le domaine où l'écart entre la littérature de librairie et la littérature académique est le plus large — et le tri entre les deux y est le travail principal, pas une précaution de forme.
Guides d'achat¶
Comparatifs concrets pour acheter du matériel réel : prix relevés à une date donnée, sources citées, et séparation nette entre ce qui est vérifié et ce qui est estimé. Ces guides vieillissent plus vite que le reste de la bibliothèque.
Recherches principales¶
Se former au management sans école de commerce¶
Peut-on couvrir le programme d'une école de commerce en ne payant rien, ou en n'achetant que des livres ? Oui pour la matière, non pour le reste — et ce rapport dit précisément où passe la frontière.
4 parties, 21 chapitres. Le tronc commun établi à partir d'une maquette publiée, puis le catalogue vérifié des ressources gratuites : les 192 cours de la Sloan School of Management publiés par MIT OpenCourseWare, relevés par API — dont 20 seulement comportent des vidéos, ce qui change complètement l'usage qu'on peut en faire ; les douze manuels universitaires libres d'OpenStax, qui couvrent presque tout le programme à zéro euro ; les études de cas du MIT Sloan, ouvertes sous licence Creative Commons depuis 2009.
Et les mauvaises nouvelles, relevées plutôt que supposées : l'effondrement du gratuit sur les plateformes commerciales depuis 2025, et un catalogue FUN-MOOC interrogé par API qui montre une offre francophone de management majoritairement archivée et orientée secteur public.
Puis une bibliothèque de trente livres classés par rang de priorité et par niveau de preuve — dont un chapitre entier sur ceux qu'il ne faut pas lire, et pourquoi Good to Great en fait partie. Enfin un programme de douze mois, environ 500 heures, avec un livrable écrit par bloc.
Le HPC à l'ENSIIE par apprentissage¶
Quelles options choisir dans la formation par apprentissage de l'ENSIIE pour faire du calcul intensif, et comment s'en servir — en entreprise, et jusqu'aux compétitions internationales.
6 parties, 58 chapitres, dont une roadmap qui place les trois ans sur une frise avec sept jalons à critère vérifiable. La Brochure des enseignements FISA 2026-2027 intégralement dépouillée : les créneaux, les modules, les ECTS, et le fait structurant — la maquette ne laisse choisir que cinq UE techniques sur trois ans, une option facultative au S3, une au S4, trois UE de spécialisation au S5, et chaque choix passe par l'accord de l'entreprise.
Les trois décisions sont tranchées avec leur contre-argument : PRPA23 au S3 parce que c'est le seul enseignement de MPI du cursus ; PRCV24 au S4 pour son mini-projet de bibliothèque de threads ; et au S5 le triplet PGPU35 + PDSP35 + COAV35, qui tient parce que les trois UE sont sur trois créneaux distincts.
Puis ce que la maquette ne donne pas — et c'est beaucoup : ni administration de cluster, ni systèmes de fichiers parallèles, ni programmation scientifique, ni algèbre linéaire numérique. Dix chapitres de socle technique, quinze projets chiffrés dont sept tiennent sur un ordinateur portable, et le paysage réel des compétitions.
Le résultat structurant : environ 80 ECTS sur 180 viennent de l'entreprise. Pour un apprenti, le levier principal n'est pas le catalogue d'UE — c'est de transformer un traitement trop lent en sujet de projet, puis en projet de fin d'études. Une section Hors FISA documente en outre les dix UE de calcul intensif réservées à la formation sous statut étudiant, qui servent de plan d'auto-formation.
Aucun prérequis pour la partie « choix » · 10 à 15 h de lecture
Mathématiques du S1 de la FISA — ENSIIE¶
Cours complet de l'UE [MATH11] de la formation d'ingénieur par apprentissage de l'ENSIIE, reconstruit intégralement à partir du programme officiel — et rédigé à partir du niveau seconde.
5 parties, 46 chapitres, plus de 300 exercices corrigés cotés de ★ à ★★★★. Algèbre (récurrence, ensembles, combinatoire, tout le calcul matriciel jusqu'à la diagonalisation, arithmétique jusqu'au théorème des restes chinois), analyse (fonctions, les trois techniques d'intégration, nombres complexes), probabilités (de l'univers aux vecteurs gaussiens et au théorème central limite), et modélisation.
Chaque chapitre relie explicitement sa notion à son usage : Euclide étendu fabrique la clé privée de RSA, la diagonalisation d'une matrice de covariance est l'analyse en composantes principales, la variance de la sigmoïde explique le gradient qui s'évanouit. Tout le code Python publié a été exécuté et les sorties reportées telles quelles.
Niveau de départ : seconde · 90 à 130 h de travail · créé le 31 août 2026
Lire le langage corporel : des bases aux contre-mesures¶
Guide complet de l'observation du comportement humain, depuis les gestes élémentaires jusqu'aux méthodes d'interrogatoire judiciaire — et jusqu'aux moyens de leur résister.
5 parties, 37 chapitres. Les fondamentaux correctement posés (base de référence, grappe, contexte), l'état réel de la recherche, la boîte à outils du mentaliste expliquée mécaniquement, les méthodes d'entretien d'enquête des plus discréditées aux plus validées, et une partie entière de contre-mesures.
Le résultat qui structure tout le guide : un être humain détecte le mensonge à 54 % sur 206 études et 24 483 juges, et les professionnels ne font pas mieux — ils sont seulement plus confiants et plus enclins à accuser. La règle « 7-38-55 » ne dit pas ce qu'on lui fait dire, les mouvements oculaires de la PNL sont réfutés, l'entraînement aux micro-expressions n'améliore rien, et le programme de détection comportementale de la TSA a coûté ~900 M$ sans preuve de validité. Ce qui marche est ailleurs : divulguer ses preuves en dernier, poser des questions inattendues, demander du vérifiable.
Avec un tableau récapitulatif de tous les indices courants — croyance, statut empirique réel, chapitre — et un protocole d'entraînement de huit semaines dont la mesure finale n'est pas « suis-je meilleur ? » mais « mes prédictions à 80 % se réalisent-elles 80 % du temps ? ».
Aucun prérequis · 8 à 11 h de lecture · créé le 22 août 2026
Développement GPU : de zéro à expert¶
Cours complet de programmation sur processeur graphique, depuis « qu'est-ce qu'un warp » jusqu'aux megakernels de 2026 — l'idée consistant à compiler un modèle de langage entier en un seul lancement de noyau.
11 parties, 69 chapitres. L'architecture physique du GPU, le modèle CUDA
construit brique par brique, le modèle roofline et le profilage, le CUDA moderne
(TMA, clusters, wgmma, tcgen05, CUDA Tile), les neuf façons d'écrire un
noyau en 2026 (Triton, Gluon, CUTLASS/CuTe DSL, ThunderKittens, Helion, Mojo,
HIP, SYCL, WebGPU), tous les domaines d'application — et un cœur applicatif
consacré à l'IA : GEMM optimisée pas à pas, FlashAttention, fusion,
quantification, MoE, collectives.
Dix chapitres sur les megakernels, avec le corpus complet publié entre mai 2025 et juin 2026 : l'interpréteur sur GPU de Stanford (Llama-1B en moins d'une milliseconde, 78 % de la bande passante), le compilateur Mirage MPK, Event Tensor, Fleet, le monokernel AMD, et Ada-MK — déployé en production chez Baidu. Avec le calcul qui dit quand ne pas le faire.
Une bibliothèque de ressources externes (livres, cours vidéo, papiers, dépôts) référencées au plus près des affirmations qu'elles soutiennent, et un plan d'apprentissage de 90 jours avec un livrable mesuré par semaine.
Aucun prérequis au-delà d'un langage impératif · 34 h de lecture · créé le 22 août 2026
DeepSeek-V4.1-Flash : pousser la compression du cache KV¶
Analyse d'un modèle dont l'argument n'est pas la performance mais une grandeur que presque aucune publication ne met en avant : la taille du cache clé-valeur. 552 milliards de paramètres, 8 seulement activés par jeton au préremplissage, un million de jetons de contexte — et 890 octets de cache par jeton.
8 parties, 33 chapitres, dont un cours d'entrée sans prérequis, les quatre mécanismes de compression décortiqués un par un, la comparaison chiffrée avec Kimi K3 et GLM-5.3, et une lecture critique qui classe chaque affirmation par niveau de preuve.
Un script en Python pur part du seul config.json et des formats de
quantification lus dans le code d'inférence publié. Il retrouve les 551,93 G
de paramètres à 0,01 % près, et surtout les 890,0 octets par jeton au
dixième d'octet près — ce qui établit une composition du cache écrite nulle
part : quatre couches sources sur quarante, deux formats FP4 distincts, échelles
comprises. Les 389 120 octets qu'une figure officielle attribue à
« DeepSeek-V1 » sans nommer le modèle tombent eux aussi exactement, ce qui
l'identifie — et confirme le facteur 437× avec.
Le contraste le plus parlant du rapport tient en deux nombres : 36,8 sur HLE sans outils, 63,9 avec. C'est un modèle qui sait chercher plutôt qu'un modèle qui sait — et son architecture ne lui laissait pas d'autre choix.
Aucun prérequis · 5 à 7 h de lecture · créé le 10 septembre 2026
Kimi K3 : analyse complète¶
Analyse exhaustive du rapport technique de Kimi K3 (Moonshot AI, juillet 2026) — le premier modèle d'IA de la classe des 3 billions de paramètres publié en poids ouverts.
9 parties, 60 chapitres, incluant un cours complet sur le fonctionnement des grands modèles de langage pour débutant, l'analyse détaillée de l'architecture et de l'infrastructure, une lecture critique des revendications, et un guide de réimplémentation avec du code vérifié.
Aucun prérequis · 15 à 25 h de lecture · créé le 29 juillet 2026
Pokee-Isaac 28B : comment atteindre 10 M de tokens de contexte¶
Analyse d'un modèle annoncé avec une fenêtre de contexte de 10 millions de tokens — et dont l'éditeur ne publie ni architecture, ni poids, ni rapport technique.
8 parties, 24 chapitres, incluant un cours sur le coût du contexte long, et surtout une méthode : à défaut de pouvoir lire l'architecture, la contraindre par l'arithmétique. Les chiffres publiés suffisent à établir que le modèle est nécessairement hybride et à activation creuse, qu'aucune de ses couches ne fait d'attention globale — et que la revendication « 10 M de tokens sur une RTX 4090 » est fausse.
Aucun prérequis · 2 à 3 h de lecture · créé le 6 août 2026
Qwen3.8-Max : analyse complète¶
Analyse du premier modèle de la gamme « Max » d'Alibaba publié en poids ouverts — 2,42 billions de paramètres, 95 milliards actifs par jeton — et publié sans le moindre rapport technique.
8 parties, 33 chapitres, dont un cours d'entrée sur les LLM et une
architecture entièrement reconstruite à partir du seul config.json : attention
hybride 3 pour 1, Gated DeltaNet, MoE à 513 experts, prédiction multi-jetons. Un
script en Python pur recalcule les 2,4198 T de paramètres, les 95,29 G actifs, et
retrouve la taille du dépôt à 0,04 % près — ce qui établit une information que la
documentation ne donne pas. Deux corrections y sont apportées à la couverture
courante : les poids ouverts sont textuels alors que l'API est multimodale, et
la rumeur d'interdiction géographique dans la licence est fausse.
Aucun prérequis · 5 à 7 h de lecture · créé le 13 août 2026
Qwen3.8-27B : analyse complète¶
Le petit frère du précédent, publié deux jours après lui sous Apache 2.0 : un dense de 27,7 milliards de paramètres, nativement multimodal, et le seul modèle de sa génération qu'on puisse réellement faire tourner.
8 parties, 26 chapitres. Architecture reconstruite depuis config.json —
attention hybride 3 pour 1, voie visuelle native, mRoPE —, les trente lignes de
benchmarks reproduites et lues, et l'arithmétique matérielle carte par carte. Le
script de vérification retrouve la taille du dépôt à 0,26 % près et corrige
l'omission commune à tous les tableaux « VRAM requise » publiés : à 262 144
jetons le cache dépasse les poids, et une RTX 4090 en 4 bits ne tient que
~115 600 jetons — 44 % de la fenêtre annoncée.
Particularité : les douze prédictions d'architecture faites la veille de la sortie sont conservées et notées, y compris celle qui était juste pour de mauvaises raisons.
Aucun prérequis · 2 h 30 de lecture · créé le 13 août 2026, réédité le 15 août 2026 après publication des poids
LP Army & Meteora : le guide complet du DLMM¶
Étude de LP Army, la plus grande communauté de fournisseurs de liquidité en crypto, et du protocole Meteora sur lequel elle opère.
5 parties, 32 chapitres, couvrant la mécanique complète du DLMM (bins, formes de liquidité, formules de frais, perte impermanente), le curriculum des 23 leçons de l'academy, une trentaine de stratégies communautaires décrites en détail à partir de 362 publications analysées, et une sélection argumentée par profil de risque.
Aucun prérequis · 6 à 9 h de lecture · créé le 29 juillet 2026
Trading order flow automatisé en retail¶
Guide complet de construction d'un bot de trading fondé sur l'analyse du flux d'ordres, avec données Rithmic et comptes prop firm sur les futures CME.
6 parties, 39 chapitres, couvrant la microstructure du carnet d'ordres, les niveaux de données L1/L2/MBO, la lecture dynamique du carnet et du tape, l'écosystème Rithmic et ses trois APIs, les règles d'automatisation des prop firms, quatre stratégies formalisées de manière calculable, l'architecture logicielle avec du code Python testé, une boîte à outils raisonnée, la validation statistique selon López de Prado, et un modèle économique chiffré qui conclut à une espérance négative pour la première année.
Aucun prérequis en finance · 17 h de lecture · créé le 29 juillet 2026, révisé le 31 juillet 2026
Agrégateurs d'API LLM gratuites¶
Inventaire des fournisseurs donnant un accès gratuit aux modèles de langage par API, et des projets qui empilent ces offres derrière un point d'entrée unique.
5 parties, 15 chapitres, avec le détail modèle par modèle des quotas (requêtes et tokens, par minute et par jour), le budget mensuel en tokens réellement obtenable fournisseur par fournisseur, la liste des offres fermées en 2026 — dont certaines encore référencées par des annuaires « mis à jour quotidiennement » — et l'analyse des écarts entre les chiffres annoncés, qui vont de 1,37 à 10 milliards de tokens par mois pour le même écosystème.
Aucun prérequis · 50 min de lecture · créé le 3 août 2026
IP résidentielles bon marché pour MystNodes¶
Enquête sur le marché mondial des adresses IP résidentielles louables, partie d'une question simple : un node Mysterium rapporte 15 $/mois par IP, et les proxys résidentiels se vendent 0,27 $ l'unité — où est le piège ?
4 parties, 20 chapitres. Les six segments du marché passés en revue avec les prix et la couverture par pays — proxys ISP statiques, VPN à IP résidentielle, proxys mobiles 4G/5G, VPS résidentiels, lignes physiques réelles, location de blocs /24 avec déclaration par geofeed — puis un recensement géographique complet, Afrique, Amérique latine, Moyen-Orient, Asie du Sud-Est et CIS comprises.
Le piège est double. Une IP à 0,27 $ est un mandataire sortant : elle ne peut pas héberger un service, et un node est un serveur. Et les offres qui le peuvent coûtent 14 à 20 $/mois, alors que le budget maximal démontré est de 8,50 $ par IP. Un script en Python pur teste les dix-huit montages du panel : un seul est franchement positif, et c'est une vraie ligne fibre chez un vrai foyer.
Le calcul est refait aux prix de gros, et c'est là que tombe le chiffre décisif : le plancher mondial de la bande passante résidentielle achetée en gros est de 0,50 $/Go, quand Mysterium en verse 0,032 à 0,24 $ net. Au meilleur prix du monde, l'intrant coûte 2 à 16 fois ce que la revente rapporte. Le volume fait bien tomber le prix de l'adresse — un /24 loué revient à 1,62 $/IP tout compris — mais laisse intactes les deux choses qui ne s'achètent pas : le droit d'accepter une connexion entrante, et le fait d'être un vrai foyer.
Le second passage ajoute la pièce manquante : le 28 janvier 2026, Google a démantelé IPIDEA, l'arrière-guichet commun à treize marques de proxys et de VPN, qui enrôlait des millions d'appareils comme nœuds de sortie via des kits glissés dans 600 applications Android — sans le consentement de leurs propriétaires. C'est l'explication des prix du bas de marché, et le renversement de la question : le node runner n'est pas un client de ce marché, il en est la filière d'approvisionnement légitime.
Aucun prérequis · 1 h 30 à 2 h de lecture · créé le 30 août 2026
Récemment publié¶
| Date | Recherche | Domaine |
|---|---|---|
| 25 septembre 2026 | Se former au management sans école de commerce | Management |
| 25 septembre 2026 | Le HPC à l'ENSIIE par apprentissage | Informatique |
| 10 septembre 2026 | DeepSeek-V4.1-Flash : analyse complète | Intelligence artificielle |
| 8 septembre 2026 | Le décodage spéculatif, de 2018 à DSpark | Intelligence artificielle |
| 31 août 2026 | Mathématiques du S1 de la FISA — ENSIIE | Mathématiques |
| 30 août 2026 | IP résidentielles bon marché pour MystNodes | Finance décentralisée |
| 23 août 2026 | Un smartphone à moins de 230 € qui tienne 5 ans | Guides d'achat |
| 22 août 2026 | Lire le langage corporel : des bases aux contre-mesures | Sciences humaines |
| 22 août 2026 | Développement GPU : de zéro à expert | Informatique |
| 15 août 2026 | Qwen3.8-27B : analyse complète — réédition après publication des poids | Intelligence artificielle |
| 13 août 2026 | Qwen3.8-Max : analyse complète | Intelligence artificielle |
| 6 août 2026 | Pokee-Isaac 28B : 10 M de tokens de contexte | Intelligence artificielle |
| 3 août 2026 | Agrégateurs d'API LLM gratuites | Intelligence artificielle |
| 29 juillet 2026 | Trading order flow automatisé en retail | Marchés financiers |
| 29 juillet 2026 | LP Army & Meteora : le guide du DLMM | Finance décentralisée |
| 29 juillet 2026 | Kimi K3 : analyse complète | Intelligence artificielle |
Principes de rédaction¶
Les documents de cette bibliothèque suivent quelques règles constantes :
- L'intuition avant la formule. Chaque concept est d'abord expliqué de manière informelle.
- Aucun terme technique sans définition, ou sans lien vers sa définition.
- Distinction stricte entre faits vérifiables, affirmations de constructeurs, interprétations et inconnues.
- Les sources sont citées au plus près des affirmations qu'elles soutiennent.
- Les vérifications indépendantes sont explicitées — y compris quand elles ne confirment pas la source.