Aller au contenu

Partie 9 · Pratique

Comment passer de la lecture à l'écriture. Obtenir une carte, monter l'environnement, intégrer un noyau, tester, déboguer, et un plan de progression sur 90 jours.


Le principe de cette partie

Toutes les parties précédentes expliquent quoi et pourquoi. Celle-ci répond au comment, au niveau le plus concret possible.

Elle part d'un constat : la barrière d'entrée de la programmation GPU n'est pas intellectuelle, elle est logistique. Il faut une carte, un environnement qui compile, un moyen de mesurer, et un plan.


Ordre de lecture

1 · Obtenir un GPU

Gratuit, loué à l'heure, ou acheté. Les options réelles en 2026, avec les ordres de grandeur de prix et ce que chacune permet d'apprendre.

2 · Mettre en place l'environnement

Pilote, toolkit, PyTorch, Triton, profileurs. Les pièges de versions, et un squelette de projet qui compile.

3 · Intégrer un noyau dans PyTorch

Les quatre méthodes, de load_inline à l'extension compilée, avec la gestion des gradients et l'enregistrement d'opérateurs personnalisés.

4 · Tester et déboguer

Comment savoir qu'un noyau est correct, et quoi faire quand il ne l'est pas. Tolérances, compute-sanitizer, tests de propriétés, stratégies de bissection.

5 · Plan d'entraînement de 90 jours

Un programme jour par jour, avec des livrables vérifiables. Douze semaines, du premier hello world à un noyau non trivial mesuré contre une référence.


Le conseil le plus important de cette partie

Écrivez du code dès la première semaine. Ce document fait 34 heures de lecture ; les lire toutes avant d'ouvrir un éditeur est la meilleure façon de ne rien retenir.

Le rythme qui fonctionne : lire une partie, écrire un noyau qui l'applique, le profiler, passer à la suivante.