Aller au contenu

Fiabilité des chiffres


Le même écosystème, cinq totaux

Total Source Ce qui est compté
~1,37 Md/mois OmniRoute v3.8.42 Récurrent chiffrable, après reclassement de LongCat
~1,53 Md/mois OmniRoute v3.8.49 Récurrent chiffrable, 43 pools
~2,15 Md OmniRoute, premier mois + crédits d'inscription
~4 Md/mois FreeLLMAPI Non décomposé
~10 Md/mois OmniRoute, rejeté + débits extrapolés 24 h/24

Un facteur 7,3 sépare le plus bas du plus haut. Aucun n'est mensonger en soi ; ils ne mesurent simplement pas la même chose.

La règle

Un total sans méthode de calcul n'est pas une information. Exigez de savoir : les crédits d'inscription sont-ils inclus ? les pools partagés sont-ils dédupliqués ? les fournisseurs sans plafond sont-ils extrapolés ?


Les contradictions relevées

1. Google AI Studio — facteur 75

Source Gemini 3.6 Flash
cheahjs, 29 juillet 2026 20 requêtes/jour, 5 RPM, 250 000 TPM
freellm.net, 3 août 2026 1 500 requêtes/jour, 15 RPM
Sources secondaires, mi-2026 1 500 requêtes/jour, 10 RPM
Documentation officielle Google « consultez votre tableau de bord »

Arbitrage : la version cheahjs est à la fois la plus récente, la plus pessimiste et la plus cohérente avec la tendance documentée (coupe de 50–80 % en décembre 2025, retrait de Gemini 2.5 Pro du gratuit en avril 2026, arrêt de 2.0 Flash en juin 2026). Les 1 500 RPD ressemblent à une valeur d'avant la coupe, jamais rafraîchie.

Mais Google lui-même refuse de trancher : sa documentation renvoie au tableau de bord par projet et précise que « les limites indiquées ne sont pas garanties ». C'est donc le seul cas du rapport où aucune source externe ne fait autorité.

2. GitHub Models — un service mort encore listé

Retiré le 30 juillet 2026, encore présent le 3 août 2026 dans le tableau des tiers gratuits permanents de freellm.net. Détails dans Fournisseurs disparus.

3. Chutes.ai — idem

Tier gratuit fermé en mars 2026 selon OmniRoute, encore listé par freellm.net en août 2026.

4. Groq — 42 M ou 15 M par mois ?

Ce rapport calcule 42 M/mois en additionnant les plafonds quotidiens par modèle (quotas non partagés, d'après la documentation officielle). OmniRoute annonce 15 M après déduplication par pool.

Arbitrage : les deux sont défendables. La documentation Groq présente bien des TPD par modèle, ce qui appuie le calcul haut ; la prudence d'OmniRoute protège contre l'hypothèse — plausible — d'un pool partagé non documenté. Retenez 15 M comme plancher, 42 M comme plafond.

5. Mistral — le milliard invérifiable

Le chiffre de ~1 Md tokens/mois pèse 65 % du total agrégé. Il provient d'OmniRoute et de sources secondaires, pas de la documentation officielle, dont les pages de limites de débit renvoient une erreur 404 depuis leur réorganisation.

Pire : cheahjs documente que Mistral est passé à des limites par modèle et par organisation, un nouveau compte voyant « entre 25 000 et 20 000 000 tokens/minute et entre 0,03 et 12,5 requêtes/seconde selon le modèle ». Ce n'est plus le même modèle de quota.

La conséquence

Si le milliard Mistral ne se vérifie pas sur votre compte, le total agrégé de tout l'écosystème tombe de 1,53 Md à environ 500 M. C'est le point de fragilité principal de tous les chiffres publiés.

6. AI21 — 3 mois ou 7 jours ?

cheahjs (29 juillet 2026) : crédit de 10 $ valable 3 mois. OmniRoute (17 juin 2026) : « trial window shrunk from 3 months to 7 days ».

Contradiction non résolue. La source la plus récente donne la valeur la plus généreuse, ce qui est inhabituel et suggère que cheahjs n'a pas rafraîchi cette ligne.


Les biais systématiques

Biais 1 — Les listes vieillissent vers le haut

Une offre supprimée reste listée ; une offre réduite garde son ancien chiffre. Le biais est donc toujours optimiste. Sur les six contradictions relevées, cinq vont dans le sens d'un chiffre trop généreux.

Biais 2 — « Régénéré quotidiennement » ≠ « vérifié quotidiennement »

Un script qui régénère un Markdown depuis une base de données n'améliore pas la fraîcheur de cette base. freellm.net en fait la démonstration.

Biais 3 — Le compteur de fournisseurs est gonflable

Annoncer 290 fournisseurs est impressionnant. Mais 195 sont payants, 31 sont des cookies de navigateur, 23 des jetons OAuth détournés — 43 pools seulement sont chiffrables en tokens gratuits. Le nombre qui compte est celui-là.

Biais 4 — Le volume masque le débit

Tous les totaux publiés sont des volumes. Aucun n'exprime ce que vous pouvez réellement consommer par heure. Or c'est le débit qui bloque en premier, presque toujours.


Méthode de vérification recommandée

Quatre étapes, dix minutes

  1. Page tarifaire officielle du fournisseur. Elle prime sur tout.
  2. Tableau de bord de votre compte quand il existe (Google AI Studio, Mistral admin.mistral.ai/plateforme/limits, OpenRouter). C'est la seule source qui reflète votre quota.
  3. En-têtes de réponse HTTP — la plupart des fournisseurs renvoient des X-RateLimit-* qui donnent le quota restant en temps réel. C'est la vérité opérationnelle.
  4. Un test réel — envoyez 20 requêtes et regardez quand arrive le premier 429. Cinq minutes de test valent mieux que trois annuaires.

Ce que ce rapport ne garantit pas

Ce document a été rédigé le 3 août 2026 à partir de sources datées du 17 juin au 3 août 2026. Compte tenu du rythme de changement observé — huit fermetures et dix réductions majeures en douze mois — une partie de ses chiffres sera périmée dans les trois mois.

Sa valeur durable n'est pas dans les nombres, mais dans la méthode : savoir quelles catégories sont additionnables, quelle limite mord en premier, et pourquoi un total annoncé sans méthode ne veut rien dire.


Chapitre suivant : Conditions d'utilisation