Aller au contenu

Sources

Toutes les sources ont été consultées le 3 août 2026, sauf mention contraire. La date indiquée entre parenthèses est celle de la donnée, pas de la consultation.


Point de départ de la recherche

Les deux liens à l'origine de ce rapport :

Méthode de récupération du tweet

L'accès direct renvoie une erreur 402 Payment Required. Le contenu a donc été récupéré via trois proxys publics indépendants, puis comparé :

Proxy Endpoint Résultat
Syndication X cdn.syndication.twimg.com/tweet-result?id=… ✅ texte + médias + métadonnées
FxTwitter api.fxtwitter.com/Granite0x/status/… ✅ texte + engagement + tweet cité
VxTwitter api.vxtwitter.com/Granite0x/status/… ✅ texte + engagement

Les trois restitutions du texte sont rigoureusement identiques (898 caractères, comparaison octet par octet). Cette concordance est ce qui autorise à citer le tweet comme source fiable malgré l'impossibilité d'accéder à l'original.

Deux instances Nitter ont également été testées : xcancel.com renvoie une page anti-robot, nitter.poast.org une erreur 503, nitter.net un corps vide. Aucune donnée n'en provient.

Ce que le tweet ne fournit pas

  • Les 9 réponses ne sont pas restituées par ces proxys, qui ne gèrent pas les fils de conversation.
  • Le tweet cité (24 juillet 2026) renvoie à un article long-format du même auteur, « A Graph of Loops: Build a Full Claude Code Agent System From GitHub », sans rapport avec OmniRoute. L'article lui-même (x.com/i/article/2080625876987756544) n'a pu être récupéré : le proxy texte r.jina.ai bloque le domaine x.com, et FxTwitter ne gère pas les articles. Seules ses métadonnées (titre, texte d'aperçu) ont été obtenues.
  • La vidéo de 22 secondes attachée n'a pas été analysée.

Aucune donnée chiffrée du rapport ne provient du tweet : il ne fait que reprendre le chiffre de ~1,53 Md publié par la documentation d'OmniRoute, qui est la source réellement utilisée.


Documentation officielle des fournisseurs

Sources primaires, prioritaires sur toutes les autres.

Fournisseur Page Utilisée pour
Groq console.groq.com/docs/rate-limits Table complète RPM/RPD/TPM/TPD par modèle
Cerebras inference-docs.cerebras.ai/support/rate-limits 5 RPM / 30 K TPM / 1 M TPD, crédit de 5 $
Cerebras cerebras.ai/pricing Distinction tier gratuit / crédit
Cohere docs.cohere.com/docs/rate-limits 20 RPM, 1 000 appels/mois, limites par endpoint
OpenRouter openrouter.ai/docs/api/reference/limits 20 RPM, 50 → 1 000 RPD, règle du solde positif
Cloudflare developers.cloudflare.com/workers-ai/platform/pricing 10 000 neurones/jour, grille neurones/M tokens
Google ai.google.dev/gemini-api/docs/rate-limits Système de paliers, renvoi au tableau de bord

Documentations inaccessibles

Les pages de limites de débit de Mistral (docs.mistral.ai) renvoient une erreur 404 depuis leur réorganisation. Le tableau de bord de quotas de Google AI Studio exige une authentification. Le catalogue de freellmapi.co/models charge dynamiquement et n'a rien renvoyé d'exploitable. Les chiffres correspondants s'appuient donc sur des sources secondaires, signalés comme tels dans le rapport.


Annonces officielles


Listes communautaires

Sources secondaires, auto-générées. Utilisées pour les listes de modèles et les fournisseurs mineurs, jamais comme autorité finale sur un quota.

cheahjs/free-llm-api-resources

github.com/cheahjs/free-llm-api-resources

  • README généré le 29 juillet 2026 (commit « Update README with latest models (#361) »).
  • ~29 200 étoiles.
  • La plus rigoureuse : exclut explicitement les services rétro-conçus.
  • Utilisée pour : Google AI Studio (version A), Mistral Codestral, Cloudflare, OpenRouter, listes de modèles, crédits d'essai.

awesome-free-llm-apis / freellm.net

github.com/open-free-llm-api/awesome-freellm-apis · freellm.net

  • Données du 3 août 2026.
  • La plus riche : URL de base, exigence de carte, modalités, fenêtres de contexte, classement d'usage hebdomadaire.
  • Fiabilité défaillante : liste encore GitHub Models (retiré le 30 juillet 2026) et Chutes.ai (fermé en mars 2026) comme tiers gratuits actifs.
  • Utilisée pour : URL de base, fournisseurs mineurs, ordres de grandeur.

OmniRoute — documentation

  • FREE_TIERS.md — recherche du 17 juin 2026, document versionné v3.8.40 du 28 juin 2026. Seule source du corpus donnant des budgets mensuels en tokens par fournisseur, avec méthodologie et audit des conditions d'utilisation.
  • PROVIDER_REFERENCE.md — généré le 28 juillet 2026, v3.8.49. Répartition des 290 fournisseurs par catégorie.
  • README d'OmniRoute — fonctions, stratégies de routage, compression.

FreeLLMAPI — documentation

  • README — 29 fournisseurs, ~4 Md tokens/mois, modèle premium, avertissement sur l'instabilité des tiers gratuits.
  • docs/architecture.md — limites reconnues, revue des conditions d'utilisation (mai 2026).

Métadonnées vérifiées via l'API GitHub

Consultées le 3 août 2026 :

Dépôt Étoiles Dernier push Création
cheahjs/free-llm-api-resources 29 177 29 juillet 2026 —
tashfeenahmed/freellmapi 17 591 2 août 2026 21 avril 2026
diegosouzapw/OmniRoute 38 433 3 août 2026 13 février 2026

Sources secondaires de contexte

Utilisées uniquement pour corroborer un ordre de grandeur, jamais seules.

  • Recherches web sur les limites du tier gratuit Gemini (mi-2026) — version C du désaccord Google.
  • Recherches web sur le tier Experiment de Mistral (juillet 2026) — corroboration du ~1 Md tokens/mois et des ~2 RPM.
  • Recherches web sur NVIDIA NIM (mai 2026), incluant les fils du forum développeurs NVIDIA sur la limite de 40 RPM.
  • Recherches web sur les limites gratuites de Z.AI GLM-4.7-Flash (2026).
  • Recherches web confirmant la fermeture du tier gratuit de Chutes.ai (mars 2026).

Ce que valent les sources secondaires sur ce sujet

Le sujet attire une quantité importante de contenu optimisé pour le référencement, qui recopie des chiffres périmés sans les dater. Aucune valeur de ce rapport ne repose sur une source secondaire seule : elles ne servent qu'à corroborer ou à documenter un désaccord.


Ce qui n'a pas pu être vérifié

Par honnêteté, la liste de ce qui reste ouvert :

  1. La décomposition des ~4 Md de FreeLLMAPI — le catalogue détaillé est réservé à l'offre premium et la page publique n'a rien renvoyé.
  2. Le ~1 Md/mois de Mistral — non confirmé par la documentation officielle, inaccessible ; et le modèle de quota a changé pour des limites par organisation.
  3. Les quotas réels de Google AI Studio — trois valeurs incompatibles, et Google renvoie au tableau de bord par projet.
  4. Le facteur de compression de 15–95 % d'OmniRoute — revendication du projet, sans vérification indépendante dans cette recherche.
  5. Les fournisseurs mineurs (LLM7, api.airforce, BluesMinds, Bazaarlink, Arcee, Morph, Ollama Cloud) — repris des listes communautaires sans vérification à la source.