OmniRoute¶
Dépôt : github.com/diegosouzapw/OmniRoute
L'origine : un tweet¶
Cette recherche est partie d'un lien vers un tweet de @Granite0x publié le 2 août 2026 à 13 h 54 UTC. Contrairement à ce qu'on pouvait supposer, il ne parle pas de FreeLLMAPI mais d'OmniRoute.
Texte intégral, récupéré via trois proxys indépendants — l'API de
syndication de X, api.fxtwitter.com et api.vxtwitter.com — dont les
restitutions sont rigoureusement identiques (898 caractères, comparaison
octet par octet) :
🚨 YOUR AGENT WILL NEVER HIT A RATE LIMIT AGAIN
someone open-sourced a repo that stacks the free allowances of 90+ AI providers into one endpoint
OmniRoute. 290+ providers in total, 500+ models, built by 500+ contributors. 36,493 stars
install it - and your agent gets:
- one endpoint that speaks OpenAI, so Claude Code, Cursor, Codex, Cline and Copilot just work
- Claude, GPT, Gemini, Kimi, DeepSeek, GLM, MiniMax - switch by name
- quota dies mid-task → it moves on instead of stopping
- the order it tries: your subscription, then your keys, then cheap, then free
- ~1.53B free tokens a month across 516 models
no signup. model "auto" answers on a fresh install with zero keys.
important: it's all local. your keys sit encrypted on your machine, your prompts never route through anyone's cloud
Le tweet est exact
Vérification faite : les 36 493 étoiles annoncées correspondent (le dépôt en affichait 38 433 le 3 août, la croissance est cohérente), les 290 fournisseurs et le chiffre de ~1,53 Md tokens/mois correspondent exactement à ce que publie la documentation du projet, et l'affirmation « c'est local, vos clés restent chiffrées chez vous » est conforme à l'architecture décrite.
C'est suffisamment rare pour être noté : le tweet promotionnel reprend le chiffre conservateur du projet, pas son plafond théorique de 10 milliards.
Seule nuance : « YOUR AGENT WILL NEVER HIT A RATE LIMIT AGAIN » reste une formule publicitaire. Un routeur ne supprime pas les limites, il les contourne en changeant de fournisseur — jusqu'à ce que tous soient épuisés.
Ce que le tweet ne contient pas¶
Le message se termine par « save this before the next time your agent quits on you mid-task ↓ ». Cette flèche laisse attendre un fil de discussion détaillant les fournisseurs. Vérification faite, elle ne mène à rien de tel :
- une vidéo de 22 secondes (démonstration du tableau de bord) ;
- un tweet cité du 24 juillet 2026, qui pointe vers un article long-format du même auteur intitulé « A Graph of Loops: Build a Full Claude Code Agent System From GitHub » — sans rapport avec OmniRoute.
Les 9 réponses au tweet ne sont pas accessibles via les proxys publics, qui ne restituent pas les fils de conversation. Toutes les données chiffrées de ce rapport proviennent donc de la documentation du projet, pas du tweet — lequel ne fait que reprendre le chiffre de 1,53 Md publié par OmniRoute.
Portée réelle du message¶
| Métrique | Valeur |
|---|---|
| Vues | 12 237 |
| Mentions « j'aime » | 87 |
| Signets | 164 |
| Republications | 7 |
| Réponses | 9 |
Le tweet n'explique pas la popularité du projet
12 000 vues pour un dépôt à 38 000 étoiles : ce message n'est pas la source de la notoriété d'OmniRoute, seulement l'un des nombreux relais d'un projet déjà installé. C'est utile à savoir pour ne pas confondre viralité d'un post et adoption d'un outil — la seconde se mesure sur le dépôt, pas sur le réseau social.
Fiche d'identité¶
| Créé le | 13 février 2026 |
| Étoiles GitHub (3 août 2026) | ~38 400 |
| Forks | ~5 000 |
| Licence | MIT |
| Fournisseurs | 290 (dont 90+ avec tier gratuit, 40+ gratuits pour toujours) |
| Modèles | 500+ |
| Tokens gratuits annoncés | ~1,53 milliard/mois (43 pools, 516 modèles) |
| Modèle économique | Entièrement gratuit, financé par dons |
Répartition des 290 fournisseurs¶
D'après PROVIDER_REFERENCE.md,
généré le 28 juillet 2026 :
| Catégorie | Nombre | Nature |
|---|---|---|
| Clé d'API (payant ou avec crédits gratuits) | 195 | Le gros du catalogue |
| Cookie web | 31 | Sessions de navigateur rejouées ⚠️ |
| OAuth | 23 | Connexions d'autres logiciels réutilisées ⚠️ |
| Autres (local, recherche, audio, agents cloud, système) | ~41 | Ollama, LM Studio, vLLM, moteurs de recherche… |
54 fournisseurs sur 290 ne sont pas des API
Les catégories « cookie web » et « OAuth » représentent près d'un cinquième du catalogue. Elles couvrent ChatGPT Web, Claude Web, Perplexity Web, Gemini Web, Qwen Web, Poe, t3.chat, Meta AI, Microsoft Copilot, Kiro, Antigravity…
Le projet est transparent sur le sujet : sa table « ToS attention » marque
19 fournisseurs caution en citant l'article des conditions concerné —
par exemple pour Kiro : « Kiro FAQ explicitly prohibits use with OpenClaw
and similar tools that leverage third-party harnesses », ou pour t3.chat :
« ToS explicitly restricts accounts to personal use only, prohibits
credential sharing with third parties, and bans automated/bot/scraping
access ».
Ces fournisseurs ne sont pas comptés dans le budget en tokens : ils
apparaissent avec la mention keyless et aucune valeur chiffrée. Ils
gonflent le compteur « 290 fournisseurs », pas le compteur de tokens.
La méthodologie, publiée¶
C'est ce qui distingue OmniRoute. Son fichier
FREE_TIERS.md
publie quatre chiffres au lieu d'un, et explique pourquoi il en rejette deux :
| Métrique | Valeur | Statut |
|---|---|---|
| Grant récurrent documenté | ~1,53 Md/mois | « Use this number » |
| + crédits d'inscription | ~2,15 Md | Premier mois seulement |
| + gratuits sans plafond publié | non quantifiable | Listé, jamais sommé |
| + déblocage par dépôt (10 $ OpenRouter) | +~24 M/mois | Rapporté séparément |
| Plafond théorique (limites × 24/7) | ~10 Md/mois | « do not headline this » |
Les règles de conversion sont explicites : plafond quotidien × 30 ; à défaut,
RPD × ~800 tokens de sortie × 30 ; un crédit d'inscription compte zéro dans
le budget récurrent ; un fournisseur sans plafond publié est classé
recurring-uncapped et jamais additionné.
Le projet indique que le chiffre est contrôlé par intégration continue : un
test check:docs-counts fait échouer le build si la documentation dérive de ce
que calcule la fonction computeFreeModelTotals().
Le passage le plus honnête du corpus
« Le plafond théorique (~10 Md) est gonflé par des fournisseurs limités seulement en débit, sans plafond de tokens publié, dont les chiffres seraient RPM/TPM × 24/7 × 30j — un maximum théorique qu'aucun compte réel ne soutiendra. Ils sont exclus du chiffre défendable. C'est cette même inflation qui rend peu fiables les revendications multi-milliards des concurrents. »
Un projet qui explique publiquement comment il pourrait annoncer 10 milliards, et pourquoi il annonce 1,53, mérite d'être cru davantage qu'un projet qui annonce 4 milliards sans décomposition.
Les révisions à la baisse, publiées¶
| Version | Total | Correction |
|---|---|---|
| Avant juin 2026 | ~1,94 Md | — |
| 17 juin 2026 | ~1,53 Md | Gemini dédupliqué (462 M → 60 M), Cloudflare corrigé (122 M → 30 M), Doubao reclassé, tiers fermés retirés |
| v3.8.42 | ~1,37 Md | LongCat reclassé en crédit unique |
| v3.8.49 | ~1,53 Md | 4 pools ajoutés + 2 nouveaux fournisseurs |
Le projet qualifie la baisse de juin de « honesty correction, not a loss ».
Fonctions notables¶
- 19 stratégies de routage (
auto/cheap,auto/offline, remplissage de quota, quota restant maximal, réinitialisation la plus proche…), avec un moteur de scoring à 12 facteurs. - Cascade en 4 niveaux : abonnement → clé d'API → modèles bon marché → gratuits.
- Compression de contexte — une pile de 12 moteurs (RTK, Caveman, LLMLingua-2, session-dedup…) annoncée à 15–95 % d'économie, ~89 % en moyenne sur les sessions riches en appels d'outils. Code, URL et JSON sont préservés à l'octet près.
- Fonctionne sans clé — le modèle
autorépond dès l'installation grâce aux fournisseurs sans authentification pré-câblés (OpenCode Free, Felo). - Local d'abord — clés chiffrées AES-256-GCM sur votre machine.
- Serveur MCP (104 outils), protocole A2A, mémoire persistante, garde-fous, mode distant, applications Desktop/Termux/PWA, 43 langues d'interface.
La compression est peut-être l'apport le plus concret
Si l'on retient un facteur de compression même modeste — disons 50 % sur des sessions d'agent réelles plutôt que les 89 % annoncés — cela double de fait le budget gratuit disponible, sans dépendre d'aucun fournisseur. C'est un levier plus fiable que l'empilement de clés, puisqu'il ne peut pas être retiré par un changement de politique tarifaire.
Ce chiffre de 15–95 % est en revanche une revendication du projet, non vérifiée de façon indépendante dans cette recherche.
Chapitre suivant : Listes de référence