Aller au contenu

OmniRoute

Dépôt : github.com/diegosouzapw/OmniRoute


L'origine : un tweet

Cette recherche est partie d'un lien vers un tweet de @Granite0x publié le 2 août 2026 à 13 h 54 UTC. Contrairement à ce qu'on pouvait supposer, il ne parle pas de FreeLLMAPI mais d'OmniRoute.

Texte intégral, récupéré via trois proxys indépendants — l'API de syndication de X, api.fxtwitter.com et api.vxtwitter.com — dont les restitutions sont rigoureusement identiques (898 caractères, comparaison octet par octet) :

🚨 YOUR AGENT WILL NEVER HIT A RATE LIMIT AGAIN

someone open-sourced a repo that stacks the free allowances of 90+ AI providers into one endpoint

OmniRoute. 290+ providers in total, 500+ models, built by 500+ contributors. 36,493 stars

install it - and your agent gets:

  • one endpoint that speaks OpenAI, so Claude Code, Cursor, Codex, Cline and Copilot just work
  • Claude, GPT, Gemini, Kimi, DeepSeek, GLM, MiniMax - switch by name
  • quota dies mid-task → it moves on instead of stopping
  • the order it tries: your subscription, then your keys, then cheap, then free
  • ~1.53B free tokens a month across 516 models

no signup. model "auto" answers on a fresh install with zero keys.

important: it's all local. your keys sit encrypted on your machine, your prompts never route through anyone's cloud

Le tweet est exact

Vérification faite : les 36 493 étoiles annoncées correspondent (le dépôt en affichait 38 433 le 3 août, la croissance est cohérente), les 290 fournisseurs et le chiffre de ~1,53 Md tokens/mois correspondent exactement à ce que publie la documentation du projet, et l'affirmation « c'est local, vos clés restent chiffrées chez vous » est conforme à l'architecture décrite.

C'est suffisamment rare pour être noté : le tweet promotionnel reprend le chiffre conservateur du projet, pas son plafond théorique de 10 milliards.

Seule nuance : « YOUR AGENT WILL NEVER HIT A RATE LIMIT AGAIN » reste une formule publicitaire. Un routeur ne supprime pas les limites, il les contourne en changeant de fournisseur — jusqu'à ce que tous soient épuisés.

Ce que le tweet ne contient pas

Le message se termine par « save this before the next time your agent quits on you mid-task ↓ ». Cette flèche laisse attendre un fil de discussion détaillant les fournisseurs. Vérification faite, elle ne mène à rien de tel :

  • une vidéo de 22 secondes (démonstration du tableau de bord) ;
  • un tweet cité du 24 juillet 2026, qui pointe vers un article long-format du même auteur intitulé « A Graph of Loops: Build a Full Claude Code Agent System From GitHub » — sans rapport avec OmniRoute.

Les 9 réponses au tweet ne sont pas accessibles via les proxys publics, qui ne restituent pas les fils de conversation. Toutes les données chiffrées de ce rapport proviennent donc de la documentation du projet, pas du tweet — lequel ne fait que reprendre le chiffre de 1,53 Md publié par OmniRoute.

Portée réelle du message

Métrique Valeur
Vues 12 237
Mentions « j'aime » 87
Signets 164
Republications 7
Réponses 9

Le tweet n'explique pas la popularité du projet

12 000 vues pour un dépôt à 38 000 étoiles : ce message n'est pas la source de la notoriété d'OmniRoute, seulement l'un des nombreux relais d'un projet déjà installé. C'est utile à savoir pour ne pas confondre viralité d'un post et adoption d'un outil — la seconde se mesure sur le dépôt, pas sur le réseau social.


Fiche d'identité

Créé le 13 février 2026
Étoiles GitHub (3 août 2026) ~38 400
Forks ~5 000
Licence MIT
Fournisseurs 290 (dont 90+ avec tier gratuit, 40+ gratuits pour toujours)
Modèles 500+
Tokens gratuits annoncés ~1,53 milliard/mois (43 pools, 516 modèles)
Modèle économique Entièrement gratuit, financé par dons

Répartition des 290 fournisseurs

D'après PROVIDER_REFERENCE.md, généré le 28 juillet 2026 :

Catégorie Nombre Nature
Clé d'API (payant ou avec crédits gratuits) 195 Le gros du catalogue
Cookie web 31 Sessions de navigateur rejouées ⚠️
OAuth 23 Connexions d'autres logiciels réutilisées ⚠️
Autres (local, recherche, audio, agents cloud, système) ~41 Ollama, LM Studio, vLLM, moteurs de recherche…

54 fournisseurs sur 290 ne sont pas des API

Les catégories « cookie web » et « OAuth » représentent près d'un cinquième du catalogue. Elles couvrent ChatGPT Web, Claude Web, Perplexity Web, Gemini Web, Qwen Web, Poe, t3.chat, Meta AI, Microsoft Copilot, Kiro, Antigravity…

Le projet est transparent sur le sujet : sa table « ToS attention » marque 19 fournisseurs caution en citant l'article des conditions concerné — par exemple pour Kiro : « Kiro FAQ explicitly prohibits use with OpenClaw and similar tools that leverage third-party harnesses », ou pour t3.chat : « ToS explicitly restricts accounts to personal use only, prohibits credential sharing with third parties, and bans automated/bot/scraping access ».

Ces fournisseurs ne sont pas comptés dans le budget en tokens : ils apparaissent avec la mention keyless et aucune valeur chiffrée. Ils gonflent le compteur « 290 fournisseurs », pas le compteur de tokens.


La méthodologie, publiée

C'est ce qui distingue OmniRoute. Son fichier FREE_TIERS.md publie quatre chiffres au lieu d'un, et explique pourquoi il en rejette deux :

Métrique Valeur Statut
Grant récurrent documenté ~1,53 Md/mois « Use this number »
+ crédits d'inscription ~2,15 Md Premier mois seulement
+ gratuits sans plafond publié non quantifiable Listé, jamais sommé
+ déblocage par dépôt (10 $ OpenRouter) +~24 M/mois Rapporté séparément
Plafond théorique (limites × 24/7) ~10 Md/mois « do not headline this »

Les règles de conversion sont explicites : plafond quotidien × 30 ; à défaut, RPD × ~800 tokens de sortie × 30 ; un crédit d'inscription compte zéro dans le budget récurrent ; un fournisseur sans plafond publié est classé recurring-uncapped et jamais additionné.

Le projet indique que le chiffre est contrôlé par intégration continue : un test check:docs-counts fait échouer le build si la documentation dérive de ce que calcule la fonction computeFreeModelTotals().

Le passage le plus honnête du corpus

« Le plafond théorique (~10 Md) est gonflé par des fournisseurs limités seulement en débit, sans plafond de tokens publié, dont les chiffres seraient RPM/TPM × 24/7 × 30j — un maximum théorique qu'aucun compte réel ne soutiendra. Ils sont exclus du chiffre défendable. C'est cette même inflation qui rend peu fiables les revendications multi-milliards des concurrents. »

Un projet qui explique publiquement comment il pourrait annoncer 10 milliards, et pourquoi il annonce 1,53, mérite d'être cru davantage qu'un projet qui annonce 4 milliards sans décomposition.


Les révisions à la baisse, publiées

Version Total Correction
Avant juin 2026 ~1,94 Md —
17 juin 2026 ~1,53 Md Gemini dédupliqué (462 M → 60 M), Cloudflare corrigé (122 M → 30 M), Doubao reclassé, tiers fermés retirés
v3.8.42 ~1,37 Md LongCat reclassé en crédit unique
v3.8.49 ~1,53 Md 4 pools ajoutés + 2 nouveaux fournisseurs

Le projet qualifie la baisse de juin de « honesty correction, not a loss ».


Fonctions notables

  • 19 stratégies de routage (auto/cheap, auto/offline, remplissage de quota, quota restant maximal, réinitialisation la plus proche…), avec un moteur de scoring à 12 facteurs.
  • Cascade en 4 niveaux : abonnement → clé d'API → modèles bon marché → gratuits.
  • Compression de contexte — une pile de 12 moteurs (RTK, Caveman, LLMLingua-2, session-dedup…) annoncée à 15–95 % d'économie, ~89 % en moyenne sur les sessions riches en appels d'outils. Code, URL et JSON sont préservés à l'octet près.
  • Fonctionne sans clé — le modèle auto répond dès l'installation grâce aux fournisseurs sans authentification pré-câblés (OpenCode Free, Felo).
  • Local d'abord — clés chiffrées AES-256-GCM sur votre machine.
  • Serveur MCP (104 outils), protocole A2A, mémoire persistante, garde-fous, mode distant, applications Desktop/Termux/PWA, 43 langues d'interface.

La compression est peut-être l'apport le plus concret

Si l'on retient un facteur de compression même modeste — disons 50 % sur des sessions d'agent réelles plutôt que les 89 % annoncés — cela double de fait le budget gratuit disponible, sans dépendre d'aucun fournisseur. C'est un levier plus fiable que l'empilement de clés, puisqu'il ne peut pas être retiré par un changement de politique tarifaire.

Ce chiffre de 15–95 % est en revanche une revendication du projet, non vérifiée de façon indépendante dans cette recherche.


Chapitre suivant : Listes de référence