Aller au contenu

FreeLLMAPI

Dépôt : github.com/tashfeenahmed/freellmapi Site : freellmapi.co


Fiche d'identité

Créé le 21 avril 2026
Étoiles GitHub (3 août 2026) ~17 600
Dernier commit 2 août 2026
Fournisseurs annoncés 29
Familles de modèles 251
Endpoints modèle/fournisseur 358
Tokens gratuits annoncés ~4 milliards/mois
Modèle économique Gratuit + Premium (19 $/an ou 49 $ à vie)

Ce que fait le logiciel

Un serveur local, compatible OpenAI, à installer chez soi (Docker ou Node 20+, ~40 Mo de RAM au repos). Vous y ajoutez vos clés fournisseur, il route.

Fonctions principales, d'après la documentation du dépôt :

  • Routage et basculement — le routeur choisit le modèle disponible le plus prioritaire dont la clé est saine et sous ses limites ; sur un 429 ou un 5xx, il met la clé en refroidissement et passe au suivant.
  • Compteurs RPM/RPD/TPM/TPD par clé — le routeur apprend les plafonds annoncés par les fournisseurs pour rester dessous.
  • Chiffrement des clés — AES-256-GCM dans une base SQLite locale, déchiffrement en mémoire par requête. Vos applications ne voient qu'un jeton unifié.
  • Surfaces multiples — /v1 OpenAI, l'API Messages d'Anthropic, /v1beta natif Gemini pour Gemini CLI, et une émulation Ollama optionnelle.
  • Fusion — un prompt est envoyé à plusieurs modèles et les réponses sont synthétisées.
  • Média — /v1/images/generations et /v1/audio/speech.
  • Configuration automatique des clients — npx freellmapi setup-claude configure Claude Code, Codex CLI, Cline, Continue, Aider.
  • Serveur MCP sur /mcp et visionneuse OpenAPI sur /v1/docs.

Les fournisseurs

Le dépôt en nomme douze : Google, Groq, Cerebras, OpenCode Zen, Mistral, OpenRouter, Cloudflare, Cohere, Z.ai (Zhipu), NVIDIA, HuggingFace, ModelScope — puis indique « … and 17 more free providers ».

La liste complète n'est pas publique

Le README renvoie vers freellmapi.co/models pour « la liste complète, toujours à jour, avec les limites de débit, fenêtres de contexte et budgets de tokens gratuits par modèle ». Cette page charge son catalogue dynamiquement et n'a rien renvoyé d'exploitable lors de la consultation du 3 août 2026.

Il n'a donc pas été possible de vérifier la décomposition des ~4 milliards de tokens annoncés. Ce n'est pas une accusation : c'est un constat sur ce qui est vérifiable depuis l'extérieur.

Le code source du dépôt ne contient que 5 adaptateurs de fournisseurs spécifiques (aihorde, cloudflare, cohere, google, modelscope, pollinations) plus un adaptateur générique openai-compat — ce qui est cohérent avec une architecture où la plupart des fournisseurs sont pilotés par un catalogue de configuration plutôt que par du code dédié.


Le modèle économique

C'est le point qui distingue le plus FreeLLMAPI d'OmniRoute.

Le logiciel est libre, mais le catalogue de modèles à jour est le produit payant :

« Premium keeps that signed catalog live on every router you run. »

Sans abonnement, le routeur synchronise un catalogue signé depuis freellmapi.co ; avec abonnement (19 $/an ou 49 $ à vie), la synchronisation suit les changements de quotas et les nouveaux modèles en continu — annoncée comme deux fois par jour.

Le dépôt précise que le serveur de catalogue ne voit jamais vos prompts, complétions ou clés fournisseur.

Un raisonnement défendable

Le paysage change chaque semaine ; maintenir un catalogue exact est un travail réel. Facturer ce travail plutôt que l'inférence est cohérent. Mais cela signifie que la donnée la plus précieuse — le tableau détaillé fournisseur par fournisseur — n'est pas auditable publiquement, alors même qu'elle sert à justifier le chiffre affiché en tête du dépôt.


Les limites, telles que le projet les reconnaît

Le dépôt est explicite sur ce qu'empiler des tiers gratuits implique :

« no frontier models, variable latency, no SLA — and the effective intelligence of the endpoint dips late in the day as top models hit their daily caps, then resets at UTC midnight. »

Et, en tête de la section licence :

« This project is for personal experimentation and learning, not production. Free tiers exist so developers can prototype against them; they aren't a stable, supported inference substrate and shouldn't be treated as one. »

Le projet indique par ailleurs avoir passé en revue les conditions d'utilisation de chaque fournisseur en mai 2026, et rappelle que votre relation avec chaque fournisseur reste régie par les conditions acceptées à la création du compte.

À porter au crédit du projet

Cet avertissement est plus honnête que la majorité des projets du genre. L'observation sur la baisse d'intelligence en fin de journée — les meilleurs modèles épuisent leur quota quotidien en premier, le routeur bascule vers des modèles plus faibles jusqu'à minuit UTC — est une remarque fine, et probablement la limite pratique la plus importante de toute l'approche.


Chapitre suivant : OmniRoute