FreeLLMAPI¶
Dépôt : github.com/tashfeenahmed/freellmapi Site : freellmapi.co
Fiche d'identité¶
| Créé le | 21 avril 2026 |
| Étoiles GitHub (3 août 2026) | ~17 600 |
| Dernier commit | 2 août 2026 |
| Fournisseurs annoncés | 29 |
| Familles de modèles | 251 |
| Endpoints modèle/fournisseur | 358 |
| Tokens gratuits annoncés | ~4 milliards/mois |
| Modèle économique | Gratuit + Premium (19 $/an ou 49 $ à vie) |
Ce que fait le logiciel¶
Un serveur local, compatible OpenAI, à installer chez soi (Docker ou Node 20+, ~40 Mo de RAM au repos). Vous y ajoutez vos clés fournisseur, il route.
Fonctions principales, d'après la documentation du dépôt :
- Routage et basculement — le routeur choisit le modèle disponible le plus
prioritaire dont la clé est saine et sous ses limites ; sur un
429ou un5xx, il met la clé en refroidissement et passe au suivant. - Compteurs RPM/RPD/TPM/TPD par clé — le routeur apprend les plafonds annoncés par les fournisseurs pour rester dessous.
- Chiffrement des clés — AES-256-GCM dans une base SQLite locale, déchiffrement en mémoire par requête. Vos applications ne voient qu'un jeton unifié.
- Surfaces multiples —
/v1OpenAI, l'API Messages d'Anthropic,/v1betanatif Gemini pour Gemini CLI, et une émulation Ollama optionnelle. - Fusion — un prompt est envoyé à plusieurs modèles et les réponses sont synthétisées.
- Média —
/v1/images/generationset/v1/audio/speech. - Configuration automatique des clients —
npx freellmapi setup-claudeconfigure Claude Code, Codex CLI, Cline, Continue, Aider. - Serveur MCP sur
/mcpet visionneuse OpenAPI sur/v1/docs.
Les fournisseurs¶
Le dépôt en nomme douze : Google, Groq, Cerebras, OpenCode Zen, Mistral, OpenRouter, Cloudflare, Cohere, Z.ai (Zhipu), NVIDIA, HuggingFace, ModelScope — puis indique « … and 17 more free providers ».
La liste complète n'est pas publique
Le README renvoie vers freellmapi.co/models pour « la liste complète,
toujours à jour, avec les limites de débit, fenêtres de contexte et budgets
de tokens gratuits par modèle ». Cette page charge son catalogue
dynamiquement et n'a rien renvoyé d'exploitable lors de la consultation du
3 août 2026.
Il n'a donc pas été possible de vérifier la décomposition des ~4 milliards de tokens annoncés. Ce n'est pas une accusation : c'est un constat sur ce qui est vérifiable depuis l'extérieur.
Le code source du dépôt ne contient que 5 adaptateurs de fournisseurs
spécifiques (aihorde, cloudflare, cohere, google, modelscope,
pollinations) plus un adaptateur générique openai-compat — ce qui est
cohérent avec une architecture où la plupart des fournisseurs sont pilotés par
un catalogue de configuration plutôt que par du code dédié.
Le modèle économique¶
C'est le point qui distingue le plus FreeLLMAPI d'OmniRoute.
Le logiciel est libre, mais le catalogue de modèles à jour est le produit payant :
« Premium keeps that signed catalog live on every router you run. »
Sans abonnement, le routeur synchronise un catalogue signé depuis
freellmapi.co ; avec abonnement (19 $/an ou 49 $ à vie), la synchronisation
suit les changements de quotas et les nouveaux modèles en continu — annoncée
comme deux fois par jour.
Le dépôt précise que le serveur de catalogue ne voit jamais vos prompts, complétions ou clés fournisseur.
Un raisonnement défendable
Le paysage change chaque semaine ; maintenir un catalogue exact est un travail réel. Facturer ce travail plutôt que l'inférence est cohérent. Mais cela signifie que la donnée la plus précieuse — le tableau détaillé fournisseur par fournisseur — n'est pas auditable publiquement, alors même qu'elle sert à justifier le chiffre affiché en tête du dépôt.
Les limites, telles que le projet les reconnaît¶
Le dépôt est explicite sur ce qu'empiler des tiers gratuits implique :
« no frontier models, variable latency, no SLA — and the effective intelligence of the endpoint dips late in the day as top models hit their daily caps, then resets at UTC midnight. »
Et, en tête de la section licence :
« This project is for personal experimentation and learning, not production. Free tiers exist so developers can prototype against them; they aren't a stable, supported inference substrate and shouldn't be treated as one. »
Le projet indique par ailleurs avoir passé en revue les conditions d'utilisation de chaque fournisseur en mai 2026, et rappelle que votre relation avec chaque fournisseur reste régie par les conditions acceptées à la création du compte.
À porter au crédit du projet
Cet avertissement est plus honnête que la majorité des projets du genre. L'observation sur la baisse d'intelligence en fin de journée — les meilleurs modèles épuisent leur quota quotidien en premier, le routeur bascule vers des modèles plus faibles jusqu'à minuit UTC — est une remarque fine, et probablement la limite pratique la plus importante de toute l'approche.
Chapitre suivant : OmniRoute