OmniRoute : une passerelle IA gratuite pour le routage multi-fournisseurs
OmniRoute expose un point de terminaison compatible OpenAI pour plusieurs fournisseurs de modèles, avec un routage prenant en compte les quotas, un repli automatique et une compression de réponse facultative.
En bref
- De quoi s’agit-il ?
- Un projet TypeScript qui expose un point de terminaison compatible OpenAI à plus d'une centaine de fournisseurs, avec chaînes de repli, suivi de quota et support MCP/A2A.
- À qui s’adresse-t-il ?
- diegosouzapw/OmniRoute convient surtout aux équipes qui acceptent de lire ses contraintes et de tester l'interface annoncée dans leur propre contexte. Avant adoption, exécutez la commande ou le flux explicitement documenté dans le README, contrôlez la sortie attendue et vérifiez les limites de version, de plateforme et de licence mentionnées par le dépôt.
- Puis-je l’utiliser commercialement ?
- Oui. MIT est une licence permissive : vous pouvez utiliser, modifier et vendre un logiciel qui en dépend, à condition de conserver les mentions de droit d’auteur et de licence.
- Est-il encore maintenu ?
- Oui. Le dépôt a reçu de nouveaux commits au cours des dernières 24 heures.
- En quel langage est-il écrit ?
- Principalement TypeScript, d’après les statistiques de langage de GitHub.
Ces réponses reposent sur les données GitHub du projet (dernière synchronisation le 15 septembre 2026) et sur notre analyse. Elles ne constituent pas un avis juridique.
ANALYSE OPEN SOURCE APPROFONDIE
Un proxy universel pour les API IA
Le README commence par « Ne cessez jamais de coder. Routage intelligent vers des modèles IA GRATUITS et à faible coût avec repli automatique. » Il décrit OmniRoute comme un proxy API universel qui expose un point de terminaison unique, http://localhost:20128/v1, pour plus de 100 fournisseurs. Le projet est écrit en TypeScript et liste les complétions de chat, les intégrations, la génération d'images, la vidéo, la musique, l'audio, le re-ranking, la recherche web, le serveur MCP et le protocole A2A parmi ses capacités. La description des métadonnées du dépôt prétend 290+ fournisseurs et 500+ modèles, ce qui est supérieur au « 100+ » du README. Le README n'explique pas cette divergence.
Comment fonctionnent les niveaux de routage
Le README décrit un système de repli à quatre niveaux : d'abord l'abonnement, puis la clé API, puis le moins cher, puis le gratuit. Chaque niveau est vérifié pour le quota et le budget, et le routeur descend lorsqu'un niveau est épuisé. Le support multi-comptes avec round-robin est inclus. Le routage prend en charge 13 stratégies d'équilibrage, notamment la priorité, la pondération et l'optimisation des coûts. Le README mentionne également la sélection P2C consciente des quotas.
Couverture des fournisseurs et des modèles
Le README liste les intégrations avec Claude Code, Codex, Cursor, OpenCode, Cline, Copilot, et d'autres. Il prend en charge des fournisseurs gratuits comme Kiro, Qoder et Qwen, et payants comme GLM, MiniMax, DeepSeek. Le point de terminaison traduit entre les formats OpenAI, Claude et Gemini. Il expose également des points de terminaison pour les intégrations, les images, l'audio, la vidéo, la musique, la modération et le re-ranking. Le README dit 100+ fournisseurs mais ne donne ni liste exacte ni nombre.
Compression de contexte et contrôle des coûts
Le README décrit une fonctionnalité de compression proactive du contexte qui élague l'historique de conversation avant que la requête n'atteigne l'amont, avec des gardes d'intégrité structurelle pour maintenir la cohérence des paires tool_use et tool_result. Il mentionne également le rejet multi-couches des messages système et des messages réguliers. Les métadonnées du dépôt citent « la compression RTK+Caveman économise 15 à 95 % de tokens », mais ce terme et cette plage de pourcentage n'apparaissent pas dans le README. Le README ne quantifie pas les économies de tokens.
Support des protocoles MCP et A2A
OmniRoute inclut un serveur MCP (démarrage avec `omniroute --mcp`) qui expose des outils comme `omniroute_get_health` et `omniroute_list_combos`. Il fournit également un point de terminaison JSON-RPC A2A sur /a2a avec message/send et message/stream, ainsi que des API de cycle de vie des tâches. Le README décrit une interface de gestion pour MCP et A2A, y compris les permissions scopées, la journalisation d'audit et l'état de santé. Il mentionne aussi une carte d'agent à /.well-known/agent.json.
Options d'installation et de déploiement
Le README donne une commande d'installation npm globale : `npm install -g omniroute && omniroute`. Il couvre également Docker, les profils Docker Compose, un paquet Arch Linux AUR et un modèle Void Linux. Le port par défaut est 20128. Un mode port séparé peut distinguer l'API et le tableau de bord. Le README inclut des variables d'environnement pour les délais d'attente et une fonctionnalité Cloudflare Quick Tunnel. Le README dit que le tableau de bord s'ouvre sur http://localhost:20128.
Sécurité, observabilité et ce que la licence ne couvre pas
Le README liste la gestion des clés API, les permissions au niveau des modèles, la limitation de débit, le filtrage IP, la protection contre l'injection de prompt et le chiffrement AES-256-GCM pour les identifiants. Il décrit également un tableau de bord de journaux unifié avec les journaux de requête, proxy, audit et console, ainsi qu'un tableau de bord de santé avec latence p50/p95/p99. Le projet est sous licence MIT, qui accorde les droits d'utilisation, de copie, de modification, de fusion, de publication, de distribution, de sous-licence et de vente de copies, mais ne fournit aucune garantie ni responsabilité. Le texte de la licence ne commente pas la posture de sécurité, le support ou la préparation à la production.
Ce que le dépôt permet de vérifier · diegosouzapw omniroute
Pour examiner diegosouzapw/OmniRoute, le point de départ est le dépôt lui-même et ses fichiers nommés dans le README. diegosouzapw/OmniRoute apparaît dans le README avec cette description : OmniRoute exposes one OpenAI-compatible endpoint for multiple model providers, with quota-aware routing, automatic fallback, and optional response compression.. Le texte source cite aussi OmniRoute - The Free AI Gateway ~1.51B Free Tokens / Month > Stacking free tiers by hand is painful - dozens of SDKs, dozens of rate limits, and no idea how much you actually have. OmniRoute catalogs 445 free-tier entries across 39 recurring pool keys and computes the token headline from the 20 pools with a published positive monthly budget , deduplicated by shared pool. The result stays visible on the dashboard ( /dashboard/free-tiers ). > Animated summary of the live /dashboard/free-tiers page. Full methodo. Cette matière permet de situer le dépôt, mais elle ne constitue pas une mesure indépendante de performance. Une vérification utile consiste à reprendre l'entrée documentée par le projet, à observer sa sortie et à comparer cette sortie avec le comportement annoncé. Les commandes, options et chemins varient selon le dépôt ; il faut donc conserver les noms exacts comme `OmniRoute`, les scripts indiqués et les répertoires de configuration cités par les mainteneurs.
Conclusion éditoriale
diegosouzapw/OmniRoute convient surtout aux équipes qui acceptent de lire ses contraintes et de tester l'interface annoncée dans leur propre contexte. Avant adoption, exécutez la commande ou le flux explicitement documenté dans le README, contrôlez la sortie attendue et vérifiez les limites de version, de plateforme et de licence mentionnées par le dépôt.
Notes de la communauté