Infraestrutura e MLOps

OmniRoute, de diegosouzapw, conecta 500 modelos em um gateway

Projeto criado em 2026-02-13 reúne 290+ provedores e oferece mais de 90 opções gratuitas em um único endpoint.

O OmniRoute é um gateway de inteligência artificial que conecta clientes como Claude Code, Codex, Cursor, OpenCode, Cline e Copilot a 290+ provedores e 500+ modelos. diegosouzapw criou o projeto em 2026-02-13, e o repositório já alcançou 39.752 estrelas no GitHub. A ferramenta atende quem precisa alternar entre Claude, GPT, Gemini, DeepSeek e outros modelos sem configurar cada cliente para um serviço diferente.

O gateway troca de provedor quando a cota acaba

O usuário envia a chamada para um endpoint do OmniRoute, que encaminha o pedido ao provedor escolhido. A rota pode apontar diretamente para serviços como OpenCode Free e Felo ou usar auto, modo que deixa o gateway selecionar uma opção disponível.

O modo auto acompanha as cotas e aciona fallback quando uma delas termina. Essa lógica evita que uma aplicação pare apenas porque um provedor atingiu o limite, mas não elimina a dependência das APIs externas que entregam os modelos.

O OmniRoute não executa Claude, GPT ou Gemini dentro do próprio gateway. A máquina do usuário roda a camada de acesso, enquanto os provedores externos fazem a inferência e devolvem as respostas.

O projeto também integra MCP e A2A, que permitem conectar ferramentas e agentes ao gateway. A descrição oficial cita compatibilidade com Kimi, Claude, GPT, OpenAI, Gemini, GLM, DeepSeek e MiniMax.

O README informa que o OmniRoute usa RTK+Caveman para comprimir tokens antes do envio. Segundo o projeto, a técnica reduz o consumo entre 15% e 95%, mas o material disponível não traz benchmark independente para confirmar esse intervalo.

O gateway ainda oferece Desktop/PWA e um painel de cotas gratuitas. Esse painel calcula cerca de 1,53B tokens por mês a partir de 43 pools de provedores e 516 modelos documentados.

A instalação não exige configuração, mas o projeto é recente

O README descreve o OmniRoute como zero-config e afirma que ele funciona logo após a instalação, sem chaves nem configuração inicial. O projeto distribui um pacote npm e uma imagem Docker, embora o material disponível não detalhe os comandos de instalação.

Na primeira execução, o usuário pode começar com auto ou escolher um backend gratuito específico. Quem preferir OpenCode Free pode usar uma rota oc/…; quem escolher Felo pode indicar felo/…, conforme os exemplos do README.

O catálogo de gratuidades passa por auditoria a cada duas semanas. O total pode cair quando um provedor encerra uma faixa gratuita ou subir quando outro serviço entra no catálogo.

O número de tokens gratuitos não representa crédito garantido para qualquer conta. Ele resume o que o catálogo documenta e calcula naquele momento, enquanto cada provedor mantém seus próprios limites e condições.

A velocidade de crescimento merece atenção. O repositório tem 172 dias de idade, soma 39.752 estrelas, registra 5.260 forks e mantém 672 issues abertas.

O último commit ocorreu em 2026-08-05. A versão mais recente é a v3.8.49, publicada em 2026-07-30.

As notas dessa versão listam 1.383 entradas no ciclo e mencionam 306 commits. Entre as mudanças aparecem suporte nativo a Agnes AI, o provedor gratuito Dahl, um catálogo de embeddings do OpenRouter e ajustes no pipeline SSE.

Esse volume mostra atividade intensa, não maturidade comprovada. A quantidade de issues abertas também indica que equipes com baixa tolerância a mudanças frequentes precisam testar o gateway antes de colocá-lo em fluxos críticos.

A licença MIT permite usar, alterar e redistribuir o código, inclusive em produtos comerciais. A ferramenta não serve, sem adaptação, para quem precisa manter a inferência exclusivamente em infraestrutura própria, porque seu desenho conecta o gateway a provedores externos.

Também não é uma escolha adequada para quem busca um catálogo estático de modelos. O projeto adiciona provedores, altera rotas e revisa as cotas com frequência.

Fontes

TypeScriptMITInfraestrutura e MLOpsTrendshift
Como fazemos: nossa equipe monitora diariamente os repositórios de código aberto em maior alta e produz esta cobertura com apoio de modelos de linguagem, sempre a partir de dados verificados na fonte primária — repositório, documentação oficial e ranking público. Os números de estrelas e a posição no ranking refletem o momento da coleta. Entenda o método.