Files
OmniRoute/docs/i18n/pt-BR
Diego Rodrigues de Sa e Souza c3e966eeb9 docs(changelog): reconcile the v3.8.51 living section — round 2 (2026-09-15) (#13731)
Second `npm run release:reconcile` pass on `release/v3.8.50..release/v3.8.51`
(091589089c..c0f92ec98a, 916 non-merge commits, 877 merged PRs):

- fold the 173 changelog.d fragments accumulated since #12971 under
  `## [3.8.51]` and delete them
- generate bullets for the 58 cycle commits that had no fragment
  (4 features / 42 fixes / 12 maintenance), each with the merged PR link and
  `— thanks @author`
- link 137 fragment bullets to the PR of the commit that added them and
  credit the author; two prefix/origin mismatches reviewed (#12945→#13392,
  #13001→#13379, both maintainer rebaselines of other people's PRs)
- refresh "Release by the numbers" + Top-25 and regenerate the
  `### 🙌 Contributors` hall (112 external contributors + maintainer; every
  non-bot author of the 877 merged PRs present)
- closed-PR credit audit for the window: nothing to add (#13215→#13361 and
  #13059→#13690 are still open, #12998 was independently fixed earlier by
  #12853); no human co-author trailers, no commits without a PR
- resync the 58 i18n CHANGELOG mirrors

Gates: check:changelog-integrity OK, check:docs-sync PASS.
2026-09-17 10:47:11 -03:00
..

README (Português (Brasil))

🌐 Languages: 🇺🇸 English · 🇪🇹 am · 🇸🇦 ar · 🇦🇿 az · 🇧🇬 bg · 🇧🇩 bn · 🇨🇿 cs · 🇩🇰 da · 🇩🇪 de · 🇬🇷 el · 🇪🇸 es · 🇪🇪 et · 🇮🇷 fa · 🇫🇮 fi · 🇫🇷 fr · 🇮🇪 ga · 🇮🇳 gu · 🇳🇬 ha · 🇮🇱 he · 🇮🇳 hi · 🇭🇷 hr · 🇭🇺 hu · 🇦🇲 hy · 🇮🇩 id · 🇳🇬 ig · 🇮🇹 it · 🇯🇵 ja · 🇬🇪 ka · 🇰🇭 km · 🇮🇳 kn · 🇰🇷 ko · 🇱🇹 lt · 🇱🇻 lv · 🇮🇳 ml · 🇮🇳 mr · 🇲🇾 ms · 🇲🇹 mt · 🇲🇲 my · 🇳🇵 ne · 🇳🇱 nl · 🇳🇴 no · 🇮🇳 or · 🇮🇳 pa · 🇵🇭 phi · 🇵🇱 pl · 🇵🇹 pt · 🇷🇴 ro · 🇷🇺 ru · 🇱🇰 si · 🇸🇰 sk · 🇸🇮 sl · 🇷🇸 sr · 🇸🇪 sv · 🇰🇪 sw · 🇮🇳 ta · 🇮🇳 te · 🇹🇭 th · 🇹🇷 tr · 🇺🇦 uk-UA · 🇵🇰 ur · 🇺🇿 uz · 🇻🇳 vi · 🇳🇬 yo · 🇨🇳 zh-CN · 🇹🇼 zh-TW


Painel do OmniRoute

🚀 OmniRoute — O Gateway de IA Gratuito

OmniRoute — Nunca pare de programar. Todas as ferramentas de IA → 359 provedores — mais de 150 gratuitos — por meio de um único endpoint. Claude Code, Codex, Cursor, Cline, Copilot e Antigravity conectados GRATUITAMENTE ao Claude / GPT / Gemini com fallback automático. A compressão combinada RTK + Caveman economiza de 15% a 95% dos tokens (média de ~89%) — nunca atinja os limites. 359 provedores de IA · mais de 150 níveis gratuitos · ~1,47 bi de tokens gratuitos/mês · 19 estratégias de roteamento · US$ 0 para começar.

💰 ~1,47 bi de tokens gratuitos/mês

Combinar níveis gratuitos manualmente é trabalhoso — dezenas de SDKs, dezenas de limites de taxa e nenhuma ideia de quanto você realmente tem disponível. O OmniRoute cataloga 452 entradas de níveis gratuitos distribuídas entre 34 chaves de pools recorrentes e calcula o total de tokens com base nos 16 pools que possuem um orçamento mensal positivo publicado, além de cinco limites da Groq por modelo, eliminando duplicidades por pool compartilhado. As cotas que só ficam disponíveis após uma verificação de identidade regional (atualmente: ModelScope) são exibidas separadamente, com mais ~6 mi condicionados à verificação de identidade regional, e nunca são somadas ao total principal. O resultado permanece visível no painel (/dashboard/free-tiers).

Cartão de orçamento dos níveis gratuitos do OmniRoute: ~1,47 bi de tokens gratuitos por mês de forma contínua, chegando a ~2,07 bi no primeiro mês com créditos de cadastro, provenientes de 34 chaves documentadas de pools recorrentes que abrangem 452 entradas catalogadas de níveis gratuitos por trás de um único endpoint. Cálculo transparente com eliminação de duplicidades por pool — cada pool compartilhado é contabilizado uma única vez, incluindo 16 pools recorrentes com um orçamento mensal positivo de tokens publicado, além de cinco limites da Groq por modelo; 13 provedores estão marcados como evitar no catálogo de riscos dos termos, para que você decida. A barra de orçamento inclui Mistral 1 bi, Nara 210 mi, LLM7 150 mi, Groq 30 mi (cinco limites por modelo) e pools menores, além de créditos de cadastro do primeiro mês e provedores permanentemente gratuitos sem limite de tokens, exibidos separadamente para que nunca inflem o total principal. Uso e saldo restante em tempo real em /dashboard/free-tiers.

Resumo animado da página /dashboard/free-tiers em tempo real. Metodologia completa (eliminação de duplicidades por pool, níveis de crédito, termos dos provedores): docs/reference/FREE_TIERS.md.

Esses números são auditados novamente a cada duas semanas com base no catálogo ativo e podem variar em ambas as direções — se um provedor encerra um nível gratuito, o número cai; se um novo é adicionado, ele sobe. Publicamos o que o catálogo realmente calcula, nunca um cenário otimista arredondado para cima.


Dê uma estrela ao repositório se o OMNIROUTE ajudou você a economizar dinheiro e facilitou seu trabalho.

Estrelas diegosouzapw%2FOmniRoute | Trendshift Posição no histórico de estrelas olud.ai

💬 Participe da comunidade

👋 Siga o mantenedor — receba primeiro as novidades sobre provedores, versões e dicas:

Siga Diego no LinkedIn Siga @diegosouzapw no GitHub

Discord Telegram WhatsApp Global WhatsApp Brasil Site

Dúvidas, dicas de provedores, roteiro e suporte → Discord · Telegram · WhatsApp 🌍 Global / 🇧🇷 Brasil / Portal


📈 O Gateway Continua Crescendo

v3.8.49 v3.8.50 v3.8.51+
🌐 Provedores 290 352 mais na fila
🧠 IDs únicos de modelos de chat 1185 1312
🖼️ Ponte de modalidades 🆕 visão + áudio + vídeo
📡 Catálogo gratuito do Radar 🆕 adesão opcional
⚖️ Agendamento com reconhecimento de cota 🆕 Quota-Share
📊 Telemetria de cotas 🆕 ao vivo

Roteiro — seguindo os trilhos rumo à v3.9.0 LTS


🧩 Disponível

versão no npm NPM mensal Docker Hub Licença: MIT Downloads do Docker Downloads do Electron

🚀 Comece 🚀 Início Rápido 📦 Instalação 🆓 Configuração Zero
💡 Aprenda 💥 A Promessa 🤔 Por Que o OmniRoute 🏆 O Que o Diferencia
⚙️ Recursos 🎯 Combos 🌐 Provedores 🔌 CLI e MCP
🗜️ Compressão 🖥️ Onde Ele Roda 🔒 Privado
👀 Veja 🎬 Em Ação Novidades 🤖 CLIs Compatíveis
💚 Apoie 💚 Apoiar / Doar 💬 Comunidade 💖 Patrocinadores
📦 Projeto 🛠️ Stack Tecnológica 📖 Documentação 👥 Colaboradores
🌐 Em 66 idiomas

Inglês (en) Português — Brasil (pt-BR) Português (pt) Espanhol (es) Francês (fr) Italiano (it) Alemão (de) Holandês (nl) Russo (ru) Ucraniano (uk-UA) Polonês (pl) Tcheco (cs) Eslovaco (sk) Romeno (ro) Húngaro (hu) Búlgaro (bg) Dinamarquês (da) Finlandês (fi) Norueguês (no) Sueco (sv) Chinês — Simplificado (zh-CN) Chinês — Tradicional (zh-TW) Japonês (ja) Coreano (ko) Tailandês (th) Vietnamita (vi) Indonésio (id) Malaio (ms) Filipino (phi) Hindi (hi) Guzerate (gu) Marata (mr) Tâmil (ta) Telugu (te) Bengali (bn) Urdu (ur) Persa (fa) Árabe (ar) Hebraico (he) Turco (tr) Azerbaijano (az) Suaíli (sw) Grego (el) Croata (hr) Sérvio (sr) Lituano (lt) Estoniano (et) Letão (lv) Esloveno (sl) Maltês (mt) Irlandês (ga) Canarês (kn) Malaiala (ml) Oriá (or) Punjabi (pa) Nepalês (ne) Cingalês (si) Birmanês (my) Khmer (km) Hauçá (ha) Iorubá (yo) Igbo (ig) Amárico (am) Uzbeque (uz) Georgiano (ka) Armênio (hy)


🆓 Funciona assim que você instala — sem chaves, sem configuração

Funciona assim que você instala — configuração zero. Três etapas: 1. Instale — npm i -g omniroute, o servidor inicia em localhost:20128. 2. Aponte sua ferramenta para http://localhost:20128/v1 — qualquer ferramenta compatível com OpenAI (Claude Code, Cursor, Cline). 3. Ele responde — chame o modelo auto para receber uma resposta instantânea, sem chave de API, sem cadastro e sem configuração. O provedor sem chave OpenCode Free vem pré-configurado na combinação auto, então uma instalação nova funciona imediatamente.
# Instalação nova, zero credenciais — `auto` já funciona:
curl http://localhost:20128/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{"model":"auto","messages":[{"role":"user","content":"Hello!"}]}'

Prefere um backend gratuito específico? Chame oc/… (OpenCode Free) diretamente. Depois, avance para auto e deixe o OmniRoute escolher.

📦 Scripts de início rápido para copiar e colar em Python, Node.js, PHP e cURLexamples/quickstart/


💥 A Promessa

A Promessa — um endpoint e 359 provedores. O fallback automático mantém o roteamento enquanto houver outro destino íntegro disponível. Seis pilares: fallback resiliente entre 359 provedores · até 95% de economia de tokens em cargas de trabalho elegíveis · custo inicial de $0 com mais de 150 níveis gratuitos e 53 provedores recorrentes/sem chave, gratuitos para sempre · 36 integrações com CLIs/agentes por meio de uma única configuração · compatibilidade com OpenAI, Claude, Gemini e Responses API em /v1 · controles de produção, incluindo circuit breakers, discrição de TLS, 110 ferramentas MCP, A2A, memória, guardrails, avaliações e mais de 39.000 declarações de testes estáticos em mais de 5.100 arquivos de teste rastreados.

🤔 Por que o OmniRoute?

Por que o OmniRoute — pare de lidar com 10 painéis, chaves de API inativas e cobranças inesperadas. Dez problemas diários e suas soluções: cota expirando sem uso → maximize as assinaturas; limites de taxa durante a programação → fallback automático em 4 níveis (Assinatura → API → Barato → Gratuito); saídas de ferramentas consumindo tokens → compressão RTK + Caveman (15–95%); APIs caras → roteamento otimizado por custo; cada ferramenta com sua própria configuração → um endpoint, um painel; IA bloqueada → proxy de 3 níveis + discrição de TLS; chaves inativas → resiliência em 3 camadas (circuit breakers, período de espera de chaves, bloqueio de modelo); equipe compartilhando uma assinatura → pools de chaves com cotas distribuídas de forma justa; prompts passando pela nuvem de terceiros → abordagem local-first com chaves criptografadas por AES-256-GCM; nenhuma visibilidade de gastos → análises em tempo real (uso, cota, economia, latência p95).
Fluxo de solicitações do OmniRoute: seu IDE ou CLI (Claude Code, Cursor, Cline…) chama um único endpoint local (http://localhost:20128/v1); o Roteador Inteligente OmniRoute (compressão RTK + Caveman, 19 estratégias de roteamento, circuit breakers, discrição de TLS, MCP, A2A, guardrails) pode recorrer ao fallback entre 4 níveis de provedores enquanto houver um destino elegível e íntegro — Nível 1 Assinatura, Nível 2 Chave de API, Nível 3 Barato e Nível 4 Gratuito.

🤝 Apoiado pelos nossos Amigos do Código Aberto

Kimi K3 — Inteligência de fronteira aberta · 2,8 trilhões de parâmetros · contexto de 1 milhão de tokens

Quer se juntar a nós como Amigo do Código Aberto? Estas são as empresas que apoiam o código aberto e ajudam a manter o OmniRoute avançando — e divulgamos publicamente para onde vai cada token que elas nos fornecem. Entre em contato: diegosouza.pw@outlook.com

Kimi (Moonshot AI)
Kimi
Moonshot AI

Amigo Fundador do Código Aberto
Agradecemos à Kimi (Moonshot AI), nossa Amiga Fundadora do Código Aberto, por apoiar este projeto! A Kimi é o laboratório de IA por trás das famílias de modelos de pesos abertos K2 e K3 — o Kimi K3 oferece uma janela de contexto de 1 milhão de tokens, visão nativa e programação em nível de fronteira por uma fração do preço dos modelos fechados, além de funcionar imediatamente com Claude Code, Codex e todas as ferramentas de programação atendidas pelo OmniRoute.

O que o apoio da Kimi viabiliza: os créditos da API da Kimi sustentam o pipeline de lançamentos do OmniRoute validado por IA — a etapa de validação de merge com tecnologia do Kimi K3, que analisa cada pull request antes do lançamento — além do desenvolvimento diário de funcionalidades. O suporte de primeira classe à Kimi está disponível pelos dois meios: a API da Kimi direta (kimi-k3) e o plano de programação Kimi Code (OAuth e chave de API). O OmniRoute também é o primeiro projeto brasileiro de código aberto no programa de apoio da Kimi. Obtenha uma chave de API da Kimi com 15% de créditos extras →
Cheaper Inference
Cheaper Inference
cheaperinference.com

Amigo do Código Aberto
Agradecemos à Cheaper Inference, uma Amiga do Código Aberto do OmniRoute, por apoiar este projeto! A Cheaper Inference é um gateway classificado por custo que revende 42 modelos de fronteira — Claude, GPT-5.x, Gemini, Kimi K3, GLM, DeepSeek, Grok e MiniMax — por meio de um único endpoint compatível com a OpenAI, encaminhando cada solicitação para o provedor elegível mais barato sem jamais cobrar acima do preço de tabela do criador do modelo.

Suporte de primeira classe no OmniRoute: Chat Completions, o endpoint nativo /v1/responses, visão, chamada de ferramentas e 3 modelos de imagem (grok-imagine, nano-banana-pro, nano-banana-2, acessíveis como cheaperinference/<model>). Obtenha uma chave de API →

Os links marcados com aff=omniroute são links de parceiros. Eles ajudam a financiar o projeto sem nenhum custo adicional para você.


🎟️ Promoções de Afiliados — cupons gratuitos de cadastro de provedores que não nos patrocinam (clique para expandir)

Esta seção destina-se apenas a códigos de indicação/cupons. As parcerias patrocinadas ficam em 🤝 Apoiado pelos nossos Amigos do Código Aberto acima. O OmniRoute não possui patrocínio nem parceria com os provedores listados aqui — estes são cupons públicos que qualquer pessoa pode usar.

AgentRouter
AgentRouter
agentrouter.org
AgentRouter — cadastro de afiliado · US$ 100 em créditos gratuitos ao se cadastrar (servidor gratuito, portanto espere maior latência — mais indicado para testes, não para produção). Suporte de primeira classe no OmniRoute desde a v3.8.50: Chat Completions, o formato de comunicação compatível com a Anthropic e o caminho compatível com a OpenAI. Os modelos disponíveis incluem claude-opus-4-8, claude-opus-5, gpt-5.6-sol e outros. Resgate seus US$ 100 →

⚠️ Link de afiliado — o OmniRoute não possui patrocínio nem parceria com este provedor.

Conhece outro provedor com um cupom generoso de cadastro gratuito que beneficie os usuários do OmniRoute? Abra uma issue e nós o adicionaremos aqui.


🎯 Combos — O carro-chefe

Todas as 19 estratégias de roteamento de combos animadas — um bloco por estratégia: priority, fill-first, weighted, round-robin, p2c, least-used, random, strict-random, cost-optimized, headroom, reset-window, reset-aware, context-relay, context-optimized, cache-optimized, lkgp, auto, fusion, pipeline. Consulte a tabela acima para saber o que cada uma faz.

Um combo é uma cadeia de modelos entre os quais o OmniRoute roteia automaticamente. Se a cota se esgotar, um provedor falhar ou os custos dispararem, o combo poderá avançar para o próximo modelo íntegro e elegível. 🛡️

Configuração zero — basta usar auto

Não é necessário criar um combo. Defina seu modelo como auto (ou uma variante), e o OmniRoute criará um combo virtual com base nos provedores conectados, pontuados em tempo real:

ID do modeloO que ele otimiza
auto🎯 Padrão equilibrado (LKGP — mantém seu último provedor que funcionou bem)
auto/coding🧑💻 Pesos com prioridade para qualidade na geração de código
auto/fast Menor latência primeiro
auto/cheap💰 Menor custo por token primeiro
auto/offline🔋 Maior folga de cota/limite de requisições primeiro
auto/smart🔭 Prioridade para qualidade + 10% de exploração para descobrir modelos melhores
auto/lkgp📌 Afinidade explícita com o último provedor que funcionou bem
auto/chaos🧪 Pesos de injeção de falhas para testes de resiliência (engenharia do caos)

🔀 Ou crie o seu próprio — 19 estratégias de roteamento

Todas as 19 estratégias — combine-as livremente em cada etapa do combo:

# Estratégia O que ela faz
1 priority Lista ordenada pelo primeiro destino — esgota cada um antes de passar ao próximo 🥇
2 fill-first Usa toda a cota de cada destino antes de avançar
3 weighted Seleção aleatória ponderada pelo peso de cada destino
4 round-robin Percorre os destinos em ordem, de forma cíclica
5 p2c Balanceamento de carga aleatório por escolha entre duas opções
6 least-used Seleciona o destino com a menor carga atual
7 random Seleção aleatória uniforme (sem duplicatas)
8 strict-random Seleção aleatória sem remover repetições 🎲
9 cost-optimized Minimiza o custo em $ por requisição com base nos preços do catálogo em tempo real 💸
10 headroom Seleciona o destino com a maior cota restante
11 reset-window Prefere o destino cuja janela de cota será redefinida mais cedo
12 reset-aware Classifica pelo tempo de redefinição da cota — janelas mais curtas primeiro 📊
13 context-relay Transfere o contexto entre destinos em conversas longas 🧠
14 context-optimized Seleciona a melhor opção para o tamanho atual do contexto
15 cache-optimized Fixa cada prefixo reutilizável do prompt na mesma conta — maximiza os acertos do cache de prompts 🎯
16 lkgp Caminho que funcionou bem por último — fixa no último provedor bem-sucedido e depois recorre às regras
17 auto Pontuação em tempo real com 16 fatores para todas as conexões 🤖
18 fusion Distribui a solicitação para um painel de modelos, e um modelo avaliador sintetiza uma única resposta 🧬
19 pipeline Encadeia etapas — a saída de cada destino alimenta o próximo 🔗

O mecanismo Auto-Combo pontua cada candidato com base em 16 fatores (integridade, cota, custo, latência, adequação à tarefa, qualidade, disponibilidade da sessão…) — consulte docs/routing/AUTO-COMBO.md.

🧱 A resiliência é integrada (3 camadas independentes)

Resiliência do OmniRoute — 3 camadas independentes de autorrecuperação, a camada certa para a falha certa. Camada 1: disjuntor do provedor (provedor inteiro): é acionado somente em 408/5xx, limites OAuth 8× / chave de API 12× / local 2×, é redefinido após 60s/30s/15s para uma sondagem HALF-OPEN, recuperação sob demanda; enquanto estiver OPEN, o combo redireciona para o próximo provedor. Camada 2: tempo de espera da conexão (uma chave/conta): base de 5s para OAuth / 3s para chave de API, recuo exponencial de ×2 com proteção contra efeito manada, 429 respeita Retry-After, uma resposta bem-sucedida limpa todo o estado de erro; uma chave em tempo de espera é ignorada enquanto as chaves relacionadas continuam atendendo. Camada 3: bloqueio de modelo (um modelo): 429 por modelo, 404 local ou recusas de modo bloqueiam apenas esse modelo — nunca a conexão inteira. Estados terminais (banido, expirado, créditos esgotados) são responsabilidade do operador, não tempos de espera.

📖 Mecanismo de Combo Automático · Guia de Resiliência


🏆 O que diferencia o OmniRoute

O que diferencia o OmniRoute — um comparativo pontual de recursos com 9router, OpenRouter, CLIProxyAPI e LiteLLM em 13 capacidades. OmniRoute: 359 provedores, mais de 150 níveis gratuitos integrados, 19 estratégias de roteamento, compressão de tokens com 12 mecanismos, servidor MCP integrado com 110 ferramentas, protocolo de agentes A2A, memória persistente, proteções, agentes na nuvem, discrição por impressão digital TLS, Desktop/Termux/PWA e interface em 42 localidades. O OmniRoute tem licença MIT e pode ser auto-hospedado. As capacidades e contagens dos concorrentes podem mudar; consulte a metodologia no link.

📊 Metodologia completa e detalhes por recurso em comparação com 9router, OpenRouter, CLIProxyAPI e LiteLLM → docs/comparison/OMNIROUTE_VS_ALTERNATIVES.md


💚 Apoie o OmniRoute

O OmniRoute tem licença MIT e é mantido de forma aberta. Se ele poupa seu tempo ou dinheiro, veja como ajudar a mantê-lo independente — escolha a opção que mais combina com você. O patrocínio nunca afeta a prioridade de roteamento; ele oferece visibilidade, não posição no ranking.

Dê uma estrela ao repositórioGrátis — ajuda genuinamente na visibilidadeDê uma estrela ao OmniRoute
🐙 GitHub SponsorsContribuição única ou mensal · taxa zero da plataformagithub.com/sponsors/diegosouzapw
Ko-fiContribuição única e rápida, sem cadastro para o doadorko-fi.com/diegosouzapw
🧋 Buy Me a CoffeePequeno gesto informalbuymeacoffee.com/diegosouzapw
🖐 LiberapayRecorrente · sem fins lucrativos · código abertoliberapay.com/diegosouzapw
🇧🇷 PIX (Brasil)Instantâneo, sem taxaschave e QR abaixo
CriptomoedasBTC · ETH · USDT-TRC20 · USDC-Solanaendereços abaixo

🇧🇷 PIX — instantâneo, sem taxas (Brasil)

Código QR PIX do OmniRoute

Chave (aleatória): 5d865059-bc44-483a-962d-43ceb80126eb

Pix copia e cola:

00020101021126580014br.gov.bcb.pix01365d865059-bc44-483a-962d-43ceb80126eb5204000053039865802BR5922OMNIROUTE CONTRIBUICAO6006BRASIL62070503***630475DD

₿ Criptomoedas — BTC · ETH · USDT-TRC20 · USDC-Solana (clique para expandir)
₿ BTCBitcoin (SegWit)bc1qh00smz004sy85wyl28v77tenkt3ckl6eaep7fd
Ξ ETHEthereum (ERC20)0x64Cf6B68A6Ff34288e89172950a2d00102337a84
₮ USDTTron (TRC20)TKAF41JpuQrHbKTnsQa9svJE2T192Hvsc2
$ USDCSolana2emNNZzVVWQc3FQ2wk9M6qXUQmW8AKdjjL174fXR28Tu

⚠️ Envie cada moeda somente pela rede indicada — o envio pela rede errada pode resultar na perda dos fundos.

🐛 Encontrou um bug ou tem algum comentário? Abra uma Discussão.


Notas para desenvolvedores: O projeto pode gerar um arquivo local .env durante a instalação ou o postinstall do npm para facilitar o trabalho dos desenvolvedores. Esse arquivo é intencionalmente ignorado por meio do .gitignore (consulte .gitignore) e nunca deve ser commitado — se for commitado acidentalmente, substitua todos os segredos expostos e remova o arquivo do histórico. Consulte docs/DEVELOPER-ENVIRONMENT.md para obter orientações sobre como gerenciar arquivos de ambiente locais e segredos.

📡 Radar do OmniRoute

O principal destaque do nível gratuito continua sendo ~1,47 bilhão de tokens/mês, com base no catálogo documentado acima e desduplicado por pool. Créditos temporários de cadastro oferecidos pelos provedores podem elevar separadamente o primeiro mês para ~2,07 bilhões. O Radar é uma sobreposição opcional e assinada do catálogo para quem deseja informações mais atualizadas sobre a disponibilidade de modelos gratuitos entre os lançamentos do OmniRoute; o catálogo da comunidade e todos os recursos gratuitos existentes continuam gratuitos.

Os apoiadores podem receber o catálogo em tempo real e oportunidades adicionais de provedores. Seu limite separado e variável é de aproximadamente 3 bilhões de tokens/mês, no máximo, dependendo da disponibilidade dos provedores. Esse limite não é uma garantia: os provedores podem alterar cotas, critérios de elegibilidade, modelos ou regiões a qualquer momento.

O Radar é opcional e usa somente solicitações GET. O cliente do OmniRoute não envia prompts, tráfego, configurações de provedores, telemetria de uso nem o estado local de dispensa de anúncios. Saiba mais sobre os critérios de elegibilidade e o catálogo atual em radar.omniroute.online/planos.


Novidades

Destaques recentes da v3.8.20 → v3.8.50. Histórico completo em CHANGELOG.md.

  • 🎛️ OmniConductor — delegação A2A de entrada para sua frota de agentes, habilidades do Conductor no Agent Card e um painel no dashboard com chat por voz push-to-talk do Faro. → Servidor A2A
  • 🛂 Admissão adaptativa e proteção contra sobrecarga — solicitações pesadas de chat entram na fila em vez de retornarem 503, com concessões móveis atômicas de RPM por conexão. → Guia de resiliência
  • 🗂️ Ordenação canônica de /v1/models — um bloco contíguo agrupado por provedor para cada provedor (combos fixados primeiro), estável em todas as fontes do catálogo. → Referência da API
  • 🗜️ Reforço da compressão — proteção contra inflação ativada por padrão, pacotes Caveman para DE / FR / JA + chinês (wényán), filtros RTK para Gradle e .NET. → Compressão
  • 💸 Custo fixo realista — provedores de assinatura / planos de programação aparecem com custo de $0 nas análises; orçamento, cota e roteamento continuam fazendo estimativas. → Referência da API
  • ⚖️ Roteamento Quota-Share — distribui de forma justa a cota de uma conta compartilhada entre chaves agrupadas, preservando o trabalho para que parcelas ociosas sejam emprestadas. → Guia de resiliência
  • 🤖 Configuração de CLI/agente com um único comando — 13 comandos setup-* registrados; omniroute run inicia 7 CLIs (Claude Code, Codex, Aider, Goose, OpenCode, Qwen Code, Gemini CLI); omniroute configure oferece suporte a 10 destinos, com um seletor interativo de provedor+modelo e favoritos por contexto. → Integrações de CLI
  • 🛰️ Modo remoto — controle uma instância remota do OmniRoute com tokens de escopo limitado (connect / contexts / tokens) + um auxiliar OAuth antigravity para instalações em VPS. → Modo remoto
  • 🧭 Roteamento automático mais inteligente — combos auto/<category>:<tier>, Fusion (painel de modelos + avaliador), roteamento sensível à tarefa, substituições por solicitação de modelo / modo / orçamento em USD. → Auto-Combo
  • 🗜️ Compressão plugável — 12 mecanismos combináveis + Compression Studios: LLMLingua-2, Ultra de dois níveis, omniglyph, controle de fidelidade por etapa, GCF v3.2, editor com reordenação por arrastar. → Compressão
  • 🕵️ Descriptografia MITM transparente (TPROXY) — capture CLIs que ignoram variáveis de ambiente de proxy, com uma CA por SNI + instalador de armazenamento de confiança. → MITM/TPROXY
  • 💸 Telemetria de custos em toda parte — cabeçalhos de custo/uso X-OmniRoute-* em todos os endpoints, cabeçalho de economia por cache HIT, cotas de gastos em USD por chave. → Referência da API
  • 🧠 Memória sob seu controle — desativada por padrão, quantização vetorial int8 opcional + decaimento tipado, x-omniroute-no-memory por solicitação. → Memória
  • 🛡️ Segurança — proteção contra injeção de prompt em todas as rotas LLM (suíte de red team), mecanismo opcional de mascaramento de credenciais (remove chaves de API/segredos vazados em ambas as direções), pesquisa web gratuita no DuckDuckGo como último recurso e uma barreira opcional de login OIDC para o dashboard (o login por senha permanece sempre disponível). → Proteções
  • 🖼️ Novos endpoints/v1/ocr (Mistral OCR) e /v1/audio/translations (no estilo Whisper) completam a cobertura de mídia. → Referência da API
  • 🎨 Geração de imagens / vídeos / áudio — uma API para mídia: xAI Grok Imagine e vídeos da Novita AI, ComfyUI, Magnific, Adobe Firefly, Segmind e provedores de voz como ElevenLabs. → Referência da API
  • 🌍 Implantação e operaçõesbasePath de proxy reverso, detecção automática do idioma do navegador, rastreamento de dispositivos por chave, confiança MITM sem acesso root, localização zh-TW. → Ambiente
  • 🤝 Mais provedores e agentes — agentes na nuvem (Codex Cloud, Cursor, Devin, Jules), Grok Build (xAI) com navegador + login OAuth, card dedicado do Ollama, Claude Opus 5 e Sonnet 5, parceria oficial com a Kimi (Code/Web/Moonshot), Zed, Requesty, SenseNova, Yuanbao, Agnes AI… e um catálogo atualizado com 352 provedores. → Provedores
  • 📡 Transparência de roteamento — cada resposta inclui um cabeçalho X-OmniRoute-Decision que identifica a estratégia/provedor/latência que a atendeu; uma nova estratégia de combo cache-optimized + o fator cacheAffinity do Auto-Combo encaminham solicitações repetidas de volta à conexão que mantém o prefixo em cache; e um endpoint somente leitura /v1/auto-combo/{channel}/candidates expõe o conjunto de candidatos em tempo real de um canal auto/*. → Auto-Combo
  • Desempenho local e infraestrutura — Redis local com um clique, implantadores de relay para Cloudflare Workers / Deno Deploy, Bifrost e Mux como serviços incorporados supervisionados. → Serviços incorporados
  • 🧩 Também incluído — framework de plugins + marketplace, frameworks de habilidades Omni/Agent/GitHub, integração com cofres do Obsidian (22 ferramentas MCP), APIs Batch e Files compatíveis com OpenAI, cache semântico de respostas, gamificação com placares de líderes, descoberta de agentes ACP (15 agentes integrados), exportação agendada de logs para o BigQuery, injeção de falhas auto/chaos, uma ponte para bots do Telegram, um gerenciador de versões no aplicativo e rankings de provedores gratuitos do LMArena-ELO. → Documentação

🤖 CLIs e agentes de programação compatíveis

Uma única configuração — http://localhost:20128/v1 — e todos os IDEs de IA ou CLIs funcionam com modelos gratuitos e de baixo custo.

Claude Code
Claude Code
                           
Codex CLI
Codex CLI
                           
Cline
Cline
                           
Kilo Code
Kilo Code
Zoo Code
Zoo Code
Continue
Continue
                           
Aider
Aider
                           
ForgeCode
ForgeCode
                           
jcode
jcode
                           
DeepSeek TUI
DeepSeek TUI
                           
CodeWhale
CodeWhale
                           
OpenCode
OpenCode
                           
Factory Droid
Factory Droid
                           
GitHub Copilot CLI
Copilot CLI
                           
Cursor CLI
Cursor CLI
                           
Smelt
Smelt
                           
Pi (pi-coding-agent)
Pi
                           
Grok Build (xAI)
Grok Build
                           
Hermes Agent (Nous Research)
Hermes Agent
                           
OpenClaw
OpenClaw
                           
Goose
Goose
                           
Open Interpreter
Open Interpreter
                           
Warp AI
Warp AI
                           
Agent Deck
Agent Deck
                           
também funciona com · Kiro · Command Code · Antigravity · Windsurf · AMP · qualquer ferramenta compatível com a OpenAI

📖 Configuração individual para todas as 36 ferramentas (26 CLIs de código + 10 agentes de CLI) → docs/reference/CLI-TOOLS.md · 🧩 Plugin do OpenCode → @omniroute/opencode-provider


Inicie qualquer CLI compatível por meio do OmniRoute com um único comando — nenhum arquivo de configuração é gravado, as credenciais são injetadas por processo, e Qwen/Gemini recebem um diretório inicial isolado e descartável:

omniroute run claude   --model openai/gpt-5.4          # Claude Code
omniroute run codex    --model glm/glm-5.2             # OpenAI Codex CLI
omniroute run aider    --model glm/glm-5.2 -- --message "reply OK"
omniroute run goose    --model glm/glm-5.2
omniroute run opencode --model glm/glm-5.2 -- run "reply OK"
omniroute run qwen     --model glm/glm-5.2 -- -p "reply OK"
omniroute run gemini   --model glm/glm-5.2 -- --skip-trust -p "reply OK"

# Ou escolha o provedor+modelo interativamente e grave a configuração da própria ferramenta:
omniroute configure codex          # também: claude opencode qwen aider goose gemini cline continue kilo

Todos os comandos respeitam o contexto remoto ativo (omniroute connect <host>), --dry-run exibe uma prévia exata das variáveis de ambiente e dos argumentos sem executar nada, e --api-key-env NAME mantém os segredos fora do histórico do seu shell. → Integrações de CLI


🌐 352 provedores de IA — 152 marcados no catálogo como gratuitos

352 provedores registrados nas coleções canônicas de chat, mídia, pesquisa, execução local, agentes de nuvem e sistema, incluindo 152 com metadados de descoberta hasFree: true. O registro de modelos de chat abrange 229 provedores / 2.554 pares distintos de provedor-modelo / 1.283 IDs brutos de modelos; o catálogo separado de franquias gratuitas tem 443 registros por modelo, 34 pools recorrentes e 53 provedores gratuitos para sempre, recorrentes/sem chave. Esses denominadores são diferentes intencionalmente; as definições e os cálculos com pools desduplicados estão na Referência de Provedores e em Planos Gratuitos.

🏢 Todos os principais laboratórios — por meio de um único endpoint

OpenAI
OpenAI
                           
Anthropic
Anthropic
                           
Gemini
Gemini
                           
xAI Grok
xAI Grok
                           
DeepSeek
DeepSeek
                           
Mistral
Mistral
                           
Qwen
Qwen
                           
Meta Llama
Meta Llama
                           
Groq
Groq
                           
NVIDIA
NVIDIA
                           
MiniMax
MiniMax
                           
Cohere
Cohere
                           
Perplexity
Perplexity
                           
Hugging Face
HuggingFace
                           
Together
Together
                           
Fireworks
Fireworks
                           
Cloudflare
Cloudflare
                           
Baidu
Baidu
                           

…e mais de 330 — todos os ícones são carregados em tempo real a partir do catálogo de provedores do painel. 📖 Referência de Provedores


🆓 Grátis para sempre — US$ 0, sem cartão

OpenCode Zen
OpenCode Zen
DeepSeek V4, Nemotron 3
Sem limite de tokens
Kilo Code
Kilo Code
Roteador automático, Tencent Hy3
Grátis para sempre
Requesty
Requesty
GPT-OSS 120B, Nemotron
Grátis para sempre
SiliconFlow
SiliconFlow
DeepSeek V3.2 / R1
Plano gratuito
Z.AI GLM
Z.AI GLM
GLM-4.7 / 4.5-Flash
Grátis para sempre
Baidu ERNIE
Baidu ERNIE
ERNIE 4.0
Grátis para sempre
Qoder AI
Qoder AI
Qwen3-Max, Kimi-K2
GRÁTIS e ilimitado
Pollinations
Pollinations
GPT, Llama, Claude
Nenhuma chave necessária
Cloudflare AI
Cloudflare AI
Mais de 50 modelos
10 mil neurônios/dia
NVIDIA NIM
NVIDIA NIM
GLM, MiniMax
~40 RPM grátis
Cerebras
Cerebras
GLM 4.7, GPT-OSS
1 milhão de tokens/dia
OpenRouter
OpenRouter
Modelos :free
+$10 → RPM mais alto

📖 Catálogo completo legível por máquina → docs/reference/PROVIDER_REFERENCE.md


🖥️ Onde o OmniRoute roda — em qualquer lugar

O mesmo aplicativo, sua máquina, suas regras. De uma instalação global via npm até seu celular via Termux.

PlataformaInstalaçãoDestaques
📦 npm (global)npm install -g omnirouteUm comando, qualquer sistema operacional
🐳 Dockerdocker run … diegosouzapw/omnirouteMultiarquitetura AMD64 + ARM64
🖥️ Desktop (Electron)npm run electron:buildJanela nativa + bandeja do sistema — Windows / macOS / Linux
🎩 Barra de menus (OmniRouteTray)brew install --cask zoispag/tap/omniroute-traySupervisiona e atualiza automaticamente o servidor — macOS
💪 ARMnativo em arm64Raspberry Pi, servidores ARM, Apple Silicon
📱 Android (Termux)pkg install nodejs && npx -y omnirouteRoda no seu celular, 24 horas por dia, 7 dias por semana, sem root
📲 PWA"Adicionar à tela inicial"Tela cheia, offline e instalável pelo navegador
🧩 Plugin do OpenCode@omniroute/opencode-providerIntegração nativa com o OpenCode
🤖 VS Code Copilot Chatinstale a extensão OmniCopilotTodos os modelos do OmniRoute no seletor nativo do Copilot Chat — versões estável e Insiders
🛠️ A partir do código-fontenpm install && npm run devModifique e contribua

📖 Guia do Docker · Desktop · Barra de menus · Termux · PWA · OpenCode


🧩 Novo: OmniRoute dentro do Copilot Chat nativo do VS Code

Sem uma nova barra lateral, sem uma nova interface de chat — todos os modelos disponibilizados pelo OmniRoute aparecem diretamente no seletor de modelos do Copilot Chat que você já usa. Desde o VS Code 1.122, os modelos de provedores funcionam sem login no GitHub nem assinatura do Copilot — modo agente, chamadas de ferramentas e visão, tudo gratuitamente.

Instale a extensão OmniCopilot, aponte-a para seu servidor OmniRoute (o padrão é localhost:20128) e abra Copilot Chat → seletor de modelos → Gerenciar modelos…OmniRoute.

LojaLinkCompatível com
🧩 VS Code MarketplaceInstalar →VS Code — versões estável e Insiders
🔓 Open VSX RegistryInstalar →Cursor, Windsurf, VSCodium, Theia, code-server, Gitpod, Antigravity, Kiro…

Dentro do editor: abra a visualização Extensões, pesquise por "OmniRoute" e clique em Instalar — funciona da mesma maneira nas duas lojas. O código-fonte, as issues e o guia do processo de publicação estão em diegosouzapw/OmniCopilot.

📖 Guia do VS Code Copilot Chat — configuração, o que o seletor exibe, painel em uma aba e solução de problemas


🎩 Novo: OmniRouteTray — seu gateway na barra de menus

omniroute serve funciona melhor quando está sempre ativo. O OmniRouteTray transforma isso em um aplicativo para a barra de menus do macOS que você configura e esquece: ele inicia o servidor, mantém o serviço ativo após reinicializações, atualiza-o no próprio local e deixa seu orçamento de tokens em tempo real a apenas um clique — sem deixar uma janela do terminal aberta e sem precisar cuidar de npm install -g omniroute.

Desenvolvido com Tauri v2 (um núcleo em Rust minúsculo), ele inclui seu próprio runtime assinado do Node 24 e gerencia uma instalação do OmniRoute pertencente ao aplicativo, portanto nunca entra em conflito com seu node/bun global. Ele compartilha sua configuração e seu banco de dados existentes em ~/.omniroute/ — portanto, é o mesmo OmniRoute que você já executa, só que de chapéu. 🎩

O que ele fazComo
🟢 Supervisiona o servidorInicia omniroute serve e adota uma instância já em execução em vez de duplicá-la
📊 Uso em tempo real de relanceBarras de cota dos provedores, limites de sessão/semanais do Claude com contagens regressivas para redefinição e detalhamento de custos dos últimos 30 dias
🔄 Atualiza-se automaticamente no próprio localInstalação em etapas, substituição atômica e reversão em caso de falha — sempre na versão mais recente
🚀 Inicia ao fazer loginInicialização opcional ao fazer login; somente na barra de menus, sem ícone no Dock
🩺 Diagnóstico e logsDiagnósticos com um clique e acesso aos logs do servidor
brew install --cask zoispag/tap/omniroute-tray

Prefere baixar? Obtenha o .dmg mais recente em Releases. O código-fonte, as issues e a documentação de compilação estão disponíveis em zoispag/omniroute-tray.
💛 Um projeto da comunidade criado por @zoispag — não é uma versão oficial do OmniRoute.


🔒 Privado e local-first

Privado e local-first — o gateway e o plano de controle do OmniRoute são executados na sua máquina. Os prompts são enviados ao provedor upstream selecionado para cada solicitação; o OmniRoute não adiciona nenhuma etapa hospedada de processamento de prompts, e a telemetria é desativada por padrão. As credenciais são criptografadas em repouso com AES-256-GCM; os controles incluem escopo de chaves de API, filtragem de IP, limites de taxa, proteções contra injeção de prompt, remoção de cabeçalhos upstream, redação opcional de PII, erros sanitizados e uma trilha de auditoria local no SQLite. O OmniRoute é licenciado sob a licença MIT e pode ser auto-hospedado.

📖 Autorização · Proteções · Conformidade


🔌 CLI completa + A2A e MCP

Além do servidor, o OmniRoute é um cockpit completo de linha de comando com mais de 80 comandos, além de protocolos abertos para agentes, permitindo que um agente de IA o opere por conta própria.

⌨️ Uma CLI de verdade (não apenas start)

omniroute               # inicia o gateway + painel (porta 20128)
omniroute chat          # cliente de chat TUI interativo (barra: /model /combo /skill /memory)
omniroute setup         # assistente guiado para a primeira execução
omniroute doctor        # diagnostica provedores, portas e dependências nativas

🛰️ Modo remoto — execute a CLI aqui e o OmniRoute em uma VPS

OmniRoute em um servidor? Controle-o pelo seu laptop com a mesma CLI. Faça login uma vez com um token de acesso com escopo; depois disso, todos os comandos terão como destino a instância remota.

omniroute connect 192.168.0.15            # senha → token com escopo, salvo como um contexto
omniroute models list                     # ← executado no servidor REMOTO
omniroute configure codex                 # ← seleciona um modelo remoto e grava um perfil local do Codex
omniroute tokens create --name ci --scope read   # gera tokens mais restritos para outras máquinas
omniroute contexts use default            # ← volta para o servidor local

Os tokens têm os escopos read / write / admin; as rotas que iniciam processos continuam restritas ao loopback. 📖 Modo remoto

Demonstração animada no terminal da CLI do OmniRoute — omniroute providers list, omniroute combo list e omniroute health — percorrendo os 86 comandos de nível superior disponíveis: providers · oauth · keys · combo · nodes · models · cache · compression · cost · usage · quota · health · resilience · telemetry · logs · audit · mcp · a2a · cloud · memory · skills · eval · tunnel · backup · sync · webhooks · policy · pricing · translator · simulate …

🤝 Conecte um agente — e ele controlará o próprio OmniRoute

Exponha o OmniRoute por MCP, A2A, uma API REST, webhooks ou uma CLI remota — qualquer agente compatível (ou seu próprio código) recebe as chaves para controlar todo o gateway: roteamento, provedores, combos, cache, compressão e memória — de forma autônoma. Os endpoints HTTP abaixo são disponibilizados em http://localhost:20128.

InterfaceEndpoint / comandoUse para
🧰 MCP (stdio)omniroute --mcpIntegrar ao Claude Desktop, Cursor ou qualquer cliente MCP
🌊 MCP (HTTP)/api/mcp/streamMCP remoto — 110 ferramentas, 33 escopos (aplicação opcional), trilha de auditoria completa
📡 MCP (SSE)/api/mcp/sseTransporte MCP por streaming
🤝 A2A/.well-known/agent.jsonAgente para agente, JSON-RPC 2.0 + SSE, 6 habilidades
🌐 API REST/v1/*Compatível com OpenAI — chat, embeddings, imagens, áudio e OCR
🔔 Webhooks/api/webhooksEnviar eventos de solicitação / cota para Slack, Discord, Telegram ou qualquer URL
🛰️ CLI remotaomniroute connect Controlar uma instância remota com tokens de acesso com escopo
# Disponibilize ao Claude Code o conjunto completo de ferramentas do OmniRoute por MCP:
claude mcp add-server omniroute --type http --url http://localhost:20128/api/mcp/stream

📖 Servidor MCP · Servidor A2A · Protocolos de agentes


🗜️ Economize de 1595% dos tokens — Automaticamente

📖 Como funciona — pipeline, arquitetura e cálculo da economia

Pipeline de compressão do OmniRoute: uma solicitação ilustrativa do cliente com 10.000 tokens passa por 12 mecanismos combináveis — Session-Dedup, CCR, Lite, RTK, Responses Tool Output, Headroom, Relevance, Caveman, Aggressive, LLMLingua-2, Ultra e OmniGlyph — e pode chegar ao provedor com cerca de 1.080 tokens no exemplo documentado de empilhamento. O conteúdo estruturado é protegido por salvaguardas de preservação e verificações de fidelidade em cada etapa; modos explicitamente com perdas ou experimentais podem transformar conteúdo elegível.

A combinação empilhada padrão executa RTK → Caveman. Quando ambos atuam sobre o mesmo payload de ferramenta/contexto, a economia é composta:

combined = 1  (1  RTK) × (1  Caveman_input)
average  = 1  (1  0.80) × (1  0.46) = 89.2%
range    = 78.4  94.6%

Blocos de código, URLs, JSON e dados estruturados são sempre protegidos pelo mecanismo de preservação.

Por que usar muitos tokens quando poucos dão conta do recado? Cada solicitação passa pelo pipeline de compressão do OmniRoute de forma transparente — sem alterações no cliente. Agora ele é uma pilha de 12 mecanismos combináveis, executados em ordem e combinados de diferentes maneiras conforme a configuração de roteamento — com base em ideias do RTK, Caveman ( 90K+), LLMLingua-2 e Troglodita (PT-BR).

🧱 A pilha de 12 mecanismos

Os mecanismos são executados na ordem do pipeline; cada um pode ser ativado, desativado e configurado de forma independente para cada combinação:

#MecanismoO que faz
1Session-DedupRemove conteúdo repetido entre turnos (endereçado por conteúdo, entre turnos)
2CCRArquiva blocos grandes por trás de marcadores de recuperação, acessados sob demanda
3LiteRemoção de espaços em branco + URLs de imagens (base leve em latência)
4RTKFiltragem inteligente de resultados de ferramentas, desduplicação e truncamento (com reconhecimento de comandos)
5Responses Tool OutputJSON priorizando a ausência de perdas + compressão limitada de diagnósticos para saídas de shell/patch/pesquisa/build (Responses API)
6HeadroomCompactação tabular sem perdas de arrays JSON (~30%) por meio de um codec GCF incorporado
7RelevancePontuação extrativa de frases em relação à última consulta do usuário
8CavemanCompressão de texto baseada em regras (~6575% na saída)
9AggressiveResumo + envelhecimento progressivo de turnos antigos
10LLMLingua-2Poda semântica com ML via MobileBERT ONNX — segura para código, assíncrona
11UltraPoda heurística de tokens com uma camada opcional de modelo pequeno (SLM)
12OmniGlyphCodificação experimental de contexto como imagem para o Claude Fable 5 medido na conexão direta da Anthropic; os transformers do GPT 5.6 permanecem bloqueados por segurança enquanto aguardam comprovantes do provedor. Quatro perfis de compressão (agressivo por padrão, equilibrado, seguro para código, passagem direta) (mais agressivo; adesão opcional)

Blocos de código, URLs e dados estruturados são sempre preservados byte a byte. Predefinições de um clique combinam os mecanismos:

ModoEconomiaMais indicado para
🪶 Lite~15%Padrão seguro sempre ativo
🪨 Standard (Caveman)~30%Programação diária
Aggressive~50%Sessões longas com uso intensivo de ferramentas
🔥 Ultra~75%Economia máxima
🧰 RTK6090%Saídas de shell/test/build/git
🔗 Stacked (RTK → Caveman)7895%Prompts mistos + logs de ferramentas

Exemplo real — modo Standard:

Antes (69 tokens): "O motivo pelo qual seu componente React está sendo renderizado novamente provavelmente é que você está criando uma nova referência de objeto a cada ciclo de renderização. Quando você passa um objeto inline como prop, a comparação superficial do React o considera um objeto diferente todas as vezes, o que aciona uma nova renderização. Recomendo usar useMemo para memorizar o objeto."

Depois (19 tokens): "Nova referência de objeto a cada renderização. Objeto inline como prop = nova referência = nova renderização. Envolva em useMemo."

Mesma resposta. 72% menos tokens. Nenhuma perda de precisão.

Exemplo em PT-BR — modo Troglodita:

Antes (42 tokens): "O problema é que o componente está re-renderizando porque uma nova referência de objeto está sendo criada em cada ciclo de renderização. Eu recomendaria usar useMemo."

Depois (12 tokens): "Re-render: ref nova cada ciclo (objeto inline recriado). Usar useMemo."

Mesma resposta. ~70% menos tokens. Precisão técnica intacta.


🎚️ Além dos mecanismos — estilos de saída, ajuste adaptativo e controle por requisição

Os 12 mecanismos acima reduzem o que entra. Outras três camadas determinam como, quando e o que sai:

  • 🪄 Estilos de saída (direcionamento do eixo de saída) — injetam instruções determinísticas e seguras para cache que moldam a resposta; podem ser combinados, cada um com intensidade lite / full / ultra. Adicionar um estilo requer uma única linha no registro:
    • Prosa concisa — remove texto supérfluo / artigos / ressalvas; mantém a exatidão técnica.
    • Menos código — YAGNI de "dev sênior preguiçoso": a menor alteração funcional, sem estruturas não solicitadas.
    • Rabo de cavalo (dev sênior preguiçoso) — sobe a escada do YAGNI, corrige a causa raiz, produz o menor diff funcional.
    • Tenho TDAH (ação primeiro) — começa pela próxima ação, numera as etapas, fornece um único próximo passo concreto, sem preâmbulo.
    • CJK conciso (文言) — estilo ultraconciso em chinês clássico (restrito à localidade zh).
  • 🎯 Orçamento de contexto adaptativo (o ajuste) — em vez de um único limite de tokens liga/desliga, escala apenas os mecanismos mais baratos e com menor perda, até onde for necessário para caber na janela de contexto do modelo. Política: reserve-output (padrão, ciente do modelo) · percentage · absolute. Modo: floor (garante que caiba) · replace-autotrigger (sua escolha explícita prevalece) · off (limite legado).
  • 🎛️ Onde a compactação é decidida (precedência, alta → baixa) — cabeçalho x-omniroute-compression por requisição substituição da combinação de roteamento perfil nomeado ativo adaptativo / acionamento automático padrão do painel desativado. O plano aplicado é retornado no cabeçalho de resposta X-OmniRoute-Compression: <mode>; source=<source>.

Use o acionamento automático por limite de tokens, ative o ajuste adaptativo, fixe um perfil nomeado, defina uma configuração única por requisição ou atribua um pipeline por combinação de roteamento — o que melhor se adequar à carga de trabalho. Um harness de avaliação offline opcional (npm run eval:compression) pontua fidelidade versus economia em um corpus fixado antes de você promover uma alteração.

📖 COMPRESSION_GUIDE.md · RTK_COMPRESSION.md · COMPRESSION_ENGINES.md


Início rápido

1) Instale e execute

npm install -g omniroute
omniroute

💡 Está vendo npm warn ERESOLVE ou avisos de dependências peer? Eles são inofensivos.

Painel em http://localhost:20128 · API em http://localhost:20128/v1.

2) Conecte um provedor GRATUITO (sem cadastro)

Painel → Provedores → conecte o Kiro AI (Claude gratuito, ~50 créditos/mês por conta) ou o OpenCode Free (sem autenticação) → pronto.

3) Configure sua ferramenta de programação

URL base:    http://localhost:20128/v1
Chave de API: [copie em Painel → Endpoints]
Modelo:       auto            (roteamento inteligente sem configuração — ou qualquer provedor/modelo)

4) Verifique se está funcionando

curl http://localhost:20128/v1/models -H "Authorization: Bearer YOUR_KEY"

Você deverá ver seus modelos conectados na lista. 🎉 Pronto — comece a programar, e o OmniRoute fará o roteamento automático e usará alternativas quando necessário.

Se o seu cliente não conseguir enviar cabeçalhos personalizados, o OmniRoute também disponibiliza aliases de compatibilidade com token:

Catálogo OpenAI:   http://localhost:20128/vscode/YOUR_KEY/
Modelos OpenAI:    http://localhost:20128/vscode/YOUR_KEY/models
Chat OpenAI:       http://localhost:20128/vscode/YOUR_KEY/chat/completions
Respostas OpenAI:  http://localhost:20128/vscode/YOUR_KEY/responses
Chat Ollama:       http://localhost:20128/vscode/YOUR_KEY/api/chat
Tags Ollama:       http://localhost:20128/vscode/YOUR_KEY/api/tags

Use-os apenas com clientes que não conseguem anexar Authorization: Bearer .... A autenticação por cabeçalho continua sendo o modo recomendado.


📦 Mais métodos de instalação — Docker, código-fonte, pnpm, Arch

🐳 Docker

docker run -d --name omniroute --restart unless-stopped --stop-timeout 40 \
  -p 127.0.0.1:20128:20128 -v omniroute-data:/app/data diegosouzapw/omniroute:latest

:latest acompanha a versão estável SemVer publicada mais alta. Ela não acompanha a main do git. Fixe em :X.Y.Z para GitOps. Consulte Canais de lançamento do Docker. A imagem fixa OMNIROUTE_MEMORY_MB=1024. Isso é suficiente para o painel e um chat leve. Agentes de programação (POST /v1/responses do Claude Code, Codex, Grok, …) precisam de um heap V8 muito maior, caso contrário o processo apresenta FATAL ERROR com aproximadamente 12GiB durante dois contextos longos sobrepostos. Dimensione o contêiner acima do tamanho do heap (os buffers nativos ficam fora do V8):

Carga de trabalho Heap (-e OMNIROUTE_MEMORY_MB) Contêiner (--memory)
Painel / chat leve 1024 (padrão da imagem) ≥2g
Um agente de programação 8192 ≥10g
Duas /v1/responses longas simultâneas 1024012288 ≥1216g
docker run -d --name omniroute --restart unless-stopped --stop-timeout 40 \
  -e OMNIROUTE_MEMORY_MB=8192 --memory=10g \
  -p 127.0.0.1:20128:20128 -v omniroute-data:/app/data diegosouzapw/omniroute:latest

Tabela completa: Guia do Docker — RAM em tempo de execução.

Canal de pré-lançamento do Docker: diegosouzapw/omniroute:next e diegosouzapw/omniroute:next-web acompanham a ramificação padrão atual release/v*. Essas tags mutáveis destinam-se apenas a testar correções ainda não lançadas e não são compatíveis com ambientes de produção. Consulte Canais de lançamento do Docker.

🥟 Bun

O bun install padrão e a instalação global (bun install -g omniroute) são compatíveis por meio da detecção do runtime Bun:

  • bun:sqlite integrado: o OmniRoute usa o driver bun:sqlite integrado do Bun quando executado no Bun, recorrendo ao better-sqlite3 no Node.js ou ao sql.js.
  • Seleção automática do empacotador Webpack em desenvolvimento: o desenvolvimento (bun run dev) detecta automaticamente o Bun e desativa o Turbopack em favor do Webpack para evitar incompatibilidades com bindings nativos do V8. As builds de produção (bun run build) seguem OMNIROUTE_USE_TURBOPACK exatamente como no Node: Turbopack por padrão, OMNIROUTE_USE_TURBOPACK=0 para compilar com Webpack (Dockerfile.bun o disponibiliza como um --build-arg).
  • Dockerfile dedicado ao Bun: Dockerfile.bun multiestágio para implantações nativas de produção com Bun (docker build -f Dockerfile.bun -t omniroute:bun .).
# Instale e execute com Bun
bun install
bun run dev

🛠️ A partir do código-fonte

cp .env.example .env && npm install
PORT=20128 npm run dev

📦 pnpm

pnpm add -g omniroute@latest --allow-build=better-sqlite3 --allow-build=@swc/core && omniroute

🐧 Arch Linux (AUR)

yay -S omniroute-bin && systemctl --user enable --now omniroute.service

🔧 Nix (Flake)

# Usando flakes do Nix
nix develop
npm run dev

# Ou usando devbox
devbox run npm run dev

📖 Guia do Docker — perfis do Compose, HTTPS com Caddy e túneis do Cloudflare.

🦭 Podman

# 1. Prepare o diretório de dados montado por bind
mkdir -p data

# 2. Somente Linux + Podman rootless local (nunca um cliente remoto do Podman Machine):
podman unshare chown 1000:1000 ./data

# 3. Defina a indicação de runtime, compile a imagem local do Compose e inicie
echo "CONTAINER_HOST=podman" >> .env
podman compose --profile base up -d --build

No macOS ou Windows, o Podman usa um Podman Machine remoto: ignore podman unshare e siga as orientações de diretório de dados específicas para cada topologia.

📖 Guia do Podman — builds do Compose, Podman Machine e configuração do Quadlet com Linux/systemd.

Instalação mais rápida / enxuta (ignore a build nativa)

O mecanismo SQLite nativo (better-sqlite3) é uma dependência opcional, portanto uma instalação global nunca fica bloqueada compilando a partir do código-fonte: ela usa um binário pré-compilado quando há um compatível com sua plataforma/Node e, caso contrário, recorre de forma transparente a um mecanismo JavaScript puro (node:sqlite no Node 22+, ou então o WASM sql.js incluído) — nenhuma ferramenta de build é necessária.

Para ignorar completamente a preparação nativa pós-instalação (CI, ambientes sem interface gráfica ou máquinas lentas):

OMNIROUTE_SKIP_POSTINSTALL=1 npm install -g omniroute   # CI=1 também a ignora

Para instalações mais rápidas, prefira o pnpm (armazenamento endereçado por conteúdo + links físicos — veja acima). Para um runtime sem painel e sem interface gráfica, use o perfil base do Docker (acima) ou o guia do Termux. A CLI e o painel web são servidos pelo mesmo processo em uma única porta, portanto atualmente não há um pacote separado somente para CLI.


🎬 OmniRoute em ação

📹 Guias em vídeo

Captura do painel em 2026-08-24 · Catálogo bruto: YT 809 | TT 137 | IG 124 · Frescor (dias): YT 1 | TT 21 | IG 22

Reel do Instagram
🎬 #1 — Instagram
nick_saraev — 3,042,474 visualizações
Reel do Instagram — theopenstack
🎬 #2 — Instagram
theopenstack — 692,419 visualizações
TikTok — milesreevesai
🎬 #3 — TikTok
milesreevesai — 620,400 visualizações
YouTube — Vaibhav Sisinty
🎬 #4 — YouTube
Vaibhav Sisinty — 391,109 visualizações
Reel do Instagram — buildwithai.club
🎬 #5 — Instagram
buildwithai.club — 347,652 visualizações

Ranking completo (URLs canônicas deduplicadas, v > 0, maior alcance):

#1 #2 #3 #4 #5
nick_saraev — Instagram3,042,474 theopenstack — Instagram692,419 milesreevesai — TikTok620,400 Vaibhav Sisinty — YouTube391,109 buildwithai.club — Instagram347,652
#6 #7 #8 #9 #10
nivedan.ai — Instagram331,973 vaibhavsisinty — Instagram263,744 Nick Automates — Shorts do YouTube218,174 theroshankrishna — Instagram186,786 midudev — TikTok177,800

Métricas canônicas em 2026-08-24: 1.029 vídeos únicos · 11.132.922 visualizações conhecidas (v > 0) · 639 canais/perfis por rede. O painel bruto contém 1.070 linhas; 41 duplicatas do Instagram foram normalizadas pela URL canônica, mantendo a maior contagem por vídeo.

🎬 Fez um vídeo sobre o OmniRoute? Abra uma issue ou uma discussão com o link — nós o destacaremos aqui.


📧 Comunidade e ajuda

Tudo em um só lugar — siga o mantenedor, converse com a comunidade ou abra uma issue.

Canal Onde / como
💼 LinkedIn — siga o mantenedor linkedin.com/in/diegosouzapw
🐙 GitHub — siga para lançamentos e dicas @diegosouzapw
💬 Discord discord.gg/U47eFqAXCn
✈️ Telegram t.me/omnirouteOficial
🟢 WhatsApp — 🌍 Global entre no grupo
🟢 WhatsApp — 🇧🇷 Brasil entrar no grupo
🌍 Site omniroute.online
🌍 🌍Comunidade StHub OmniRoute (gratuita) portal StHub
📦 Código-fonte github.com/diegosouzapw/OmniRoute
🐛 Relatar um bug abra uma issue — anexe a saída de npm run system-info
🤝 Contribuir CONTRIBUTING.md · Modelo de branches e lançamentos · escolha uma good first issue
💚 Apoiar o projeto Formas de apoiar ↑ · GitHub Sponsors


🛠️ Stack de Tecnologias

CamadaTecnologia
Ambiente de execuçãoNode.js 22.x / 24.x LTS — >=22.22.2 <23 || >=24.0.0 <27
LinguagemTypeScript 6.0 — 100% TypeScript em src/ e open-sse/ (nenhum any no núcleo desde a v2.0)
FrameworkNext.js 16 + React 19 + Tailwind CSS 4
Banco de dadosbetter-sqlite3 (SQLite, registro em diário WAL) + LowDB (JSON legado) — 122 módulos de domínio, 176 migrações
MemóriaTexto completo com SQLite FTS5 + embeddings vetoriais quantizados em int8, decaimento tipado
EsquemasZod 4 — validação de E/S de ferramentas MCP + contratos de API
ProtocolosMCP (stdio / HTTP / SSE) + A2A v0.3 (JSON-RPC 2.0 + SSE)
StreamingServer-Sent Events (SSE) + ponte WebSocket (/v1/ws)
CompressãoPipeline de 12 mecanismos — RTK, Caveman, LLMLingua-2 (MobileBERT ONNX), GCF, OmniGlyph
Autenticação e segurançaOAuth 2.0 (PKCE) + JWT + chaves de API + autenticação MCP com escopo · AES-256-GCM para dados em repouso · DOMPurify
Furtividadewreq-js — imitação de impressão digital TLS JA3 / JA4, proxy de 3 níveis
ResiliênciaDisjuntor, recuo exponencial, prevenção de efeito manada, autorrecuperação automática de combos
Logspino — logs JSON estruturados com contexto da requisição
TestesExecutor de testes do Node.js + Vitest — mais de 39.000 declarações estáticas de testes em mais de 5.100 arquivos de teste rastreados (unitários, integração, E2E, segurança, ecossistema)
PlataformasDesktop (Electron) · Android (Termux) · PWA (qualquer navegador)
CI/CDGitHub Actions — publicação automática no npm + Docker Hub a cada lançamento
LinksSite · npm · Docker Hub

📖 Documentação

📘 Primeiros passos

DocumentoDescrição
Guia do usuárioProvedores, combinações, integração com CLI, implantação
Guia de configuraçãoMétodos completos de instalação, configurações de ferramentas de CLI, configuração de protocolos, ajuste de tempos limite
Guia de ferramentas de CLIConfiguração específica para Claude Code, Codex, Cursor, Cline, OpenClaw, Kilo e Copilot
Modo remotoControle um OmniRoute remoto (VPS) pela CLI do seu laptop usando tokens de acesso com escopo
Configuração do Claude CodeDirecione o Claude Code para o OmniRoute (local/remoto) com launch + perfis por modelo
Início rápidoInstalação em 3 etapas → conexão → configuração

🔧 Operações e implantação

DocumentoDescrição
Guia do DockerDocker run, perfis do Compose, HTTPS com Caddy, túneis, tags de imagem
Guia do PodmanIntegração do Quadlet com systemd, podman-compose, SELinux
Implantação em VMGuia completo: configuração de VM + nginx + Cloudflare
Implantação no Fly.ioImplante no Fly.io com armazenamento persistente
Guia do TermuxExecute o OmniRoute no Android por meio do Termux
Guia de PWAInstalação, cache e arquitetura de Progressive Web App
Guia de desinstalaçãoRemoção completa para todos os métodos de instalação
Configuração do ambienteVariáveis e referências completas de .env

🧠 Recursos e arquitetura

DocumentoDescrição
ArquiteturaArquitetura do sistema, fluxo de dados e funcionamento interno
Guia de compressãoPipeline com 7 opções: desativado / leve / padrão / agressivo / ultra / RTK / empilhado
Compressão RTKCompressão da saída de comandos, filtros, confiança, verificação, recuperação da saída bruta
Mecanismos de compressãoCaveman, RTK, pipelines empilhados, interfaces de painel/API/MCP
Formato das regras de compressãoEsquemas de pacotes de regras JSON para filtros Caveman e RTK
Pacotes de idiomas para compressãoDetecção de idioma e criação de pacotes de regras do Caveman
Guia de resiliênciaDisjuntores, períodos de espera, fila, prevenção de efeito manada, falsificação de TLS
Mecanismo de combinação automáticaPontuação com 16 fatores, pacotes de modos, autorrecuperação
Guia de proxySistema de proxy de 3 níveis, marketplace 1proxy, CRUD do registro
Camadas gratuitasDiretório consolidado: 34 pools recorrentes documentados / 452 entradas de camada gratuita catalogadas
Galeria de recursosTour visual pelo painel com capturas de tela
Documentação da base de códigoApresentação da base de código voltada para iniciantes

🤖 Protocolos e APIs

DocumentoDescrição
Referência da APITodos os endpoints com exemplos
Especificação OpenAPIEspecificação OpenAPI 3.0
Servidor MCP110 ferramentas MCP, configurações de IDE, clientes Python/TS/Go
Guia do servidor MCPInstalação do MCP, transportes e referência de ferramentas
Servidor A2AProtocolo JSON-RPC 2.0, habilidades, streaming, gerenciamento de tarefas
Guia do servidor A2ACartão do agente A2A, tarefas, habilidades e streaming

📋 Projeto e qualidade

DocumentoDescrição
Como contribuirConfiguração e diretrizes de desenvolvimento
Modelo de ramificação e lançamentoPara onde os PRs são direcionados (release/*) e o que main e as tags significam
Registro de alteraçõesHistórico completo de lançamentos por versão
Política de segurançaRelato de vulnerabilidades e práticas de segurança
Guia de i18nSuporte a 42 idiomas, fluxo de trabalho de tradução e RTL
Lista de verificação de lançamentoEtapas de validação antes do lançamento
Plano de coberturaEstratégia de cobertura de testes para mais de 39.000 declarações estáticas de testes em mais de 5.100 arquivos de teste rastreados

Principais colaboradores

O OmniRoute é moldado por uma comunidade apaixonada por código aberto. Estas pessoas fizeram contribuições excepcionais que afetam diretamente a qualidade, a estabilidade e o alcance do projeto. Agradecemos a todos.

Colaboradores externos por pull requests mesclados

PosiçãoColaboradorPRs mesclados~Linhas alteradas
1backryun190227,977
2oyi77180407,678
3rdself14580,663
4JxnLexn128387,049
5KooshaPari101125,747
6herjarsa88230,872
7RaviTharuma7955,106
8maxmad64bis69394,715
9artickc5933,260
10HouMinXi5147,334
10chirag127515,153
12xz-dev50245,976
13hartmark4752,185
14rqzbeh39143,181
15dhaern3419,559
16Dingding-leo331,986
17NomenAK3213,854
18MumuTW3016,953
19benzntech2911,641
20pacocartones249,331
20Prudhvivuda246,312

Dados congelados no commit mais recente dafb4ae808 da ramificação ativa release/v3.8.50, com mesclagens até 2026-08-24 05:26:03 UTC. O censo paginado do GitHub GraphQL contém 5.911 PRs mesclados: 2.707 pelo proprietário do repositório, 179 pelo Dependabot e 3.025 PRs externos de 535 colaboradores distintos. “Linhas alteradas” corresponde às adições + exclusões do GitHub e inclui arquivos gerados, lockfiles, catálogos, traduções e documentação; é uma medida da rotatividade do código, não de LOC de autoria. Empates no limite de corte são mantidos.

Commits atribuídos pelo GitHub

backryun
backryun

🥇 220 commits atribuídos pelo GitHub
Paijo
Paijo

🥈 219 commits atribuídos pelo GitHub
Randi
Randi

🥉 108 commits atribuídos pelo GitHub
Ravi Tharuma
Ravi Tharuma

🏅 81 commits atribuídos pelo GitHub
Chris
Chris

🏅 70 commits atribuídos pelo GitHub
Markus Hartung
Markus Hartung

🏅 69 commits atribuídos pelo GitHub · empate em 6º lugar
Dizzle
Dizzle

🏅 69 commits atribuídos pelo GitHub · empate em 6º lugar
Jan Leon
Jan Leon

🏅 64 commits atribuídos pelo GitHub
zenobit
zenobit

🏅 62 commits atribuídos pelo GitHub
Bob.Hou
Bob.Hou

🏅 51 commits atribuídos pelo GitHub · empate em 10º lugar
Xiangzhe
Xiangzhe

🏅 51 commits atribuídos pelo GitHub · empate em 10º lugar

Verificado novamente em 2026-08-24 06:14:31 UTC: commits atribuídos pelo GitHub, conforme informados pela API de Colaboradores do repositório para a branch padrão release/v3.8.50. A API retornou 525 identidades (415 usuários, 2 bots e 108 anônimas); esta tabela exclui o mantenedor, os bots e as identidades anônimas e mantém os empates na classificação. Ela é distinta tanto da classificação de PRs mesclados acima quanto do censo de metadados do Git com 639 pessoas abaixo.

🙏 Os recursos, as correções de bugs e as melhorias de infraestrutura desses colaboradores são uma parte essencial do que torna o OmniRoute confiável e rico em recursos. Cada pull request, cada caso de teste e cada arquivo de tradução i18n são importantes. O código aberto é construído por pessoas como elas.



💖 Patrocinadores

Um agradecimento especial às pessoas que financiam o OmniRoute do próprio bolso — cada contribuição mantém o projeto gratuito, independente e em constante evolução.

Andrew
Andrew

💛 Patrocinador mensal ativo
Vlad I
Vlad I

💛 Patrocinador mensal ativo
Paco Cartones
Paco Cartones

💛 Patrocinador ativo com contribuição única
Professor Igor Morais Vasconcelos
Prof. Igor Morais

💛 Apoiador anterior com contribuição única
longtao
longtao

💛 Apoiador anterior com contribuição única

… e outras pessoas que preferem permanecer anônimas 💛

Patrocinadores públicos do GitHub revalidados em 2026-08-24. O status activeOnly do GitHub determina os rótulos de atividade acima; apoiadores públicos com contribuições únicas divulgados anteriormente continuam sendo reconhecidos, e patrocinadores privados permanecem anônimos.

💖 Torne-se um patrocinador → — cada dólar mantém o OmniRoute gratuito e independente.


👥 Mais de 600 colaboradores

Colaboradores

Auditado em 2026-08-24 na base congelada ac02c5b42f e verificado novamente na ponta ativa de release/v3.8.50, dafb4ae808: 639 identidades humanas normalizadas do Git — 407 aparecem como autores de commits (incluindo o mantenedor) e 232 aparecem apenas em trailers explícitos de Co-authored-by. O levantamento normaliza identificadores noreply do GitHub, exclui 26 identidades de bots/agentes/serviços/placeholders e não mescla endereços de e-mail comuns apenas porque seus nomes de exibição coincidem.

Como contribuir

  1. Faça um fork do repositório
  2. Crie a branch a partir da ponta ativa de release/vX.Y.Z (não de main) — consulte Modelo de branches e releases
  3. Crie sua branch de funcionalidade (git checkout -b feat/amazing-feature)
  4. Faça o commit das suas alterações (git commit -m 'feat: add amazing feature')
  5. Envie para a branch (git push origin feat/amazing-feature)
  6. Abra um Pull Request com a base = essa branch release/vX.Y.Z

Consulte CONTRIBUTING.md para obter diretrizes detalhadas.

Publicando uma nova versão

# Crie uma release — npm publish acontece automaticamente
VERSION=x.y.z
gh release create "v${VERSION}" --title "v${VERSION}" --generate-notes

📊 Estrelas

Gráfico do histórico de estrelas

🌍 StarMapper

StarMapper

🙏 Agradecimentos

O OmniRoute apoia-se sobre os ombros de gigantes. Ele começou como um fork do 9router e uma versão em TypeScript do projeto em Go CLIProxyAPI — e, a partir daí, cada subsistema abaixo foi inspirado por um projeto de código aberto que chegou lá primeiro. Cada um deles ajudou a moldar uma parte concreta do OmniRoute. Este é o nosso agradecimento a todos eles. 🙏

contagens de estrelas verificadas pela API REST do GitHub em 24 de agosto de 2026 — dê uma estrela a esses projetos. As contagens são um retrato exato daquela data e mudarão naturalmente.

🧬 Linhagem e gateway

ProjetoComo inspirou o OmniRoute
9router26,161O projeto original no qual este fork se baseia — ampliado aqui com APIs multimodais e uma reescrita completa em TypeScript.
CLIProxyAPI48,497A implementação em Go que inspirou esta versão portada para JavaScript / TypeScript.
LiteLLM57,100O gateway de IA cujo conjunto público de dados de preços alimenta nossa sincronização de rastreamento de custos e cujo modelo de normalização de provedores serviu de base para nosso roteamento.
codex-chatgpt-web1,410Código-fonte MIT adaptado para a ponte ChatGPT Web → Codex Responses incorporada, incluindo adaptadores de sessão do navegador, enquadramento de respostas, uso e pesquisa na web.
free-claude-code48,112Padrões portados para recuperação de streaming, aliases sem raciocínio, pesquisa na web de contingência, limites de janela deslizante, ocultação de dados em logs e fluxos de inicialização reforçados.
composer-api322Padrões de escolha de ferramentas, restrição de saída e confirmação de ferramentas do Cursor Composer adaptados para o executor nativo do Cursor.
codex-multi-auth457Padrões de novo login e rotação de tokens de atualização portados para a reautenticação OAuth do Codex.
opencode-anthropic-auth510Valores padrão de transformação compatíveis com o Claude Code e comportamento de cabeçalhos de cobrança generalizados na ponte orientada por configuração do OmniRoute.
grok2api-merged2Seus mapeamentos de modelos Grok, gerador Statsig de TypeError simulado, valores padrão de solicitação e dispositivo e processador de respostas NDJSON foram substancialmente adaptados para o executor Grok Web do OmniRoute.
TQZHR/grok2api705A principal fonte transitiva de código por trás do grok2api-merged; suas implementações de modelo, cabeçalho, payload, Statsig e processador são preservadas na linhagem do Grok Web.
chenyme/grok2api7,520O código-fonte MIT subjacente para os valores padrão de payload e dispositivo do Grok, o gerador Statsig e o processador result.response, incorporado por meio do TQZHR e do grok2api-merged.
grok2api-pro27Uma fonte transitiva creditada pelo grok2api-merged por sua camada de pool de proxies; o OmniRoute preserva esse aviso de linhagem, mas não alega ter portado um pool de proxies em seu executor Grok Web de escopo limitado.
GrokProxy50Seu proxy do Grok autenticado por cookies e o padrão de streaming result.response.token serviram de base para o transporte Grok Web do OmniRoute.
GrokBridge5A implementação original do Grok Web consultou seu design upstream de HTTP/navegador; seu caminho HTTP direto deriva do GrokProxy, portanto não se alega uma portabilidade de código independente.
grok-web-api14Seus esquemas Rust ChatOptions e de envelope de resposta serviram de base para os tipos TypeScript de solicitação e resposta de streaming do Grok no OmniRoute.

🗜️ Compressão de contexto e tokens — mecanismos

ProjetoComo inspirou o OmniRoute
Caveman100,538O projeto viral do tipo "por que usar muitos token se poucos token resolvem" — sua filosofia de fala das cavernas impulsiona nosso modo de compressão padrão e mais de 30 regras de remoção de palavras supérfluas/condensação.
RTK Rust Token Killer77,185Compressão de alto desempenho da saída de comandos — inspirou nosso mecanismo RTK, a DSL de filtros JSON, a recuperação da saída bruta e o pipeline encadeado RTK → Caveman.
headroom67,310Compressão reversível de contexto (SmartCrusher) — inspirou nosso mecanismo headroom e o padrão de marcadores de recuperação ccr.
LLMLingua6,598Pesquisa sobre compressão de prompts (LLMLingua / LLMLingua-2) — inspirou nosso mecanismo llmlingua assíncrono, seguro para código e com tolerância a falhas.
llmlingua-2-js31O porte para JS/ONNX (MobileBERT / XLM-RoBERTa) usado como backend em thread de trabalho para nosso mecanismo LLMLingua.
Troglodita40Compressão de tokens em PT-BR — impulsiona nosso pacote de idioma pt-BR: redução de pleonasmos e remoção de palavras supérfluas ajustadas à gramática do português brasileiro.
ponytail108,957A habilidade viral de programação YAGNI do "dev sênior preguiçoso" — inspirou nosso Estilo de Saída less-code: direcionamento para a menor alteração funcional que reduz o código _gerado_ (o equivalente de Caveman no eixo de saída para uma prosa concisa).
i-have-adhd23,526Seu estilo de resposta orientado à ação e adequado a pessoas com TDAH foi adaptado para o estilo de saída conciso do OmniRoute em cinco idiomas.

🧩 Formatos compactos, pesquisa sobre tokens e ferramentas com reconhecimento de código

ProjetoComo inspirou o OmniRoute
TOON25,233Notação de Objetos Orientada a Tokens — seu modelo colunar de cabeçalho e linhas moldou nossa etapa de compactação tabular.
GCF Graph Compact Format41Seu formato compacto de grafos e design de perfil genérico fundamentaram a compactação tabular do OmniRoute e o formato de codec do Headroom.
gcf-typescript4A implementação MIT em TypeScript incorporada diretamente e ampliada como codec de perfil genérico do Headroom.
token-optimizer-mcp494Cache Brotli/SQLite + delta de contexto por sessão — inspirou nosso mecanismo session-dedup.
token-savior1,122Compactação da saída do Bash + perfis MCP — inspirou nossa disciplina de interrupção da compressão e a redução de manifestos de ferramentas MCP.
token-saver138Compressão de saída sensível ao conteúdo e por tipo de arquivo, com interrupção em caso de falha — validou nosso despacho por tipo e a omissão quando o ganho é mínimo.
token-optimizer1,951"Encontre os tokens fantasmas" — seu padrão de descarregamento + identificador recuperável fundamentou nossa abordagem de descarregamento CCR.
TokenMizer28Um modelo de grafo de sessão + desduplicação de linhas entre turnos que fundamentou nosso design de desduplicação por sessão.
OmniCompress3JSON colunar em Rust + recuperação endereçada por conteúdo + desduplicação entre mensagens — validou o design dos nossos mecanismos headroom/ccr/session-dedup e a invariante estável para cache de que a "forma comprimida independe da posição".
mcp-compressor113Compressão de esquemas/descrições de ferramentas MCP — fundamentou nossa redução da cardinalidade de manifestos de ferramentas MCP.
RepoMapper197Classificação de mapas de repositórios no estilo Aider — fundamentou nossa exploração de mapas de repositórios / classificação de recuperação.
quiet-shell-mcp4Redução declarativa da saída do shell via MCP — validou nossa compactação declarativa da saída do bash.
ts-morph6,162Kit de ferramentas da API do Compilador TypeScript — inspirou nossa remoção de comentários baseada em parser, que preserva literais de string, template e expressões regulares.

🧠 Memória e RAG

ProjetoComo inspirou o OmniRoute
Mem063,902Camada universal de memória — seu modelo de proxy como limite de gravação/leitura moldou nossa arquitetura de memória.
Letta (MemGPT)24,382Agentes com estado e memória em camadas — inspiraram nosso modelo em camadas de Controle e Recuperação de Contexto (CCR).
WFGY1,781A taxonomia ProblemMap de 16 modos de falha recorrentes em RAG/LLM — o vocabulário comum usado em nosso guia de solução de problemas.

🛰️ Inspeção de tráfego, MITM e proxy transparente

ProjetoComo inspirou o OmniRoute
llm-interceptor66A interceptação/análise MITM do tráfego entre assistentes de programação ↔ LLM orientou os requisitos iniciais do Inspetor de Tráfego. Quatro módulos derivados anteriormente — mesclagem de SSE, normalização de conversas, mascaramento de segredos e sanitização de cabeçalhos — foram substituídos por implementações independentes de sala limpa, baseadas em padrões públicos de protocolo. As duas superfícies de passagem direta para o host (passthrough.ts e _internal/bypass.cjs) continuam sendo implementações internas do OmniRoute classificadas de forma independente; elas não foram reescritas como parte dessa substituição.
ProxyBridge5,995Roteamento transparente de proxy por processo — inspirou nosso encerramento de MITM seguro contra falhas, tempos limite de inatividade de soquetes, atribuição de processos via /proc e captura TPROXY.

📚 Dados de modelos, observabilidade e interface

ProjetoComo inspirou o OmniRoute
models.dev6,555Banco de dados aberto de especificações, preços e recursos de modelos de IA — sincronizado nativamente com nosso catálogo de modelos.
React Flow / xyflow38,108A biblioteca de grafos baseada em nós que viabiliza nosso Estúdio de Compressão e nosso Estúdio de Combinação/Roteamento em tempo real.
LangGraph40,314A visualização ao vivo do grafo de fluxo de trabalho do LangGraph Studio inspirou a visualização em cascata e em tempo real dos nossos Estúdios.
Langfuse33,592Seu modelo de observabilidade de rastreamento → intervalo → geração moldou a visualização em cascata do nosso Estúdio de Compressão.
Kiali3,631Observabilidade da malha de serviços do Istio — inspirou nossos indicadores de disjuntor e elementos visuais de arestas com erro no Estúdio de Roteamento/Combinação.
lobe-icons2,428Logotipos de marcas de IA/LLM usados para renderizar os ícones dos provedores em todo o nosso painel.
flag-icons12,354Fornece as bandeiras SVG licenciadas sob a licença MIT usadas pelo seletor de idioma do README.

🛡️ Segurança

ProjetoComo inspirou o OmniRoute
awesome-secure-defaults721Uma lista selecionada de bibliotecas seguras por padrão que orienta nossas escolhas de segurança (Helmet.js, DOMPurify, ssrf-req-filter, safe-regex, Google Tink).

🧭 Ferramentas complementares

ProjetoComo inspirou o OmniRoute
ClawRouter6,564Inspirou a desduplicação de solicitações, o fallback emergencial de custo zero, as estratégias conectáveis de Auto-Combo e a classificação multilíngue de intenções.
Antigravity-Manager30,652Seu remapeamento de modelos com reconhecimento de conta, a validação do caminho do executável e o comportamento dos rótulos de plano serviram de referência para o runtime Antigravity do OmniRoute.
vscode-antigravity-cockpit4,817Seu formato compacto de contagem regressiva para redefinição de cota inspirou a exibição correspondente do limite do provedor no OmniRoute.
AionUi32,230Suas integrações ACP inspiraram a detecção automática, pelo OmniRoute, dos agentes de CLI instalados.
CodexBar20,507Identificou a superfície de cota do Grok Build; em seguida, o OmniRoute verificou e corrigiu de forma independente o formato real dos dados transmitidos.

📄 Licença

Licença MIT — consulte LICENSE para mais detalhes.


⬆ Voltar ao topo · Feito com ❤️ para a comunidade de IA de código aberto.

OmniRoute v3.8.51 · Node ≥22.22.2 · Licença MIT · omniroute.online