Files
OmniRoute/docs/i18n/de
Diego Rodrigues de Sa e Souza c3e966eeb9 docs(changelog): reconcile the v3.8.51 living section — round 2 (2026-09-15) (#13731)
Second `npm run release:reconcile` pass on `release/v3.8.50..release/v3.8.51`
(091589089c..c0f92ec98a, 916 non-merge commits, 877 merged PRs):

- fold the 173 changelog.d fragments accumulated since #12971 under
  `## [3.8.51]` and delete them
- generate bullets for the 58 cycle commits that had no fragment
  (4 features / 42 fixes / 12 maintenance), each with the merged PR link and
  `— thanks @author`
- link 137 fragment bullets to the PR of the commit that added them and
  credit the author; two prefix/origin mismatches reviewed (#12945→#13392,
  #13001→#13379, both maintainer rebaselines of other people's PRs)
- refresh "Release by the numbers" + Top-25 and regenerate the
  `### 🙌 Contributors` hall (112 external contributors + maintainer; every
  non-bot author of the 877 merged PRs present)
- closed-PR credit audit for the window: nothing to add (#13215→#13361 and
  #13059→#13690 are still open, #12998 was independently fixed earlier by
  #12853); no human co-author trailers, no commits without a PR
- resync the 58 i18n CHANGELOG mirrors

Gates: check:changelog-integrity OK, check:docs-sync PASS.
2026-09-17 10:47:11 -03:00
..

README (Deutsch)

🌐 Languages: 🇺🇸 English · 🇪🇹 am · 🇸🇦 ar · 🇦🇿 az · 🇧🇬 bg · 🇧🇩 bn · 🇨🇿 cs · 🇩🇰 da · 🇬🇷 el · 🇪🇸 es · 🇪🇪 et · 🇮🇷 fa · 🇫🇮 fi · 🇫🇷 fr · 🇮🇪 ga · 🇮🇳 gu · 🇳🇬 ha · 🇮🇱 he · 🇮🇳 hi · 🇭🇷 hr · 🇭🇺 hu · 🇦🇲 hy · 🇮🇩 id · 🇳🇬 ig · 🇮🇹 it · 🇯🇵 ja · 🇬🇪 ka · 🇰🇭 km · 🇮🇳 kn · 🇰🇷 ko · 🇱🇹 lt · 🇱🇻 lv · 🇮🇳 ml · 🇮🇳 mr · 🇲🇾 ms · 🇲🇹 mt · 🇲🇲 my · 🇳🇵 ne · 🇳🇱 nl · 🇳🇴 no · 🇮🇳 or · 🇮🇳 pa · 🇵🇭 phi · 🇵🇱 pl · 🇵🇹 pt · 🇧🇷 pt-BR · 🇷🇴 ro · 🇷🇺 ru · 🇱🇰 si · 🇸🇰 sk · 🇸🇮 sl · 🇷🇸 sr · 🇸🇪 sv · 🇰🇪 sw · 🇮🇳 ta · 🇮🇳 te · 🇹🇭 th · 🇹🇷 tr · 🇺🇦 uk-UA · 🇵🇰 ur · 🇺🇿 uz · 🇻🇳 vi · 🇳🇬 yo · 🇨🇳 zh-CN · 🇹🇼 zh-TW


OmniRoute-Dashboard

🚀 OmniRoute — Das kostenlose KI-Gateway

OmniRoute — Höre niemals auf zu programmieren. Jedes KI-Tool → 359 Anbieter — über 150 kostenlos — über einen einzigen Endpunkt. Claude Code, Codex, Cursor, Cline, Copilot & Antigravity mit KOSTENLOSEM Claude / GPT / Gemini und automatischem Fallback. Die kombinierte RTK- und Caveman-Komprimierung spart 15–95 % der Tokens (durchschnittlich ca. 89 %) — stoße nie wieder an Limits. 359 KI-Anbieter · über 150 kostenlose Tarife · ca. 1,47 Mrd. kostenlose Tokens/Monat · 19 Routing-Strategien · Einstieg für 0 $.

💰 ~1,47 Mrd. kostenlose Tokens / Monat

Kostenlose Kontingente manuell zu kombinieren ist mühsam — Dutzende SDKs, Dutzende Ratenlimits und keine Ahnung, wie viel tatsächlich verfügbar ist. OmniRoute katalogisiert 452 Einträge mit kostenlosem Kontingent über 34 wiederkehrende Pool-Schlüssel hinweg und berechnet die angegebene Token-Gesamtmenge aus den 16 Pools mit einem veröffentlichten positiven monatlichen Budget sowie fünf modellspezifischen Groq-Obergrenzen, wobei gemeinsam genutzte Pools dedupliziert werden. Kontingente, die erst nach einer regionalen Identitätsprüfung verfügbar werden (derzeit: ModelScope), werden separat ausgewiesen: +~6 Mio. hinter einer regionalen Identitätsprüfung. Sie werden niemals zur Gesamtmenge hinzugerechnet. Das Ergebnis bleibt im Dashboard (/dashboard/free-tiers) sichtbar.

OmniRoute-Karte für kostenlose Kontingente: dauerhaft ~1,47 Mrd. kostenlose Tokens pro Monat, im ersten Monat mit Registrierungsguthaben bis zu ~2,07 Mrd., aus 34 dokumentierten wiederkehrenden Pool-Schlüsseln, die 452 katalogisierte Einträge mit kostenlosen Kontingenten hinter einem einzigen Endpunkt abdecken. Ehrliche, nach Pools deduplizierte Berechnung — jeder gemeinsam genutzte Pool wird nur einmal gezählt, einschließlich 16 wiederkehrender Pools mit einem veröffentlichten positiven monatlichen Token-Budget sowie fünf modellspezifischen Groq-Obergrenzen; 13 Anbieter sind im Katalog für Nutzungsbedingungsrisiken mit „vermeiden“ gekennzeichnet, sodass Sie selbst entscheiden können. Der Budgetbalken umfasst Mistral 1 Mrd., Nara 210 Mio., LLM7 150 Mio., Groq 30 Mio. (fünf modellspezifische Obergrenzen) und kleinere Pools. Registrierungsguthaben für den ersten Monat sowie dauerhaft kostenlose Anbieter ohne Token-Obergrenze werden separat ausgewiesen, damit sie die Gesamtangabe niemals künstlich erhöhen. Live-Anzeige von verbrauchten/verbleibenden Tokens unter /dashboard/free-tiers.

Animierte Zusammenfassung der Live-Seite /dashboard/free-tiers. Vollständige Methodik (Pool-Deduplizierung, Guthabenstufen, Anbieterbedingungen): docs/reference/FREE_TIERS.md.

Diese Zahlen werden alle zwei Wochen erneut anhand des Live-Katalogs geprüft und können sich in beide Richtungen verändern — beendet ein Anbieter sein kostenloses Kontingent, sinkt die Zahl; kommt ein neues hinzu, steigt sie. Wir veröffentlichen, was der Katalog tatsächlich berechnet, und niemals einen aufgerundeten Bestwert.


Gib dem Repository einen Stern, wenn OMNIROUTE dir geholfen hat, Geld zu sparen und deine Arbeit zu erleichtern.

Sterne diegosouzapw%2FOmniRoute | Trendshift Rang im Sterne-Verlauf olud.ai

💬 Tritt der Community bei

👋 Folge dem Maintainer — erfahre als Erstes von neuen Anbietern, Releases und Tipps:

Folge Diego auf LinkedIn Folge @diegosouzapw auf GitHub

Discord Telegram WhatsApp Global WhatsApp Brasil Website

Fragen, Anbietertipps, Roadmap und Support → Discord · Telegram · WhatsApp 🌍 Global / 🇧🇷 Brasilien / Portal


📈 Das Gateway wächst weiter

v3.8.49 v3.8.50 v3.8.51+
🌐 Anbieter 290 352 weitere vorgemerkt
🧠 Eindeutige Chatmodell-IDs 1185 1312
🖼️ Modalitätsbrücke 🆕 Bild + Audio + Video
📡 Kostenloser Radar-Katalog 🆕 optional aktivierbar
⚖️ Kontingentabhängige Planung 🆕 Quota-Share
📊 Kontingenttelemetrie 🆕 in Echtzeit

Roadmap — auf direktem Weg zu v3.9.0 LTS


🧩 Verfügbar

npm-Version NPM monatlich Docker Hub Lizenz: MIT Docker-Downloads Electron-Downloads

🚀 Start 🚀 Schnellstart 📦 Installation 🆓 Keine Konfiguration
💡 Lernen 💥 Das Versprechen 🤔 Warum OmniRoute? 🏆 Was OmniRoute auszeichnet
⚙️ Funktionen 🎯 Combos 🌐 Anbieter 🔌 CLI & MCP
🗜️ Komprimierung 🖥️ Wo es läuft 🔒 Privat
👀 Ansehen 🎬 Im Einsatz Neuigkeiten 🤖 Kompatible CLIs
💚 Unterstützen 💚 Unterstützen / Spenden 💬 Community 💖 Sponsoren
📦 Projekt 🛠️ Technologie-Stack 📖 Dokumentation 👥 Mitwirkende
🌐 In 66 Sprachen

English (en) Português — Brasil (pt-BR) Português (pt) Español (es) Français (fr) Italiano (it) Deutsch (de) Nederlands (nl) Русский (ru) Українська (uk-UA) Polski (pl) Čeština (cs) Slovenčina (sk) Română (ro) Magyar (hu) Български (bg) Dansk (da) Suomi (fi) Norsk (no) Svenska (sv) 中文 — 简体 (zh-CN) 中文 — 繁體 (zh-TW) 日本語 (ja) 한국어 (ko) ไทย (th) Tiếng Việt (vi) Bahasa Indonesia (id) Bahasa Melayu (ms) Filipino (phi) हिन्दी (hi) ગુજરાતી (gu) मराठी (mr) தமிழ் (ta) తెలుగు (te) বাংলা (bn) اردو (ur) فارسی (fa) العربية (ar) עברית (he) Türkçe (tr) Azərbaycan (az) Kiswahili (sw) Ελληνικά (el) Hrvatski (hr) Српски (sr) Lietuvių (lt) Eesti (et) Latviešu (lv) Slovenščina (sl) Malti (mt) Gaeilge (ga) ಕನ್ನಡ (kn) മലയാളം (ml) ଓଡ଼ିଆ (or) ਪੰਜਾਬੀ (pa) नेपाली (ne) සිංහල (si) မြန်မာ (my) ខ្មែរ (km) Hausa (ha) Yorùbá (yo) Igbo (ig) አማርኛ (am) Oʻzbekcha (uz) ქართული (ka) Հայերեն (hy)


🆓 Funktioniert sofort nach der Installation — keine Schlüssel, keine Konfiguration

Funktioniert sofort nach der Installation — ohne Konfiguration. Drei Schritte: 1. Installieren — npm i -g omniroute, der Server startet auf localhost:20128. 2. Dein Tool auf http://localhost:20128/v1 verweisen — jedes OpenAI-kompatible Tool (Claude Code, Cursor, Cline). 3. Es antwortet — rufe das Modell auto auf, um sofort eine Antwort zu erhalten, ganz ohne API-Schlüssel, Registrierung oder Konfiguration. Der schlüssellose Anbieter OpenCode Free ist bereits in die auto-Kombination integriert, sodass eine frische Installation sofort einsatzbereit ist.
# Frische Installation, keine Zugangsdaten — `auto` funktioniert bereits:
curl http://localhost:20128/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{"model":"auto","messages":[{"role":"user","content":"Hello!"}]}'

Bevorzugst du ein bestimmtes kostenloses Backend? Rufe oc/… (OpenCode Free) direkt auf. Wechsle anschließend zu auto und überlasse OmniRoute die Auswahl.

📦 Kopierfertige Schnellstartskripte für Python, Node.js, PHP und cURLexamples/quickstart/


💥 Das Versprechen

Das Versprechen — ein Endpunkt und 359 Anbieter. Automatisches Fallback hält das Routing aufrecht, solange ein anderes fehlerfreies Ziel verfügbar ist. Sechs Säulen: robustes Fallback über 359 Anbieter hinweg · bis zu 95 % Token-Einsparungen bei geeigneten Workloads · kostenloser Einstieg mit über 150 kostenlosen Tarifen und 53 wiederkehrenden bzw. schlüssellosen, dauerhaft kostenlosen Anbietern · 36 CLI-/Agenten-Integrationen über eine einzige Konfiguration · Kompatibilität mit OpenAI, Claude, Gemini und der Responses API unter /v1 · Produktionskontrollen einschließlich Schutzschaltern, TLS-Tarnung, MCP mit 110 Tools, A2A, Speicher, Schutzvorkehrungen, Evaluationen und über 39.000 statischen Testdeklarationen in mehr als 5.100 erfassten Testdateien.

🤔 Warum OmniRoute?

Warum OmniRoute — Schluss mit dem Jonglieren zwischen 10 Dashboards, ungültigen API-Schlüsseln und überraschenden Rechnungen. Zehn alltägliche Probleme und Lösungen: ungenutzt verfallendes Kontingent → Abonnements optimal ausschöpfen; Ratenbegrenzungen mitten beim Programmieren → 4-stufiges automatisches Fallback (Abonnement → API → Günstig → Kostenlos); Tool-Ausgaben verbrauchen zu viele Token → RTK- + Caveman-Komprimierung (15–95 %); teure APIs → kostenoptimiertes Routing; jedes Tool erfordert eine eigene Einrichtung → ein Endpunkt, ein Dashboard; KI blockiert → 3-stufiger Proxy + TLS-Tarnung; ungültige Schlüssel → 3-schichtige Ausfallsicherheit (Schutzschalter, Schlüssel-Abklingzeit, Modellsperre); ein Team teilt sich ein Abonnement → Schlüssel-Pools mit fair verteilten Kontingenten; Prompts laufen durch die Cloud eines Drittanbieters → Local-First mit AES-256-GCM-verschlüsselten Schlüsseln; keine Kostentransparenz → Live-Analysen (Nutzung, Kontingent, Einsparungen, p95-Latenz).
OmniRoute-Anfrageablauf: Deine IDE oder CLI (Claude Code, Cursor, Cline…) ruft einen einzigen lokalen Endpunkt auf (http://localhost:20128/v1); der intelligente OmniRoute-Router (RTK- + Caveman-Komprimierung, 19 Routing-Strategien, Schutzschalter, TLS-Tarnung, MCP, A2A, Schutzvorkehrungen) kann über 4 Anbieterstufen hinweg ausweichen, solange ein geeignetes fehlerfreies Ziel verfügbar ist — Stufe 1: Abonnement, Stufe 2: API-Schlüssel, Stufe 3: Günstig und Stufe 4: Kostenlos.

🤝 Unterstützt von unseren Open-Source-Freunden

Kimi K3 — Offene Spitzenintelligenz · 2,8 Billionen Parameter · Kontext mit 1 Million Tokens

Möchten Sie Open-Source-Freund werden? Dies sind die Unternehmen, die Open Source unterstützen und dazu beitragen, OmniRoute voranzubringen — und wir legen öffentlich offen, wofür jeder Token verwendet wird, den sie uns zur Verfügung stellen. Kontaktieren Sie uns: diegosouza.pw@outlook.com

Kimi (Moonshot AI)
Kimi
Moonshot AI

Gründender Open-Source-Freund
Vielen Dank an Kimi (Moonshot AI), unseren ersten Open-Source-Freund, für die Unterstützung dieses Projekts! Kimi ist das KI-Labor hinter den Open-Weight-Modellfamilien K2 und K3 — Kimi K3 bietet ein Kontextfenster mit 1 Million Tokens, native Bildverarbeitung und Programmierfähigkeiten auf Spitzenniveau zu einem Bruchteil der Preise geschlossener Modelle und funktioniert sofort mit Claude Code, Codex und jedem von OmniRoute unterstützten Programmierwerkzeug.

Was durch Kimis Unterstützung ermöglicht wird: Kimis API-Guthaben finanzieren die KI-validierte Release-Pipeline von OmniRoute — die Phase Merge-Validierung mit Kimi K3, die jeden Pull Request vor der Veröffentlichung überprüft — sowie die tägliche Funktionsentwicklung. Erstklassige Kimi-Unterstützung wird auf beiden Wegen bereitgestellt: über die direkte Kimi API (kimi-k3) und den Kimi Code-Programmiertarif (OAuth und API-Schlüssel). OmniRoute ist außerdem das erste brasilianische Open-Source-Projekt im Förderprogramm von Kimi. Holen Sie sich einen Kimi-API-Schlüssel mit 15 % zusätzlichem Guthaben →
Cheaper Inference
Cheaper Inference
cheaperinference.com

Open-Source-Freund
Vielen Dank an Cheaper Inference, einen Open-Source-Freund von OmniRoute, für die Unterstützung dieses Projekts! Cheaper Inference ist ein nach Kosten geordnetes Gateway, das 42 Spitzenmodelle — Claude, GPT-5.x, Gemini, Kimi K3, GLM, DeepSeek, Grok und MiniMax — über einen einzigen OpenAI-kompatiblen Endpunkt weiterverkauft und jede Anfrage an den günstigsten geeigneten Anbieter weiterleitet, ohne jemals mehr als den Listenpreis des Modellherstellers zu berechnen.

Erstklassige Unterstützung in OmniRoute: Chat Completions, der native Endpunkt /v1/responses, Bildverarbeitung, Tool-Aufrufe und 3 Bildmodelle (grok-imagine, nano-banana-pro, nano-banana-2, erreichbar als cheaperinference/<model>). API-Schlüssel anfordern →

Mit aff=omniroute gekennzeichnete Links sind Partnerlinks. Sie finanzieren das Projekt, ohne dass Ihnen zusätzliche Kosten entstehen.


🎟️ Partneraktionen — kostenlose Anmeldegutscheine von Anbietern, die uns nicht sponsern (zum Aufklappen klicken)

Dieser Abschnitt ist ausschließlich für Empfehlungs- und Gutscheincodes vorgesehen. Gesponserte Partnerschaften finden Sie oben unter 🤝 Unterstützt von unseren Open-Source-Freunden. OmniRoute unterhält keine Sponsoring- oder Partnerschaftsbeziehung mit den hier aufgeführten Anbietern — dies sind öffentliche Gutscheine, die jeder nutzen kann.

AgentRouter
AgentRouter
agentrouter.org
AgentRouter — Anmeldung über Partnerlink · $100 kostenloses Guthaben bei der Anmeldung (kostenloser Server, höhere Latenz zu erwarten — am besten zum Testen geeignet, nicht für den Produktivbetrieb). Erstklassige Unterstützung in OmniRoute seit v3.8.50: Chat Completions, das Anthropic-kompatible Übertragungsformat und der OpenAI-kompatible Pfad. Zu den verfügbaren Modellen gehören claude-opus-4-8, claude-opus-5, gpt-5.6-sol und weitere. Sichern Sie sich Ihre $100 →

⚠️ Partnerlink — OmniRoute unterhält keine Sponsoring- oder Partnerschaftsbeziehung mit diesem Anbieter.

Kennen Sie einen weiteren Anbieter mit einem großzügigen kostenlosen Anmeldegutschein, von dem OmniRoute-Nutzer profitieren? Eröffnen Sie ein Issue, und wir fügen ihn hier hinzu.


🎯 Combos — Das Flaggschiff

Alle 19 Combo-Routing-Strategien animiert — eine Kachel pro Strategie: priority, fill-first, weighted, round-robin, p2c, least-used, random, strict-random, cost-optimized, headroom, reset-window, reset-aware, context-relay, context-optimized, cache-optimized, lkgp, auto, fusion, pipeline. In der Tabelle oben steht, was die einzelnen Strategien bewirken.

Ein Combo ist eine Kette von Modellen, zwischen denen OmniRoute automatisch routet. Wenn das Kontingent erschöpft ist, ein Anbieter ausfällt oder die Kosten sprunghaft steigen, kann das Combo zum nächsten geeigneten und funktionsfähigen Modell wechseln. 🛡️

Keine Konfiguration — einfach auto verwenden

Es muss kein Combo erstellt werden. Setze dein Modell auf auto (oder eine Variante), und OmniRoute erstellt aus deinen verbundenen Anbietern ein virtuelles Combo, das in Echtzeit bewertet wird:

Modell-IDWofür es optimiert ist
auto🎯 Ausgewogener Standard (LKGP — bleibt bei deinem letzten funktionierenden Anbieter)
auto/coding🧑💻 Qualitätsorientierte Gewichtung für die Codegenerierung
auto/fast Niedrigste Latenz zuerst
auto/cheap💰 Niedrigste Kosten pro Token zuerst
auto/offline🔋 Größter Spielraum bei Kontingenten und Ratenbegrenzungen zuerst
auto/smart🔭 Qualität zuerst + 10 % Exploration, um bessere Modelle zu entdecken
auto/lkgp📌 Explizite Bindung an den letzten bekanntermaßen funktionierenden Anbieter
auto/chaos🧪 Gewichtung für Fehlerinjektion zur Resilienzprüfung (Chaos Engineering)

🔀 Oder erstelle dein eigenes — 19 Routing-Strategien

Alle 19 Strategien — pro Combo-Schritt frei kombinierbar:

# Strategie Funktionsweise
1 priority Geordnete Liste mit bevorzugtem Ziel — jedes Ziel wird vor dem nächsten vollständig ausgeschöpft 🥇
2 fill-first Das Kontingent jedes Ziels vollständig ausschöpfen, bevor zum nächsten gewechselt wird
3 weighted Gewichtete Zufallsauswahl anhand der Gewichtung pro Ziel
4 round-robin Ziele der Reihe nach durchlaufen
5 p2c Zufälliger Lastenausgleich nach dem „Power of Two Choices“-Prinzip
6 least-used Das Ziel mit der aktuell geringsten Auslastung auswählen
7 random Gleichverteilte Zufallsauswahl (ohne Duplikate)
8 strict-random Zufallsauswahl, ohne Wiederholungen zu entfernen 🎲
9 cost-optimized Kosten pro Anfrage anhand aktueller Katalogpreise minimieren 💸
10 headroom Das Ziel mit dem größten verbleibenden Kontingent auswählen
11 reset-window Das Ziel bevorzugen, dessen Kontingentfenster am frühesten zurückgesetzt wird
12 reset-aware Nach dem Zeitpunkt der Kontingent-Rücksetzung priorisieren — kurze Zeitfenster zuerst 📊
13 context-relay Kontext bei langen Unterhaltungen zwischen Zielen übergeben 🧠
14 context-optimized Das am besten zur aktuellen Kontextgröße passende Ziel auswählen
15 cache-optimized Jedes wiederverwendbare Prompt-Präfix demselben Konto zuordnen — Treffer im Prompt-Cache maximieren 🎯
16 lkgp Last-Known-Good Path — bindet Anfragen an den letzten erfolgreichen Anbieter und greift anschließend auf Regeln zurück
17 auto Echtzeitbewertung aller Verbindungen anhand von 16 Faktoren 🤖
18 fusion Anfragen parallel an ein Modellgremium senden; ein Bewertungsmodell fasst die Ergebnisse zu einer Antwort zusammen 🧬
19 pipeline Schritte verketten — die Ausgabe jedes Ziels dient als Eingabe für das nächste 🔗

Die Auto-Combo-Engine bewertet jeden Kandidaten anhand von 16 Faktoren (Zustand, Kontingent, Kosten, Latenz, Aufgabeneignung, Qualität, Sitzungsverfügbarkeit …) — siehe docs/routing/AUTO-COMBO.md.

🧱 Resilienz ist integriert (3 unabhängige Ebenen)

OmniRoute-Ausfallsicherheit — 3 unabhängige Selbstheilungsebenen, die richtige Ebene für den jeweiligen Fehler. Ebene 1: Provider-Schutzschalter (gesamter Provider): Wird nur bei 408/5xx ausgelöst, Schwellenwerte OAuth 8× / API-Schlüssel 12× / lokal 2×, wird nach 60s/30s/15s für einen HALF-OPEN-Test zurückgesetzt, verzögerte Wiederherstellung; während OPEN leitet die Kombination zum nächsten Provider um. Ebene 2: Verbindungs-Cooldown (ein Schlüssel/Konto): Basiswert 5s für OAuth / 3s für API-Schlüssel, exponentieller ×2-Backoff mit Schutz vor gleichzeitigem Wiederanlauf, bei 429 wird Retry-After berücksichtigt, ein Erfolg löscht den gesamten Fehlerstatus; ein Schlüssel im Cooldown wird übersprungen, während weitere Schlüssel weiterhin Anfragen bedienen. Ebene 3: Modellsperre (ein Modell): Modellbezogene 429-Fehler, lokale 404-Fehler oder Modusverweigerungen sperren nur dieses Modell — niemals die gesamte Verbindung. Endzustände (gesperrt, abgelaufen, Guthaben aufgebraucht) sind für den Betreiber bestimmt, nicht für Cooldowns.

📖 Auto-Combo-Engine · Ausfallsicherheitsleitfaden


🏆 Was OmniRoute auszeichnet

Was OmniRoute auszeichnet — eine zeitbezogene Funktionsübersicht im Vergleich zu 9router, OpenRouter, CLIProxyAPI und LiteLLM anhand von 13 Funktionen. OmniRoute: 359 Anbieter, über 150 integrierte kostenlose Tarife, 19 Routing-Strategien, Token-Komprimierung mit 12 Engines, integrierter MCP-Server mit 110 Tools, A2A-Agentenprotokoll, persistenter Speicher, Schutzmechanismen, Cloud-Agenten, Verschleierung von TLS-Fingerabdrücken, Desktop/Termux/PWA und 42 lokalisierte UI-Sprachen. OmniRoute ist MIT-lizenziert und kann selbst gehostet werden. Funktionen und Zahlen der Wettbewerber können sich ändern; siehe die verlinkte Methodik.

📊 Vollständige Methodik & Details zu den einzelnen Funktionen im Vergleich zu 9router, OpenRouter, CLIProxyAPI & LiteLLM → docs/comparison/OMNIROUTE_VS_ALTERNATIVES.md


💚 OmniRoute unterstützen

OmniRoute ist MIT-lizenziert und wird offen weiterentwickelt. Wenn es Ihnen Zeit oder Geld spart, können Sie so dazu beitragen, dass es unabhängig bleibt — wählen Sie einfach, was zu Ihnen passt. Sponsoring beeinflusst niemals die Routing-Priorität; es verschafft Sichtbarkeit, keine bessere Platzierung.

Repository mit einem Stern markierenKostenlos — hilft wirklich bei der SichtbarkeitOmniRoute mit einem Stern markieren
🐙 GitHub SponsorsEinmalig oder monatlich · keine Plattformgebührgithub.com/sponsors/diegosouzapw
Ko-fiSchnelle einmalige Spende, keine Registrierung für Spendende erforderlichko-fi.com/diegosouzapw
🧋 Buy Me a CoffeeKleine, informelle Gestebuymeacoffee.com/diegosouzapw
🖐 LiberapayWiederkehrend · gemeinnützig · Open Sourceliberapay.com/diegosouzapw
🇧🇷 PIX (Brasilien)Sofort, gebührenfreiSchlüssel & QR-Code unten
KryptowährungenBTC · ETH · USDT-TRC20 · USDC-SolanaAdressen unten

🇧🇷 PIX — sofort, gebührenfrei (Brasilien)

PIX-QR-Code von OmniRoute

Schlüssel (zufällig): 5d865059-bc44-483a-962d-43ceb80126eb

Pix copia-e-cola:

00020101021126580014br.gov.bcb.pix01365d865059-bc44-483a-962d-43ceb80126eb5204000053039865802BR5922OMNIROUTE CONTRIBUICAO6006BRASIL62070503***630475DD

₿ Kryptowährungen — BTC · ETH · USDT-TRC20 · USDC-Solana (zum Aufklappen anklicken)
₿ BTCBitcoin (SegWit)bc1qh00smz004sy85wyl28v77tenkt3ckl6eaep7fd
Ξ ETHEthereum (ERC20)0x64Cf6B68A6Ff34288e89172950a2d00102337a84
₮ USDTTron (TRC20)TKAF41JpuQrHbKTnsQa9svJE2T192Hvsc2
$ USDCSolana2emNNZzVVWQc3FQ2wk9M6qXUQmW8AKdjjL174fXR28Tu

⚠️ Senden Sie jede Kryptowährung ausschließlich über das angegebene Netzwerk — beim Senden über das falsche Netzwerk können die Mittel verloren gehen.

🐛 Einen Fehler gefunden oder Feedback? Eröffnen Sie eine Diskussion.


Hinweise für Entwickler: Das Projekt kann während npm install/postinstall der Einfachheit halber eine lokale .env-Datei für Entwickler erstellen. Diese Datei wird absichtlich über .gitignore ignoriert (siehe .gitignore) und darf niemals committet werden — falls sie versehentlich committet wurde, ändern Sie alle offengelegten Geheimnisse und entfernen Sie die Datei aus dem Verlauf. Hinweise zur Verwaltung lokaler Umgebungsdateien und Geheimnisse finden Sie unter docs/DEVELOPER-ENVIRONMENT.md.

📡 OmniRoute Radar

Das wichtigste kostenlose Kontingent umfasst weiterhin ~1.47B Token/Monat aus dem oben dokumentierten, um Überschneidungen zwischen Pools bereinigten Katalog. Temporäre Guthaben für die Registrierung bei Anbietern können den ersten Monat zusätzlich auf ~2.07B erhöhen. Radar ist eine optionale, signierte Katalogerweiterung für alle, die zwischen OmniRoute-Versionen aktuellere Informationen zur Verfügbarkeit kostenloser Modelle wünschen; der Community-Katalog und alle bestehenden kostenlosen Funktionen bleiben kostenfrei.

Unterstützer können den Live-Katalog und zusätzliche Anbieteroptionen erhalten. Dessen separate, veränderliche Obergrenze liegt abhängig von der Verfügbarkeit der Anbieter bei höchstens etwa 3B Token/Monat. Diese Obergrenze ist keine Garantie: Anbieter können Kontingente, Berechtigungskriterien, Modelle oder Regionen jederzeit ändern.

Radar ist optional und verwendet ausschließlich GET-Anfragen. Der OmniRoute-Client lädt keine Prompts, Datenverkehrsdaten, Anbieter- konfigurationen, Nutzungstelemetrie oder den lokalen Status verworfener Ankündigungen hoch. Weitere Informationen zur Teilnahmeberechtigung und zum aktuellen Katalog finden Sie unter radar.omniroute.online/planos.


Was ist neu?

Aktuelle Highlights von v3.8.20 → v3.8.50. Den vollständigen Verlauf finden Sie in CHANGELOG.md.

  • 🎛️ OmniConductor — eingehende A2A-Delegierung an Ihre Agentenflotte, Conductor-Skills auf der Agent Card und ein Dashboard-Panel mit Faro-Push-to-Talk-Sprachchat. → A2A-Server
  • 🛂 Adaptive Zulassung & Überlastungsschutz — ressourcenintensive Chatanfragen werden in eine Warteschlange gestellt, statt einen 503-Fehler auszulösen, mit atomaren gleitenden RPM-Leases pro Verbindung. → Resilienzleitfaden
  • 🗂️ Kanonische /v1/models-Reihenfolge — ein zusammenhängender, nach Provider gruppierter Block pro Provider (Combos zuerst fixiert), stabil über alle Katalogquellen hinweg. → API-Referenz
  • 🗜️ Gehärtete Komprimierung — standardmäßig aktivierter Inflationsschutz, Caveman-Pakete für DE / FR / JA + Chinesisch (wényán), RTK-Filter für Gradle & .NET. → Komprimierung
  • 💸 Ehrliche Pauschalkosten — Abonnement-/Coding-Plan-Provider werden in der Kostenanalyse mit $0 ausgewiesen; Budget, Kontingent & Routing nehmen weiterhin Schätzungen vor. → API-Referenz
  • ⚖️ Quota-Share-Routing — teilt das Kontingent eines gemeinsamen Kontos fair auf gebündelte Schlüssel auf und bleibt dabei auslastungserhaltend, sodass ungenutzte Anteile verliehen werden. → Resilienzleitfaden
  • 🤖 CLI-/Agenten-Einrichtung mit einem Befehl — 13 registrierte setup-*-Befehle; omniroute run startet 7 CLIs (Claude Code, Codex, Aider, Goose, OpenCode, Qwen Code, Gemini CLI); omniroute configure unterstützt 10 Ziele mit einer interaktiven Provider- und Modellauswahl sowie kontextspezifischen Favoriten. → CLI-Integrationen
  • 🛰️ Remote-Modus — steuern Sie eine entfernte OmniRoute-Instanz mit bereichsgebundenen Tokens (connect / contexts / tokens) sowie einem antigravity-OAuth-Helfer für VPS-Installationen. → Remote-Modus
  • 🧭 Intelligenteres automatisches Routingauto/<category>:<tier>-Combos, Fusion (Modellpanel + Bewerter), aufgabenbezogenes Routing sowie anfragespezifische Überschreibungen für Modell / Modus / USD-Budget. → Auto-Combo
  • 🗜️ Erweiterbare Komprimierung — 12 kombinierbare Engines + Compression Studios: LLMLingua-2, zweistufiges Ultra, omniglyph, Fidelity-Gate pro Schritt, GCF v3.2, Editor mit Drag-and-drop-Neuanordnung. → Komprimierung
  • 🕵️ Transparente MITM-Entschlüsselung (TPROXY) — erfasst CLIs, die Proxy-Umgebungsvariablen ignorieren, mit einer CA pro SNI und einem Trust-Store-Installationsprogramm. → MITM/TPROXY
  • 💸 Kosten-Telemetrie überallX-OmniRoute-*-Header für Kosten/Nutzung an jedem Endpunkt, Header für Cache-HIT-Einsparungen, USD-Ausgabenkontingente pro Schlüssel. → API-Referenz
  • 🧠 Speicher unter Ihrer Kontrolle — standardmäßig deaktiviert, optionale int8-Vektorquantisierung + typisierter Verfall, anfragespezifisches x-omniroute-no-memory. → Speicher
  • 🛡️ Sicherheit — Schutz vor Prompt-Injection auf jeder LLM-Route (Red-Team-Suite), optionale Schutzvorkehrung zur Maskierung von Zugangsdaten (schwärzt offengelegte API-Schlüssel/Geheimnisse in beide Richtungen), kostenlose DuckDuckGo-Websuche als letzte Rückfallebene und eine optionale OIDC-Anmeldeschranke für das Dashboard (die Passwortanmeldung bleibt stets verfügbar). → Schutzvorkehrungen
  • 🖼️ Neue Endpunkte/v1/ocr (Mistral OCR) und /v1/audio/translations (im Whisper-Stil) vervollständigen die Medienfunktionen. → API-Referenz
  • 🎨 Bild-/Video-/Audiogenerierung — eine API für Medien: xAI Grok Imagine & Novita AI Video, ComfyUI, Magnific, Adobe Firefly, Segmind sowie Sprachanbieter wie ElevenLabs. → API-Referenz
  • 🌍 Bereitstellung & Betrieb — Reverse-Proxy-basePath, automatische Erkennung der Browsersprache, Geräteverfolgung pro Schlüssel, MITM-Vertrauen ohne Root-Rechte, zh-TW-Lokalisierung. → Umgebung
  • 🤝 Mehr Provider & Agenten — Cloud-Agenten (Codex Cloud, Cursor, Devin, Jules), Grok Build (xAI) mit Browser- + OAuth-Anmeldung, vollwertige Ollama-Karte, Claude Opus 5 & Sonnet 5, offizielle Kimi-Partnerschaft (Code/Web/Moonshot), Zed, Requesty, SenseNova, Yuanbao, Agnes AI … und ein aktualisierter Katalog mit 352 Providern. → Provider
  • 📡 Routing-Transparenz — jede Antwort enthält einen X-OmniRoute-Decision-Header, der die verwendete Strategie, den Provider und die Latenz angibt; eine neue cache-optimized-Combo-Strategie + der Auto-Combo-Faktor cacheAffinity leiten wiederholte Anfragen zurück an die Verbindung, die das zwischengespeicherte Präfix hält; und ein schreibgeschützter Endpunkt /v1/auto-combo/{channel}/candidates stellt den aktuellen Kandidatenpool eines auto/*-Kanals bereit. → Auto-Combo
  • Lokale Leistung & Infrastruktur — lokales Redis mit einem Klick, Relay-Deployments für Cloudflare Workers / Deno Deploy, Bifrost & Mux als überwachte eingebettete Dienste. → Eingebettete Dienste
  • 🧩 Ebenfalls enthalten — Plugin-Framework + Marktplatz, Omni-/Agent-/GitHub-Skills-Frameworks, Obsidian-Vault-Integration (22 MCP-Tools), OpenAI-kompatible Batch- & Files-APIs, semantischer Antwort-Cache, Gamification mit Bestenlisten, ACP-Agentenerkennung (15 integrierte Agenten), planmäßiger Log-Export nach BigQuery, auto/chaos-Fehlerinjektion, eine Telegram-Bot-Bridge, ein integrierter Versionsmanager und LMArena-ELO-Ranglisten kostenloser Provider. → Dokumentation

🤖 Kompatible CLIs & Coding-Agenten

Eine Konfiguration — http://localhost:20128/v1 — und jede KI-IDE oder CLI läuft mit kostenlosen und kostengünstigen Modellen.

Claude Code
Claude Code
                           
Codex CLI
Codex CLI
                           
Cline
Cline
                           
Kilo Code
Kilo Code
Zoo Code
Zoo Code
Continue
Continue
                           
Aider
Aider
                           
ForgeCode
ForgeCode
                           
jcode
jcode
                           
DeepSeek TUI
DeepSeek TUI
                           
CodeWhale
CodeWhale
                           
OpenCode
OpenCode
                           
Factory Droid
Factory Droid
                           
GitHub Copilot CLI
Copilot CLI
                           
Cursor CLI
Cursor CLI
                           
Smelt
Smelt
                           
Pi (pi-coding-agent)
Pi
                           
Grok Build (xAI)
Grok Build
                           
Hermes Agent (Nous Research)
Hermes Agent
                           
OpenClaw
OpenClaw
                           
Goose
Goose
                           
Open Interpreter
Open Interpreter
                           
Warp AI
Warp AI
                           
Agent Deck
Agent Deck
                           
funktioniert auch mit · Kiro · Command Code · Antigravity · Windsurf · AMP · jedem OpenAI-kompatiblen Tool

📖 Einrichtung pro Tool für alle 36 Tools (26 CLI-Code-Tools + 10 CLI-Agenten) → docs/reference/CLI-TOOLS.md · 🧩 OpenCode-Plugin → @omniroute/opencode-provider


Starte jede unterstützte CLI mit einem einzigen Befehl über OmniRoute — es werden keine Konfigurationsdateien geschrieben, Anmeldedaten werden pro Prozess injiziert und Qwen/Gemini erhalten ein temporäres, isoliertes Home-Verzeichnis:

omniroute run claude   --model openai/gpt-5.4          # Claude Code
omniroute run codex    --model glm/glm-5.2             # OpenAI Codex CLI
omniroute run aider    --model glm/glm-5.2 -- --message "reply OK"
omniroute run goose    --model glm/glm-5.2
omniroute run opencode --model glm/glm-5.2 -- run "reply OK"
omniroute run qwen     --model glm/glm-5.2 -- -p "reply OK"
omniroute run gemini   --model glm/glm-5.2 -- --skip-trust -p "reply OK"

# Oder Anbieter und Modell interaktiv auswählen und die eigene Konfiguration des Tools schreiben:
omniroute configure codex          # außerdem: claude opencode qwen aider goose gemini cline continue kilo

Jeder Befehl berücksichtigt den aktiven Remote-Kontext (omniroute connect <host>), --dry-run zeigt die exakten Umgebungsvariablen/Argumente in einer Vorschau an, ohne sie auszuführen, und --api-key-env NAME hält Geheimnisse aus deinem Shell-Verlauf fern. → CLI-Integrationen


🌐 352 KI-Anbieter — 152 im Katalog als kostenlos gekennzeichnet

352 registrierte Anbieter in den kanonischen Sammlungen für Chat, Medien, Suche, lokale Dienste, Cloud-Agenten und Systeme, darunter 152 mit den Erkennungsmetadaten hasFree: true. Das Chat-Modellregister umfasst 229 Anbieter / 2.554 unterschiedliche Anbieter-Modell-Paare / 1.283 unverarbeitete Modell-IDs; der separate Katalog für kostenlose Kontingente enthält 443 modellspezifische Einträge, 34 wiederkehrende Pools und 53 wiederkehrend kostenlose bzw. schlüssellose, dauerhaft kostenlose Anbieter. Diese Nenner unterscheiden sich bewusst; Definitionen und um Pool-Duplikate bereinigte Berechnungen finden Sie in der Anbieterreferenz und unter Kostenlose Tarife.

🏢 Jedes große KI-Labor — über einen einzigen Endpunkt

OpenAI
OpenAI
                           
Anthropic
Anthropic
                           
Gemini
Gemini
                           
xAI Grok
xAI Grok
                           
DeepSeek
DeepSeek
                           
Mistral
Mistral
                           
Qwen
Qwen
                           
Meta Llama
Meta Llama
                           
Groq
Groq
                           
NVIDIA
NVIDIA
                           
MiniMax
MiniMax
                           
Cohere
Cohere
                           
Perplexity
Perplexity
                           
Hugging Face
HuggingFace
                           
Together
Together
                           
Fireworks
Fireworks
                           
Cloudflare
Cloudflare
                           
Baidu
Baidu
                           

…und über 330 weitere — jedes Symbol wird live aus dem Anbieterkatalog des Dashboards geladen. 📖 Anbieterreferenz


🆓 Dauerhaft kostenlos — $0, keine Kreditkarte erforderlich

OpenCode Zen
OpenCode Zen
DeepSeek V4, Nemotron 3
Kein Token-Limit
Kilo Code
Kilo Code
Auto-Router, Tencent Hy3
Für immer kostenlos
Requesty
Requesty
GPT-OSS 120B, Nemotron
Für immer kostenlos
SiliconFlow
SiliconFlow
DeepSeek V3.2 / R1
Kostenloses Kontingent
Z.AI GLM
Z.AI GLM
GLM-4.7 / 4.5-Flash
Für immer kostenlos
Baidu ERNIE
Baidu ERNIE
ERNIE 4.0
Für immer kostenlos
Qoder AI
Qoder AI
Qwen3-Max, Kimi-K2
Unbegrenzt KOSTENLOS
Pollinations
Pollinations
GPT, Llama, Claude
Kein Schlüssel erforderlich
Cloudflare AI
Cloudflare AI
Über 50 Modelle
10.000 Neuronen/Tag
NVIDIA NIM
NVIDIA NIM
GLM, MiniMax
~40 RPM kostenlos
Cerebras
Cerebras
GLM 4.7, GPT-OSS
1 Mio. Token/Tag
OpenRouter
OpenRouter
:free-Modelle
+$10 → höhere RPM

📖 Vollständiger maschinenlesbarer Katalog → docs/reference/PROVIDER_REFERENCE.md


🖥️ Wo OmniRoute läuft — überall

Dieselbe App, dein Rechner, deine Regeln. Von einer globalen npm-Installation bis hin zu deinem Smartphone über Termux.

PlattformInstallationHighlights
📦 npm (global)npm install -g omnirouteEin Befehl, jedes Betriebssystem
🐳 Dockerdocker run … diegosouzapw/omnirouteMulti-Architektur: AMD64 + ARM64
🖥️ Desktop (Electron)npm run electron:buildNatives Fenster + Taskleiste — Windows / macOS / Linux
🎩 Menüleiste (OmniRouteTray)brew install --cask zoispag/tap/omniroute-trayÜberwacht und aktualisiert den Server automatisch — macOS
💪 ARMnativ für arm64Raspberry Pi, ARM-Server, Apple Silicon
📱 Android (Termux)pkg install nodejs && npx -y omnirouteLäuft auf deinem Smartphone, rund um die Uhr, ohne Root-Zugriff
📲 PWA„Zum Startbildschirm hinzufügen“Vollbildmodus, offline, über den Browser installierbar
🧩 OpenCode-Plugin@omniroute/opencode-providerNative OpenCode-Integration
🤖 VS Code Copilot ChatOmniCopilot-Erweiterung installierenJedes OmniRoute-Modell in der nativen Copilot-Chat-Auswahl — Stable & Insiders
🛠️ Aus dem Quellcodenpm install && npm run devAnpassen und mitwirken

📖 Docker-Anleitung · Desktop · Menüleisten-App · Termux · PWA · OpenCode


🧩 Neu: OmniRoute im nativen Copilot Chat von VS Code

Keine neue Seitenleiste, keine neue Chat-Oberfläche — jedes von OmniRoute bereitgestellte Modell erscheint direkt in der bereits verwendeten Modellauswahl von Copilot Chat. Seit VS Code 1.122 funktionieren Anbietermodelle ohne GitHub-Anmeldung oder Copilot-Abonnement — Agentenmodus, Tool-Aufrufe und Bildverarbeitung, kostenlos.

Installiere die Erweiterung OmniCopilot, verbinde sie mit deinem OmniRoute-Server (standardmäßig localhost:20128) und öffne dann Copilot Chat → Modellauswahl → Modelle verwalten…OmniRoute.

StoreLinkKompatibel mit
🧩 VS Code MarketplaceInstallieren →VS Code — Stable & Insiders
🔓 Open VSX RegistryInstallieren →Cursor, Windsurf, VSCodium, Theia, code-server, Gitpod, Antigravity, Kiro…

Im Editor: Öffne die Ansicht Erweiterungen, suche nach „OmniRoute“ und klicke auf Installieren — funktioniert in beiden Stores auf dieselbe Weise. Quellcode, Issues und das Runbook für die Veröffentlichung findest du unter diegosouzapw/OmniCopilot.

📖 Anleitung für VS Code Copilot Chat — Einrichtung, Anzeige in der Modellauswahl, Dashboard in einem Tab, Fehlerbehebung


🎩 Neu: OmniRouteTray — dein Gateway in der Menüleiste

omniroute serve funktioniert am besten, wenn es immer läuft. OmniRouteTray macht daraus eine einmalig einzurichtende Menüleisten-App für macOS: Sie startet den Server, hält ihn auch nach Neustarts am Laufen, aktualisiert ihn direkt und macht dein aktuelles Token-Budget mit einem Klick verfügbar — kein offenes Terminalfenster und keine globale Installation mit npm install -g omniroute, um die du dich kümmern musst.

Die App basiert auf Tauri v2 (mit einem winzigen Rust-Kern) und bringt eine eigene signierte Node-24-Laufzeitumgebung mit. Sie verwaltet eine app-eigene OmniRoute-Installation und gerät daher nie mit deinem globalen node/bun in Konflikt. Sie verwendet deine vorhandene Konfiguration und Datenbank unter ~/.omniroute/ — es ist also dasselbe OmniRoute, das du bereits ausführst, nur mit Hut. 🎩

FunktionFunktionsweise
🟢 Überwacht den ServerStartet omniroute serve und übernimmt eine bereits laufende Instanz, statt sie zu duplizieren
📊 Live-Nutzung auf einen BlickKontingentanzeigen der Anbieter, Sitzungs- und Wochenlimits von Claude mit Countdown bis zur Zurücksetzung sowie Kostenaufschlüsselung für 30 Tage
🔄 Automatische direkte UpdatesMehrstufige Installation, atomarer Austausch und Rollback bei Fehlern — immer auf dem neuesten Release
🚀 Beim Anmelden startenOptionaler Start bei der Anmeldung; nur in der Menüleiste, ohne Dock-Symbol
🩺 Diagnose & ProtokolleDiagnose mit einem Klick und Zugriff auf die Serverprotokolle
brew install --cask zoispag/tap/omniroute-tray

Bevorzugen Sie einen Download? Laden Sie die neueste .dmg-Datei unter Releases herunter. Quellcode, Issues und Build-Dokumentation finden Sie unter zoispag/omniroute-tray.
💛 Ein Community-Projekt von @zoispag — keine offizielle OmniRoute-Veröffentlichung.


🔒 Privat & Local-First

Privat und Local-First — Gateway und Steuerungsebene von OmniRoute laufen auf Ihrem Rechner. Prompts werden an den für jede Anfrage ausgewählten Upstream-Anbieter gesendet; OmniRoute fügt keinen gehosteten Zwischenschritt zur Prompt-Verarbeitung hinzu, und Telemetrie ist standardmäßig deaktiviert. Zugangsdaten werden im Ruhezustand mit AES-256-GCM verschlüsselt; zu den Schutzmaßnahmen gehören die Einschränkung von API-Schlüsseln, IP-Filterung, Ratenbegrenzungen, Schutz vor Prompt-Injection, die Bereinigung von Upstream-Headern, optionale PII-Schwärzung, bereinigte Fehlermeldungen und ein lokales SQLite-Audit-Protokoll. OmniRoute ist MIT-lizenziert und kann selbst gehostet werden.

📖 Autorisierung · Schutzmechanismen · Compliance


🔌 Vollständige CLI + A2A & MCP

Neben dem Server ist OmniRoute eine vollständige Kommandozeilen-Schaltzentrale mit über 80 Befehlen sowie offenen Agentenprotokollen, sodass ein KI-Agent sie eigenständig steuern kann.

⌨️ Eine echte CLI (nicht nur start)

omniroute               # Gateway + Dashboard bereitstellen (Port 20128)
omniroute chat          # interaktiver TUI-Chat-Client (Slash-Befehle: /model /combo /skill /memory)
omniroute setup         # geführter Assistent für die Ersteinrichtung
omniroute doctor        # Anbieter, Ports und native Abhängigkeiten diagnostizieren

🛰️ Remote-Modus — CLI hier ausführen, OmniRoute auf einem VPS

OmniRoute auf einem Server? Steuern Sie es von Ihrem Laptop aus mit derselben CLI. Melden Sie sich einmal mit einem eingeschränkten Zugriffstoken an; anschließend wird jeder Befehl an das Remote-System gesendet.

omniroute connect 192.168.0.15            # Passwort → eingeschränktes Token, als Kontext gespeichert
omniroute models list                     # ← wird auf dem REMOTE-Server ausgeführt
omniroute configure codex                 # ← wählt ein Remote-Modell aus und schreibt ein lokales Codex-Profil
omniroute tokens create --name ci --scope read   # eingeschränktere Token für andere Rechner erstellen
omniroute contexts use default            # ← zurück zum lokalen Server wechseln

Token sind auf read / write / admin beschränkt; Routen, die Prozesse starten, bleiben ausschließlich über Loopback erreichbar. 📖 Remote-Modus

Animierte Terminal-Demo der OmniRoute-CLI — omniroute providers list, omniroute combo list und omniroute health — wechselt durch die 86 Top-Level-Befehle: providers · oauth · keys · combo · nodes · models · cache · compression · cost · usage · quota · health · resilience · telemetry · logs · audit · mcp · a2a · cloud · memory · skills · eval · tunnel · backup · sync · webhooks · policy · pricing · translator · simulate …

🤝 Einen Agenten verbinden — und er steuert OmniRoute selbst

Stellen Sie OmniRoute über MCP, A2A, eine REST API, Webhooks oder eine Remote-CLI bereit — jeder geeignete Agent (oder Ihr eigener Code) erhält die Kontrolle über das gesamte Gateway: Routing, Anbieter, Kombinationen, Cache, Komprimierung und Speicher — autonom. Die nachfolgenden HTTP-Endpunkte werden unter http://localhost:20128 bereitgestellt.

SchnittstelleEndpunkt / BefehlVerwendungszweck
🧰 MCP (stdio)omniroute --mcpIn Claude Desktop, Cursor oder jeden beliebigen MCP-Client integrieren
🌊 MCP (HTTP)/api/mcp/streamRemote-MCP — 110 Werkzeuge, 33 Berechtigungsbereiche (Durchsetzung optional), vollständiges Audit-Protokoll
📡 MCP (SSE)/api/mcp/sseStreaming-Transport für MCP
🤝 A2A/.well-known/agent.jsonAgent-zu-Agent-Kommunikation, JSON-RPC 2.0 + SSE, 6 Fähigkeiten
🌐 REST API/v1/*OpenAI-kompatibel — Chat, Einbettungen, Bilder, Audio, OCR
🔔 Webhooks/api/webhooksAnfrage- und Kontingentereignisse an Slack, Discord, Telegram oder eine beliebige URL senden
🛰️ Remote-CLIomniroute connect Eine Remote-Instanz mit eingeschränkten Zugriffstoken steuern
# Claude Code über MCP den vollständigen OmniRoute-Werkzeugsatz bereitstellen:
claude mcp add-server omniroute --type http --url http://localhost:20128/api/mcp/stream

📖 MCP-Server · A2A-Server · Agentenprotokolle


🗜️ Automatisch 1595 % Tokens sparen

📖 Funktionsweise — Pipeline, Architektur & Berechnung der Einsparungen

OmniRoute-Komprimierungspipeline: Eine beispielhafte Client-Anfrage mit 10.000 Tokens durchläuft 12 kombinierbare Engines — Session-Dedup, CCR, Lite, RTK, Responses Tool Output, Headroom, Relevance, Caveman, Aggressive, LLMLingua-2, Ultra und OmniGlyph — und kann im dokumentierten kombinierten Beispiel den Anbieter mit etwa 1.080 Tokens erreichen. Strukturierte Inhalte werden durch Schutzmechanismen zur Erhaltung und Integritätsprüfungen nach jedem Schritt geschützt; explizit verlustbehaftete oder experimentelle Modi können geeignete Inhalte transformieren.

Die standardmäßig kombinierte Konfiguration führt RTK → Caveman aus. Wenn beide dieselben Tool-/Kontextdaten verarbeiten, multiplizieren sich die Einsparungen:

kombiniert   = 1  (1  RTK) × (1  Caveman_Eingabe)
Durchschnitt = 1  (1  0.80) × (1  0.46) = 89.2%
Spanne       = 78.4  94.6%

Codeblöcke, URLs, JSON und strukturierte Daten werden durch die Schutz-Engine immer geschützt.

Warum viele Tokens verwenden, wenn wenige ausreichen? Jede Anfrage durchläuft OmniRoutes Komprimierungspipeline transparent — ohne Änderungen am Client. Sie besteht jetzt aus einem Stack aus 12 kombinierbaren Engines, die der Reihe nach ausgeführt und je nach Routing-Kombination flexibel zusammengestellt werden — basierend auf Ideen von RTK, Caveman ( 90K+), LLMLingua-2 und Troglodita (PT-BR).

🧱 Der Stack aus 12 Engines

Die Engines werden in der Reihenfolge der Pipeline ausgeführt; jede kann unabhängig aktiviert oder deaktiviert und je Kombination konfiguriert werden:

#EngineFunktionsweise
1Session-DedupEntfernt über mehrere Interaktionen hinweg wiederholte Inhalte (inhaltsadressiert, interaktionsübergreifend)
2CCRArchiviert große Blöcke hinter Abrufmarkierungen, die bei Bedarf abgerufen werden
3LiteReduziert Leerraum und Bild-URLs (latenzarme Basisvariante)
4RTKIntelligentes Filtern, Deduplizieren und Kürzen von Tool-Ergebnissen (befehlsabhängig)
5Responses Tool OutputPrimär verlustfreie JSON-Komprimierung plus begrenzte Diagnosekomprimierung für Shell-/Patch-/Such-/Build-Ausgaben (Responses API)
6HeadroomVerlustfreie tabellarische Komprimierung von JSON-Arrays (~30 %) über einen eingebundenen GCF-Codec
7RelevanceExtraktive Bewertung von Sätzen anhand der letzten Benutzeranfrage
8CavemanRegelbasierte Textkomprimierung (~6575 % bei der Ausgabe)
9AggressiveZusammenfassung und schrittweise Alterung früherer Interaktionen
10LLMLingua-2Semantische ML-Bereinigung über MobileBERT ONNX — codesicher, asynchron
11UltraHeuristische Token-Bereinigung mit optionaler Small-Model-Stufe (SLM)
12OmniGlyphExperimentelle Kodierung von Kontext als Bild für das gemessene Claude Fable 5 über die direkte Anthropic-Verbindung; GPT 5.6 Transformers bleiben bis zum Vorliegen von Anbieterbelegen nach dem Fail-Closed-Prinzip deaktiviert. Vier Komprimierungsprofile (standardmäßig aggressiv, ausgewogen, codesicher, unverändert) (am aggressivsten; optionale Aktivierung)

Codeblöcke, URLs und strukturierte Daten bleiben immer bytegenau erhalten. Ein-Klick-Voreinstellungen kombinieren die Engines:

ModusEinsparungenAm besten geeignet für
🪶 Lite~15 %Sichere, dauerhaft aktive Standardeinstellung
🪨 Standard (Caveman)~30 %Tägliche Programmierarbeit
Aggressive~50 %Lange Sitzungen mit intensiver Tool-Nutzung
🔥 Ultra~75 %Maximale Einsparungen
🧰 RTK6090 %Shell-/Test-/Build-/git-Ausgaben
🔗 Kombiniert (RTK → Caveman)7895 %Gemischte Prompts und Tool-Protokolle

Praxisbeispiel — Standardmodus:

Vorher (69 Tokens): „Der Grund dafür, dass deine React-Komponente erneut gerendert wird, liegt wahrscheinlich darin, dass du bei jedem Renderzyklus eine neue Objektreferenz erstellst. Wenn du ein Inline-Objekt als Prop übergibst, erkennt Reacts flacher Vergleich es jedes Mal als ein anderes Objekt, was ein erneutes Rendern auslöst. Ich würde empfehlen, useMemo zu verwenden, um das Objekt zu memoizieren.“

Nachher (19 Tokens): „Neue Objektreferenz bei jedem Rendern. Inline-Objekt-Prop = neue Referenz = erneutes Rendern. Mit useMemo umschließen.“

Gleiche Antwort. 72 % weniger Tokens. Kein Genauigkeitsverlust.

PT-BR-Beispiel — Troglodita-Modus:

Vorher (42 Tokens): „Das Problem ist, dass die Komponente erneut gerendert wird, weil in jedem Renderzyklus eine neue Objektreferenz erstellt wird. Ich würde empfehlen, useMemo zu verwenden.“

Nachher (12 Tokens): „Erneutes Rendern: neue Referenz je Zyklus (Inline-Objekt neu erstellt). useMemo verwenden.“

Gleiche Antwort. ~70 % weniger Tokens. Technische Präzision unverändert.


🎚️ Mehr als nur Engines — Ausgabestile, die adaptive Steuerung und Kontrolle pro Anfrage

Die 12 Engines oben reduzieren, was hineingeht. Drei weitere Ebenen bestimmen, wie, wann und was herauskommt:

  • 🪄 Ausgabestile (Steuerung der Ausgabeachse) — fügen deterministische, Cache-sichere Anweisungen zur Antwortgestaltung ein; kombinierbar, jeweils mit der Intensität lite / full / ultra. Zum Hinzufügen eines Stils genügt ein einzeiliger Registry-Eintrag:
    • Knappe Prosa — Füllwörter / Artikel / Einschränkungen weglassen; technische Substanz exakt beibehalten.
    • Weniger Code — „fauler Senior-Entwickler“-YAGNI: kleinste funktionierende Änderung, kein nicht angefordertes Gerüst.
    • Pferdeschwanz (fauler Senior-Entwickler) — die YAGNI-Leiter erklimmen, die eigentliche Ursache beheben, kleinster funktionierender Diff.
    • Ich habe ADHS (handlungsorientiert) — nächste Aktion zuerst, nummerierte Schritte, ein konkreter nächster Schritt, keine Einleitung.
    • Knappes CJK (文言) — ultraknapper Stil in klassischem Chinesisch (durch Gebietsschema auf zh beschränkt).
  • 🎯 Adaptives Kontextbudget (die Steuerung) — statt eines einzelnen Ein-/Aus-Token-Schwellenwerts werden die günstigsten Engines mit den geringsten Verlusten nur so weit hochgestuft, wie nötig ist, damit alles in das Kontextfenster des Modells passt. Richtlinie: reserve-output (Standard, modellabhängig) · percentage · absolute. Modus: floor (garantiert die Einhaltung) · replace-autotrigger (Ihre explizite Auswahl hat Vorrang) · off (veralteter Schwellenwert).
  • 🎛️ Wo über die Komprimierung entschieden wird (Priorität, hoch → niedrig)x-omniroute-compression-Header pro Anfrage Überschreibung durch Routing-Kombination aktives benanntes Profil adaptiv / automatische Auslösung Panel-Standard aus. Der angewendete Plan wird im Antwort-Header X-OmniRoute-Compression: <mode>; source=<source> zurückgegeben.

Automatische Auslösung anhand eines Token-Schwellenwerts, Aktivierung der adaptiven Steuerung, Festlegen eines benannten Profils, einmalige Einstellung pro Anfrage oder Zuweisen einer Pipeline pro Routing-Kombination — je nachdem, was zur Arbeitslast passt. Ein optionales lokales Evaluierungswerkzeug (npm run eval:compression) bewertet die Wiedergabetreue im Verhältnis zur Einsparung anhand eines festgelegten Korpus, bevor Sie eine Änderung übernehmen.

📖 COMPRESSION_GUIDE.md · RTK_COMPRESSION.md · COMPRESSION_ENGINES.md


Schnellstart

1) Installieren und ausführen

npm install -g omniroute
omniroute

💡 Sehen Sie npm warn ERESOLVE oder Peer-Dependency-Warnungen? Sie sind harmlos.

Dashboard unter http://localhost:20128 · API unter http://localhost:20128/v1.

2) Einen KOSTENLOSEN Anbieter verbinden (keine Registrierung)

Dashboard → AnbieterKiro AI (kostenloses Claude, ~50 Credits/Monat pro Konto) oder OpenCode Free (keine Authentifizierung) verbinden → fertig.

3) Ihr Programmierwerkzeug konfigurieren

Basis-URL:      http://localhost:20128/v1
API-Schlüssel:  [aus Dashboard → Endpunkte kopieren]
Modell:         auto            (intelligentes Routing ohne Konfiguration — oder beliebiger Anbieter/beliebiges Modell)

4) Funktion überprüfen

curl http://localhost:20128/v1/models -H "Authorization: Bearer YOUR_KEY"

Ihre verbundenen Modelle sollten aufgelistet werden. 🎉 Das war's — beginnen Sie mit dem Programmieren; OmniRoute übernimmt automatisch das Routing und weicht bei Bedarf auf Alternativen aus.

Falls Ihr Client keine benutzerdefinierten Header senden kann, stellt OmniRoute außerdem tokenisierte Kompatibilitätsaliase bereit:

OpenAI-Katalog:  http://localhost:20128/vscode/YOUR_KEY/
OpenAI-Modelle:  http://localhost:20128/vscode/YOUR_KEY/models
OpenAI-Chat:     http://localhost:20128/vscode/YOUR_KEY/chat/completions
OpenAI-Antworten: http://localhost:20128/vscode/YOUR_KEY/responses
Ollama-Chat:     http://localhost:20128/vscode/YOUR_KEY/api/chat
Ollama-Tags:     http://localhost:20128/vscode/YOUR_KEY/api/tags

Verwenden Sie diese nur für Clients, die Authorization: Bearer ... nicht anhängen können. Die Authentifizierung per Header bleibt der bevorzugte Modus.


📦 Weitere Installationsmethoden — Docker, Quellcode, pnpm, Arch

🐳 Docker

docker run -d --name omniroute --restart unless-stopped --stop-timeout 40 \
  -p 127.0.0.1:20128:20128 -v omniroute-data:/app/data diegosouzapw/omniroute:latest

:latest folgt der höchsten veröffentlichten stabilen SemVer-Version. Es folgt nicht dem Git-Branch main. Verwenden Sie für GitOps eine feste Version mit :X.Y.Z. Siehe Docker-Veröffentlichungskanäle. Das Image setzt OMNIROUTE_MEMORY_MB=1024 fest. Das reicht für das Dashboard und einen einfachen Chat. Coding-Agenten (POST /v1/responses von Claude Code, Codex, Grok, …) benötigen einen wesentlich größeren V8-Heap, andernfalls kommt es bei zwei sich überschneidenden langen Kontexten bei etwa 12GiB zu einem FATAL ERROR. Dimensionieren Sie den Container größer als den Heap (native Puffer befinden sich außerhalb von V8):

Arbeitslast Heap (-e OMNIROUTE_MEMORY_MB) Container (--memory)
Dashboard / einfacher Chat 1024 (Image-Standardwert) ≥2g
Ein Coding-Agent 8192 ≥10g
Zwei gleichzeitige lange /v1/responses 1024012288 ≥1216g
docker run -d --name omniroute --restart unless-stopped --stop-timeout 40 \
  -e OMNIROUTE_MEMORY_MB=8192 --memory=10g \
  -p 127.0.0.1:20128:20128 -v omniroute-data:/app/data diegosouzapw/omniroute:latest

Vollständige Tabelle: Docker-Leitfaden — Laufzeit-RAM.

Docker-Kanal für Vorabversionen: diegosouzapw/omniroute:next und diegosouzapw/omniroute:next-web folgen dem aktuellen standardmäßigen release/v*- Branch. Diese veränderlichen Tags sind ausschließlich zum Testen unveröffentlichter Korrekturen vorgesehen und werden für den Produktionseinsatz nicht unterstützt. Siehe Docker-Veröffentlichungskanäle.

🥟 Bun

Die standardmäßige Installation mit bun install sowie die globale Installation (bun install -g omniroute) werden über die Bun-Laufzeiterkennung unterstützt:

  • Integriertes bun:sqlite: OmniRoute verwendet bei der Ausführung unter Bun dessen integrierten bun:sqlite-Treiber und greift unter Node.js auf better-sqlite3 oder sql.js zurück.
  • Automatische Auswahl des Webpack-Bundlers in der Entwicklungsumgebung: Die Entwicklungsumgebung (bun run dev) erkennt Bun automatisch und deaktiviert Turbopack zugunsten von Webpack, um Inkompatibilitäten mit nativen V8-Bindings zu vermeiden. Produktions-Builds (bun run build) folgen OMNIROUTE_USE_TURBOPACK genau wie unter Node: standardmäßig Turbopack, mit OMNIROUTE_USE_TURBOPACK=0 wird mit Webpack gebaut (Dockerfile.bun stellt dies als --build-arg bereit).
  • Dediziertes Bun-Dockerfile: Mehrstufiges Dockerfile.bun für native Bun-Produktionsbereitstellungen (docker build -f Dockerfile.bun -t omniroute:bun .).
# Mit Bun installieren und ausführen
bun install
bun run dev

🛠️ Aus dem Quellcode

cp .env.example .env && npm install
PORT=20128 npm run dev

📦 pnpm

pnpm add -g omniroute@latest --allow-build=better-sqlite3 --allow-build=@swc/core && omniroute

🐧 Arch Linux (AUR)

yay -S omniroute-bin && systemctl --user enable --now omniroute.service

🔧 Nix (Flake)

# Mit Nix-Flakes
nix develop
npm run dev

# Oder mit devbox
devbox run npm run dev

📖 Docker-Leitfaden — Compose-Profile, Caddy HTTPS, Cloudflare-Tunnel.

🦭 Podman

# 1. Das per Bind-Mount eingebundene Datenverzeichnis vorbereiten
mkdir -p data

# 2. Nur unter Linux + lokalem Rootless-Podman (niemals mit einem entfernten Podman-Machine-Client):
podman unshare chown 1000:1000 ./data

# 3. Den Laufzeithinweis festlegen, das lokale Compose-Image erstellen und starten
echo "CONTAINER_HOST=podman" >> .env
podman compose --profile base up -d --build

Unter macOS oder Windows verwendet Podman eine entfernte Podman Machine: Überspringen Sie podman unshare und befolgen Sie die topologiespezifischen Hinweise zum Datenverzeichnis.

📖 Podman-Leitfaden — Compose-Builds, Podman Machine und Linux/systemd-Quadlet-Einrichtung.

Schnellere / schlankere Installation (nativen Build überspringen)

Die native SQLite-Engine (better-sqlite3) ist eine optionale Abhängigkeit, daher wird eine globale Installation niemals durch die Kompilierung aus dem Quellcode blockiert: Sie verwendet ein vorkompiliertes Binärprogramm, wenn eines zu Ihrer Plattform/Node-Version passt, und greift andernfalls transparent auf eine reine JS-Engine zurück (node:sqlite unter Node 22+, andernfalls das mitgelieferte sql.js-WASM) — keine Build-Werkzeuge erforderlich.

So überspringen Sie die native Aufwärmphase nach der Installation vollständig (CI, Headless-Systeme oder langsame Rechner):

OMNIROUTE_SKIP_POSTINSTALL=1 npm install -g omniroute   # CI=1 überspringt sie ebenfalls

Für die schnellsten Installationen empfiehlt sich pnpm (inhaltsadressierter Speicher + Hardlinks — siehe oben). Für eine Headless-Laufzeitumgebung ohne Dashboard verwenden Sie das Docker-Profil base (siehe oben) oder den Termux-Leitfaden. Die CLI und das Web-Dashboard werden vom gleichen Prozess über einen einzigen Port bereitgestellt, daher gibt es derzeit kein separates reines CLI-Paket.


🎬 OmniRoute in Aktion

📹 Videoanleitungen

Momentaufnahme des Dashboards vom 2026-08-24 · Rohkatalog: YT 809 | TT 137 | IG 124 · Aktualität (Tage): YT 1 | TT 21 | IG 22

Instagram-Reel
🎬 #1 — Instagram
nick_saraev — 3,042,474 Aufrufe
Instagram-Reel — theopenstack
🎬 #2 — Instagram
theopenstack — 692,419 Aufrufe
TikTok — milesreevesai
🎬 #3 — TikTok
milesreevesai — 620,400 Aufrufe
YouTube — Vaibhav Sisinty
🎬 #4 — YouTube
Vaibhav Sisinty — 391,109 Aufrufe
Instagram-Reel — buildwithai.club
🎬 #5 — Instagram
buildwithai.club — 347,652 Aufrufe

Vollständige Rangliste (deduplizierte kanonische URLs, v > 0, größte Reichweite):

#1 #2 #3 #4 #5
nick_saraev — Instagram3,042,474 theopenstack — Instagram692,419 milesreevesai — TikTok620,400 Vaibhav Sisinty — YouTube391,109 buildwithai.club — Instagram347,652
#6 #7 #8 #9 #10
nivedan.ai — Instagram331,973 vaibhavsisinty — Instagram263,744 Nick Automates — YouTube Shorts218,174 theroshankrishna — Instagram186,786 midudev — TikTok177,800

Kanonische Kennzahlen vom 2026-08-24: 1.029 einzigartige Videos · 11.132.922 bekannte Aufrufe (v > 0) · 639 Kanäle/Profile nach Netzwerk. Das Roh-Dashboard enthält 1.070 Zeilen; 41 Instagram-Duplikate wurden anhand der kanonischen URL normalisiert, wobei die höchste Aufrufzahl pro Video beibehalten wurde.

🎬 Du hast ein Video über OmniRoute erstellt? Eröffne ein Issue oder eine Diskussion mit dem Link — wir stellen es hier vor.


📧 Community & Hilfe

Alles an einem Ort — folge dem Maintainer, chatte mit der Community oder eröffne ein Issue.

Kanal Wo / wie
💼 LinkedIn — dem Maintainer folgen linkedin.com/in/diegosouzapw
🐙 GitHub — für Releases & Tipps folgen @diegosouzapw
💬 Discord discord.gg/U47eFqAXCn
✈️ Telegram t.me/omnirouteOficial
🟢 WhatsApp — 🌍 Global der Gruppe beitreten
🟢 WhatsApp — 🇧🇷 Brasilien der Gruppe beitreten
🌍 Website omniroute.online
🌍 🌍StHub OmniRoute-Community (kostenlos) StHub-Portal
📦 Quellcode github.com/diegosouzapw/OmniRoute
🐛 Fehler melden Issue erstellen — Ausgabe von npm run system-info anhängen
🤝 Mitwirken CONTRIBUTING.md · Branching- & Release-Modell · ein good first issue auswählen
💚 Das Projekt unterstützen Möglichkeiten zur Unterstützung ↑ · GitHub Sponsors


🛠️ Technologie-Stack

SchichtTechnologie
LaufzeitumgebungNode.js 22.x / 24.x LTS — >=22.22.2 <23 || >=24.0.0 <27
SpracheTypeScript 6.0 — 100 % TypeScript in src/ und open-sse/ (seit v2.0 kein any im Kern)
FrameworkNext.js 16 + React 19 + Tailwind CSS 4
Datenbankbetter-sqlite3 (SQLite, WAL-Journaling) + LowDB (JSON-Altsystem) — 122 Domänenmodule, 176 Migrationen
SpeicherSQLite-FTS5-Volltextsuche + int8-quantisierte Vektoreinbettungen, typisierter Verfall
SchemataZod 4 — Validierung der Ein- und Ausgaben von MCP-Tools + API-Verträge
ProtokolleMCP (stdio / HTTP / SSE) + A2A v0.3 (JSON-RPC 2.0 + SSE)
StreamingServer-Sent Events (SSE) + WebSocket-Bridge (/v1/ws)
KomprimierungPipeline mit 12 Engines — RTK, Caveman, LLMLingua-2 (MobileBERT ONNX), GCF, OmniGlyph
Authentifizierung & SicherheitOAuth 2.0 (PKCE) + JWT + API-Schlüssel + bereichsgebundene MCP-Authentifizierung · AES-256-GCM für ruhende Daten · DOMPurify
Tarnungwreq-js — Nachahmung von JA3-/JA4-TLS-Fingerabdrücken, dreistufiger Proxy
AusfallsicherheitSchutzschalter, exponentieller Backoff, Schutz vor Anfragelawinen, selbstheilende automatische Kombinationen
Protokollierungpino — strukturierte JSON-Protokolle mit Anfragekontext
TestsNode.js-Test-Runner + Vitest — mehr als 39.000 statische Testdeklarationen in mehr als 5.100 nachverfolgten Testdateien (Unit-, Integrations-, E2E-, Sicherheits- und Ökosystemtests)
PlattformenDesktop (Electron) · Android (Termux) · PWA (beliebiger Browser)
CI/CDGitHub Actions — automatische Veröffentlichung auf npm und Docker Hub bei Releases
LinksWebsite · npm · Docker Hub

📖 Dokumentation

📘 Erste Schritte

DokumentBeschreibung
BenutzerhandbuchAnbieter, Kombinationen, CLI-Integration, Bereitstellung
EinrichtungsanleitungAlle Installationsmethoden, Konfigurationen für CLI-Tools, Protokolleinrichtung, Timeout-Optimierung
Leitfaden für CLI-ToolsToolspezifische Einrichtung für Claude Code, Codex, Cursor, Cline, OpenClaw, Kilo, Copilot
Remote-ModusEine entfernte OmniRoute-Instanz (VPS) über die CLI Ihres Laptops mithilfe bereichsgebundener Zugriffstoken steuern
Claude-Code-KonfigurationClaude Code über launch und modellspezifische Profile mit OmniRoute (lokal/remote) verbinden
SchnellstartInstallation in 3 Schritten → verbinden → konfigurieren

🔧 Betrieb und Bereitstellung

DokumentBeschreibung
Docker-LeitfadenDocker-Ausführung, Compose-Profile, Caddy HTTPS, Tunnel, Image-Tags
Podman-LeitfadenQuadlet-systemd-Integration, podman-compose, SELinux
VM-BereitstellungVollständiger Leitfaden: Einrichtung von VM + nginx + Cloudflare
Fly.io-BereitstellungBereitstellung auf Fly.io mit persistentem Speicher
Termux-LeitfadenOmniRoute über Termux unter Android ausführen
PWA-LeitfadenInstallation, Caching und Architektur der Progressive Web App
DeinstallationsanleitungSaubere Entfernung für alle Installationsmethoden
UmgebungskonfigurationVollständige .env-Variablen und Referenzen

🧠 Funktionen und Architektur

DokumentBeschreibung
ArchitekturSystemarchitektur, Datenfluss und interne Abläufe
KomprimierungsleitfadenPipeline mit 7 Optionen: aus / leicht / standard / aggressiv / ultra / RTK / gestapelt
RTK-KomprimierungKomprimierung von Befehlsausgaben, Filter, Vertrauensprüfung, Verifizierung, Wiederherstellung der Rohausgabe
Komprimierungs-EnginesCaveman, RTK, gestapelte Pipelines, Dashboard-/API-/MCP-Oberflächen
Format der KomprimierungsregelnJSON-Regelpaketschemas für Caveman- und RTK-Filter
Sprachpakete für die KomprimierungSpracherkennung und Erstellung von Caveman-Regelpaketen
ResilienzleitfadenLeistungsschalter, Abkühlzeiten, Warteschlange, Schutz vor Anfragestürmen, TLS-Spoofing
Auto-Combo-EngineBewertung anhand von 16 Faktoren, Moduspakete, Selbstheilung
Proxy-Leitfaden3-stufiges Proxy-System, 1proxy-Marktplatz, Registry-CRUD
Kostenlose KontingenteKonsolidiertes Verzeichnis: 34 dokumentierte wiederkehrende Pools / 452 katalogisierte Einträge mit kostenlosem Kontingent
FunktionsübersichtVisuelle Dashboard-Tour mit Screenshots
Codebasis-DokumentationEinsteigerfreundlicher Rundgang durch die Codebasis

🤖 Protokolle und APIs

DokumentBeschreibung
API-ReferenzAlle Endpunkte mit Beispielen
OpenAPI-SpezifikationOpenAPI-3.0-Spezifikation
MCP-Server110 MCP-Tools, IDE-Konfigurationen, Python-/TS-/Go-Clients
MCP-Server-LeitfadenMCP-Installation, Transportmethoden und Tool-Referenz
A2A-ServerJSON-RPC-2.0-Protokoll, Fähigkeiten, Streaming, Aufgabenverwaltung
A2A-Server-LeitfadenA2A-Agentenkarte, Aufgaben, Fähigkeiten und Streaming

📋 Projekt und Qualität

DokumentBeschreibung
MitwirkenEinrichtung der Entwicklungsumgebung und Richtlinien
Branching- und Release-ModellAuf welche Branches PRs abzielen (release/*) und was main und Tags bedeuten
ÄnderungsprotokollVollständiger Release-Verlauf nach Version
SicherheitsrichtlinieMeldung von Schwachstellen und Sicherheitspraktiken
i18n-LeitfadenUnterstützung für 42 Sprachen, Übersetzungsworkflow, RTL
Release-ChecklisteValidierungsschritte vor dem Release
AbdeckungsplanTestabdeckungsstrategie für über 39.000 statische Testdeklarationen in über 5.100 erfassten Testdateien

Wichtigste Mitwirkende

OmniRoute wird von einer engagierten Open-Source-Community geprägt. Diese Personen haben außergewöhnliche Beiträge geleistet, die sich direkt auf die Qualität, Stabilität und Reichweite des Projekts auswirken. Vielen Dank.

Externe Mitwirkende nach zusammengeführten Pull Requests

RangMitwirkendeZusammengeführte PRs~Geänderte Zeilen
1backryun190227,977
2oyi77180407,678
3rdself14580,663
4JxnLexn128387,049
5KooshaPari101125,747
6herjarsa88230,872
7RaviTharuma7955,106
8maxmad64bis69394,715
9artickc5933,260
10HouMinXi5147,334
10chirag127515,153
12xz-dev50245,976
13hartmark4752,185
14rqzbeh39143,181
15dhaern3419,559
16Dingding-leo331,986
17NomenAK3213,854
18MumuTW3016,953
19benzntech2911,641
20pacocartones249,331
20Prudhvivuda246,312

Stand des aktiven release/v3.8.50-Heads dafb4ae808, einschließlich Merges bis zum 2026-08-24 05:26:03 UTC. Die paginierte GitHub-GraphQL-Erhebung umfasst 5.911 zusammengeführte PRs: 2.707 vom Repository-Eigentümer, 179 von Dependabot und 3.025 externe PRs von 535 verschiedenen Mitwirkenden. „Geänderte Zeilen“ entspricht den GitHub-Additionen und -Löschungen und umfasst generierte Dateien, Lockfiles, Kataloge, Übersetzungen und Dokumentation; die Zahl gibt die Änderungsmenge und nicht die selbst verfassten Quellcodezeilen an. Gleichstände an der Aufnahmegrenze werden beibehalten.

Von GitHub zugeordnete Commits

backryun
backryun

🥇 220 von GitHub zugeordnete Commits
Paijo
Paijo

🥈 219 von GitHub zugeordnete Commits
Randi
Randi

🥉 108 von GitHub zugeordnete Commits
Ravi Tharuma
Ravi Tharuma

🏅 81 von GitHub zugeordnete Commits
Chris
Chris

🏅 70 von GitHub zugeordnete Commits
Markus Hartung
Markus Hartung

🏅 69 von GitHub zugeordnete Commits · geteilter 6. Platz
Dizzle
Dizzle

🏅 69 von GitHub zugeordnete Commits · geteilter 6. Platz
Jan Leon
Jan Leon

🏅 64 von GitHub zugeordnete Commits
zenobit
zenobit

🏅 62 von GitHub zugeordnete Commits
Bob.Hou
Bob.Hou

🏅 51 von GitHub zugeordnete Commits · geteilter 10. Platz
Xiangzhe
Xiangzhe

🏅 51 von GitHub zugeordnete Commits · geteilter 10. Platz

Erneut überprüft am 2026-08-24 um 06:14:31 UTC: von GitHub zugeordnete Commits, die von der Contributors API des Repositorys für den Standard-Branch release/v3.8.50 gemeldet wurden. Die API lieferte 525 Identitäten zurück (415 Benutzer, 2 Bots, 108 anonyme); diese Tabelle schließt den Maintainer, Bots und anonyme Identitäten aus und berücksichtigt geteilte Platzierungen. Sie unterscheidet sich sowohl von der Rangliste der zusammengeführten PRs oben als auch von der auf Git-Metadaten basierenden Erhebung mit 639 Personen unten.

🙏 Die Funktionen, Fehlerbehebungen und Infrastrukturverbesserungen dieser Mitwirkenden sind ein wesentlicher Bestandteil dessen, was OmniRoute zuverlässig und funktionsreich macht. Jeder Pull Request, jeder Testfall und jede i18n-Übersetzungsdatei zählt. Open Source wird von Menschen wie ihnen geschaffen.



💖 Sponsoren

Ein herzliches Dankeschön an die Menschen, die OmniRoute aus eigener Tasche finanzieren — jeder Beitrag sorgt dafür, dass das Projekt kostenlos, unabhängig und in Bewegung bleibt.

Andrew
Andrew

💛 Aktiver monatlicher Sponsor
Vlad I
Vlad I

💛 Aktiver monatlicher Sponsor
Paco Cartones
Paco Cartones

💛 Aktiver einmaliger Sponsor
Professor Igor Morais Vasconcelos
Prof. Igor Morais

💛 Ehemaliger einmaliger Unterstützer
longtao
longtao

💛 Ehemaliger einmaliger Unterstützer

… und weitere Personen, die lieber anonym bleiben 💛

Öffentliche GitHub-Sponsoren wurden am 2026-08-24 erneut validiert. Der activeOnly-Status von GitHub bestimmt die oben aufgeführten Aktiv-Kennzeichnungen; zuvor offengelegte öffentliche einmalige Unterstützer werden weiterhin gewürdigt, und private Sponsoren bleiben anonym.

💖 Sponsor werden → — jeder Dollar trägt dazu bei, dass OmniRoute kostenlos und unabhängig bleibt.


👥 Über 600 Mitwirkende

Mitwirkende

Geprüft am 2026-08-24 auf der eingefrorenen Basis ac02c5b42f und erneut an der aktuellen Spitze von release/v3.8.50 mit dafb4ae808 überprüft: 639 normalisierte menschliche Git-Identitäten — 407 erscheinen als Commit-Autoren (einschließlich des Maintainers) und 232 ausschließlich in expliziten Co-authored-by-Trailern. Die Erhebung normalisiert GitHub-Noreply-Handles, schließt 26 Bot-, Agenten-, Dienst- oder Platzhalteridentitäten aus und führt gewöhnliche E-Mail-Adressen nicht allein deshalb zusammen, weil ihre Anzeigenamen übereinstimmen.

So können Sie beitragen

  1. Forken Sie das Repository
  2. Erstellen Sie Ihren Branch von der Spitze des aktiven release/vX.Y.Z-Branches (nicht von main) — siehe Branching- und Release-Modell
  3. Erstellen Sie Ihren Feature-Branch (git checkout -b feat/amazing-feature)
  4. Committen Sie Ihre Änderungen (git commit -m 'feat: add amazing feature')
  5. Pushen Sie in den Branch (git push origin feat/amazing-feature)
  6. Öffnen Sie einen Pull Request mit base = diesem release/vX.Y.Z-Branch

Ausführliche Richtlinien finden Sie in CONTRIBUTING.md.

Veröffentlichung einer neuen Version

# Release erstellen — npm publish erfolgt automatisch
VERSION=x.y.z
gh release create "v${VERSION}" --title "v${VERSION}" --generate-notes

📊 Sterne

Diagramm des Sterneverlaufs

🌍 StarMapper

StarMapper

🙏 Danksagungen

OmniRoute steht auf den Schultern von Giganten. Es begann als Fork von 9router und als TypeScript-Portierung des Go-Projekts CLIProxyAPI — und von da an wurde jedes der unten aufgeführten Subsysteme von einem Open-Source-Projekt inspiriert, das diesen Weg bereits zuvor beschritten hatte. Jedes davon hat einen konkreten Teil von OmniRoute geprägt. Dies ist unser Dank an sie alle. 🙏

Die Anzahl der Sterne wurde am 24. August 2026 über die REST API von GitHub verifiziert — gebt diesen Projekten einen Stern. Die Angaben sind eine exakte, datierte Momentaufnahme und werden sich selbstverständlich ändern.

🧬 Abstammung & Gateway

ProjektWie es OmniRoute inspiriert hat
9router26,161Das ursprüngliche Projekt, auf dem dieser Fork basiert — hier um multimodale APIs erweitert und vollständig in TypeScript neu geschrieben.
CLIProxyAPI48,497Die Go-Implementierung, die als Inspiration für diese JavaScript-/TypeScript-Portierung diente.
LiteLLM57,100Das KI-Gateway, dessen öffentlicher Preisdatenbestand unsere Synchronisierung zur Kostenverfolgung speist und dessen Modell zur Anbieter-Normalisierung unser Routing geprägt hat.
codex-chatgpt-web1,410MIT-lizenzierter Quellcode, der für die integrierte Brücke von ChatGPT Web zu Codex Responses angepasst wurde, einschließlich Adaptern für Browsersitzungen, Antwortformatierung, Nutzung und Websuche.
free-claude-code48,112Muster, die in die Stream-Wiederherstellung, Aliasse ohne Denkmodus, die ersatzweise Websuche, Sliding-Window-Limits, die Schwärzung von Protokolldaten und gehärtete Startabläufe portiert wurden.
composer-api322Muster von Cursor Composer für Werkzeugauswahl, Ausgabebeschränkungen und Werkzeugübermittlung, die für den nativen Cursor-Executor angepasst wurden.
codex-multi-auth457Muster für Neuanmeldung und Refresh-Token-Rotation, die in die erneute Codex-OAuth-Authentifizierung portiert wurden.
opencode-anthropic-auth510Claude-Code-kompatible Transformationsvorgaben und das Verhalten von Abrechnungs-Headern, die in OmniRoutes konfigurationsgesteuerter Brücke verallgemeinert wurden.
grok2api-merged2Seine Grok-Modellzuordnungen, der Fake-TypeError-Statsig-Generator, Anfrage- und Gerätevorgaben sowie der NDJSON-Antwortprozessor wurden in wesentlichem Umfang für OmniRoutes Grok-Web-Executor angepasst.
TQZHR/grok2api705Die wichtigste transitive Codequelle hinter grok2api-merged; ihre Implementierungen für Modelle, Header, Nutzlasten, Statsig und Prozessoren bleiben in der Entwicklungslinie von Grok Web erhalten.
chenyme/grok2api7,520Der zugrunde liegende MIT-lizenzierte Quellcode für Grok-Nutzlast- und Gerätevorgaben, den Statsig-Generator und den über TQZHR und grok2api-merged übernommenen result.response-Prozessor.
grok2api-pro27Eine transitive Quelle, die von grok2api-merged für dessen Proxy-Pool-Schicht genannt wird; OmniRoute bewahrt diesen Herkunftshinweis, beansprucht jedoch keine Portierung des Proxy-Pools in seinem klar abgegrenzten Grok-Web-Executor.
GrokProxy50Sein Cookie-authentifizierter Grok-Proxy und sein Streaming-Muster mit result.response.token dienten als Grundlage für OmniRoutes Grok-Web-Transport.
GrokBridge5Bei der ursprünglichen Grok-Web-Implementierung wurde dessen HTTP-/Browser-Upstream-Design herangezogen; da sein direkter HTTP-Pfad von GrokProxy abgeleitet ist, wird keine eigenständige Codeportierung beansprucht.
grok-web-api14Seine Rust-Schemas für ChatOptions und Antwortumschläge dienten als Grundlage für OmniRoutes TypeScript-Typen für Grok-Anfragen und Streaming-Antworten.

🗜️ Kontext- und Token-Komprimierung — Engines

ProjektWie es OmniRoute inspiriert hat
Caveman100,538Das virale „warum viele Token verwenden, wenn wenige Token reichen“-Projekt — seine Höhlenmenschen-Sprech-Philosophie bildet die Grundlage unseres Standardkomprimierungsmodus und von mehr als 30 Regeln zur Entfernung von Füllwörtern und zur Verdichtung.
RTK Rust Token Killer77,185Hochleistungsfähige Komprimierung von Befehlsausgaben — inspirierte unsere RTK-Engine, die JSON-Filter-DSL, die Wiederherstellung von Rohausgaben und die gestapelte RTK-→-Caveman-Pipeline.
headroom67,310Reversible Kontextkomprimierung (SmartCrusher) — inspirierte unsere headroom-Engine und das ccr-Abrufmarkermuster.
LLMLingua6,598Forschung zur Prompt-Komprimierung (LLMLingua / LLMLingua-2) — inspirierte unsere asynchrone, codesichere und nach dem Fail-open-Prinzip arbeitende llmlingua-Engine.
llmlingua-2-js31Der JS/ONNX-Port (MobileBERT / XLM-RoBERTa), der als Worker-Thread-Backend für unsere LLMLingua-Engine verwendet wird.
Troglodita40PT-BR-Tokenkomprimierung — bildet die Grundlage unseres pt-BR-Sprachpakets: Reduzierung von Pleonasmen und Entfernung von Füllwörtern, abgestimmt auf die brasilianisch-portugiesische Grammatik.
ponytail108,957Der virale „faule Senior-Entwickler“-YAGNI-Coder-Skill — inspirierte unseren less-code-Ausgabestil: Ausrichtung auf die kleinstmögliche funktionierende Änderung, die den _generierten_ Code reduziert (das Pendant auf der Ausgabeachse zu Cavemans knapper Prosa).
i-have-adhd23,526Sein handlungsorientierter, ADHS-freundlicher Antwortstil wurde für OmniRoutes prägnanten Ausgabestil in fünf Sprachen adaptiert.

🧩 Kompakte Formate, Token-Forschung & codebewusste Werkzeuge

ProjektWie es OmniRoute inspiriert hat
TOON25,233Token-Oriented Object Notation — sein spaltenorientiertes Modell aus Kopfzeile und Zeilen prägte unsere tabellarische Komprimierungsstufe.
GCF Graph Compact Format41Sein kompaktes Graphformat und das generische Profildesign flossen in OmniRoutes tabellarische Komprimierung und das Headroom-Codec-Format ein.
gcf-typescript4Die MIT-TypeScript-Implementierung, die direkt eingebunden und als generischer Headroom-Profil-Codec erweitert wurde.
token-optimizer-mcp494Brotli/SQLite-Cache + sitzungsbezogene Kontextdeltas — inspirierte unsere session-dedup-Engine.
token-savior1,122Komprimierung von Bash-Ausgaben + MCP-Profile — inspirierte unsere disziplinierte Abbruchstrategie bei der Komprimierung und die Reduzierung von MCP-Werkzeugmanifesten.
token-saver138Inhaltsabhängige Ausgabekomprimierung pro Dateityp mit fehlertoleranter Abbruchstrategie — bestätigte unsere typabhängige Weiterleitung und das Überspringen bei zu geringem Gewinn.
token-optimizer1,951„Finde die Geister-Token“ — sein Muster aus Auslagerung und wiederherstellbarem Handle prägte unsere Überlegungen zur CCR-Auslagerung.
TokenMizer28Eine Blaupause aus Sitzungsgraph und rundenübergreifender Zeilendeduplizierung, die unser session-dedup-Design prägte.
OmniCompress3Spaltenorientiertes JSON in Rust + inhaltsadressierter Abruf + nachrichtenübergreifende Deduplizierung — bestätigte das Design unserer headroom/ccr/session-dedup-Engines und die cache-stabile Invariante „die komprimierte Form ist positionsunabhängig“.
mcp-compressor113Komprimierung von MCP-Werkzeugschemata und -beschreibungen — floss in unsere Kardinalitätsreduktion von MCP-Werkzeugmanifesten ein.
RepoMapper197Repository-Karten-Rangfolge im Aider-Stil — floss in unsere Erkundung von Repository-Karten und Abrufrangfolgen ein.
quiet-shell-mcp4Deklarative Reduzierung von Shell-Ausgaben über MCP — bestätigte unsere deklarative Komprimierung von Bash-Ausgaben.
ts-morph6,162Toolkit für die TypeScript Compiler API — inspirierte unsere parserbasierte Entfernung von Kommentaren, bei der String-, Template- und Regex-Literale erhalten bleiben.

🧠 Speicher & RAG

ProjektWie es OmniRoute inspiriert hat
Mem063,902Universelle Speicherschicht — ihr Proxy-Modell als Schreib-/Lesegrenze prägte unsere Speicherarchitektur.
Letta (MemGPT)24,382Zustandsbehaftete Agenten mit mehrstufigem Speicher — inspirierten unser mehrstufiges Modell für Context Control & Recovery (CCR).
WFGY1,781Die ProblemMap-Taxonomie von 16 wiederkehrenden RAG-/LLM-Fehlermodi — das gemeinsame Vokabular in unserem Leitfaden zur Fehlerbehebung.

🛰️ Datenverkehrsanalyse, MITM & transparenter Proxy

ProjektWie es OmniRoute inspiriert hat
llm-interceptor66Die MITM-Überwachung/-Analyse des Datenverkehrs zwischen Programmierassistenten und LLMs floss in die frühen Anforderungen an den Traffic Inspector ein. Vier zuvor abgeleitete Module — SSE-Zusammenführung, Konversationsnormalisierung, Maskierung geheimer Daten und Header-Bereinigung — wurden durch unabhängige Clean-Room-Implementierungen ersetzt, die auf öffentlichen Protokollstandards basieren. Die beiden Oberflächen für Host-Passthrough (passthrough.ts und _internal/bypass.cjs) bleiben interne OmniRoute-Implementierungen, die unabhängig klassifiziert sind; sie wurden im Rahmen dieser Ersetzung nicht neu geschrieben.
ProxyBridge5,995Transparente, prozessbezogene Proxy-Weiterleitung — inspirierte unseren absturzsicheren MITM-Abbau, Socket-Leerlaufzeitüberschreitungen, die Prozesszuordnung über /proc und die TPROXY-Erfassung.

📚 Modelldaten, Observability & Benutzeroberfläche

ProjektWie es OmniRoute inspiriert hat
models.dev6,555Offene Datenbank mit Spezifikationen, Preisen und Fähigkeiten von KI-Modellen — wird nativ mit unserem Modellkatalog synchronisiert.
React Flow / xyflow38,108Die knotenbasierte Graphbibliothek, auf der unser Compression Studio und Combo/Routing Studio in Echtzeit basieren.
LangGraph40,314Die Live-Visualisierung von Workflow-Graphen in LangGraph Studio inspirierte die Echtzeit-Kaskadenansicht unserer Studios.
Langfuse33,592Sein Observability-Modell „Trace → Span → Generation“ prägte die Wasserfallansicht unseres Compression Studio.
Kiali3,631Observability für Istio-Service-Meshes — inspirierte unsere Circuit-Breaker-Badges und die visuelle Darstellung von Fehlerkanten im Routing/Combo Studio.
lobe-icons2,428KI-/LLM-Markenlogos, die zur Darstellung der Anbieter-Symbole in unserem Dashboard dienen.
flag-icons12,354Stellt die MIT-lizenzierten SVG-Flaggen bereit, die von der Sprachauswahl in der README verwendet werden.

🛡️ Sicherheit

ProjektWie es OmniRoute inspiriert hat
awesome-secure-defaults721Eine kuratierte Liste standardmäßig sicherer Bibliotheken, die unsere Sicherheitsentscheidungen leitet (Helmet.js, DOMPurify, ssrf-req-filter, safe-regex, Google Tink).

🧭 Ergänzende Werkzeuge

ProjektWie es OmniRoute inspiriert hat
ClawRouter6,564Inspirierte die Deduplizierung von Anfragen, einen kostenlosen Notfall-Fallback, austauschbare Auto-Combo-Strategien und die mehrsprachige Absichtsklassifizierung.
Antigravity-Manager30,652Seine kontobasierte Modellneuzuordnung, die Validierung ausführbarer Pfade und das Verhalten von Tarifbezeichnungen flossen in die Antigravity-Laufzeitumgebung von OmniRoute ein.
vscode-antigravity-cockpit4,817Sein kompaktes Countdown-Format für das Zurücksetzen von Kontingenten inspirierte die entsprechende Anzeige von Anbieterlimits in OmniRoute.
AionUi32,230Seine ACP-Integrationen inspirierten die automatische Erkennung installierter CLI-Agenten durch OmniRoute.
CodexBar20,507Identifizierte die Grok-Build-Kontingentschnittstelle; OmniRoute überprüfte und korrigierte anschließend das aktuelle Übertragungsformat unabhängig.

📄 Lizenz

MIT-Lizenz Details finden Sie unter LICENSE.


⬆ Zurück nach oben · Mit ❤️ für die Open-Source-KI-Community entwickelt.

OmniRoute v3.8.51 · Node ≥22.22.2 · MIT-Lizenz · omniroute.online