1,104 mirrors rewritten over five passes of run-translation on the 22-source core set: the 14 sources edited since their translation, the 322 mirrors that were still English copies, and the frontmatter the old extractor leaked into the newer locales' bodies. The pipeline now caches per-`## `-section hashes and retranslates only changed sections, never reuses a section that is still English, rebuilds English-copy / leaked mirrors even when the source is unchanged, merges the state on save (parallel runs), and the drift gate (scoped to the core set) is blocking. Final audit: 0 stale, 0 English copies, 0 leaked frontmatter across 1,430 core mirrors. ⚠️ base-red inherited: #12732
README (Deutsch)
🌐 Languages: 🇺🇸 English · 🇪🇹 am · 🇸🇦 ar · 🇦🇿 az · 🇧🇬 bg · 🇧🇩 bn · 🇨🇿 cs · 🇩🇰 da · 🇬🇷 el · 🇪🇸 es · 🇪🇪 et · 🇮🇷 fa · 🇫🇮 fi · 🇫🇷 fr · 🇮🇪 ga · 🇮🇳 gu · 🇳🇬 ha · 🇮🇱 he · 🇮🇳 hi · 🇭🇷 hr · 🇭🇺 hu · 🇦🇲 hy · 🇮🇩 id · 🇳🇬 ig · 🇮🇹 it · 🇯🇵 ja · 🇬🇪 ka · 🇰🇭 km · 🇮🇳 kn · 🇰🇷 ko · 🇱🇹 lt · 🇱🇻 lv · 🇮🇳 ml · 🇮🇳 mr · 🇲🇾 ms · 🇲🇹 mt · 🇲🇲 my · 🇳🇵 ne · 🇳🇱 nl · 🇳🇴 no · 🇮🇳 or · 🇮🇳 pa · 🇵🇭 phi · 🇵🇱 pl · 🇵🇹 pt · 🇧🇷 pt-BR · 🇷🇴 ro · 🇷🇺 ru · 🇱🇰 si · 🇸🇰 sk · 🇸🇮 sl · 🇷🇸 sr · 🇸🇪 sv · 🇰🇪 sw · 🇮🇳 ta · 🇮🇳 te · 🇹🇭 th · 🇹🇷 tr · 🇺🇦 uk-UA · 🇵🇰 ur · 🇺🇿 uz · 🇻🇳 vi · 🇳🇬 yo · 🇨🇳 zh-CN · 🇹🇼 zh-TW
💰 ~1,47 Mrd. kostenlose Tokens / Monat
Kostenlose Kontingente manuell zu kombinieren ist mühsam — Dutzende SDKs, Dutzende Ratenlimits und keine Ahnung, wie viel tatsächlich verfügbar ist. OmniRoute katalogisiert 452 Einträge mit kostenlosem Kontingent über 34 wiederkehrende Pool-Schlüssel hinweg und berechnet die angegebene Token-Gesamtmenge aus den 16 Pools mit einem veröffentlichten positiven monatlichen Budget sowie fünf modellspezifischen Groq-Obergrenzen, wobei gemeinsam genutzte Pools dedupliziert werden. Kontingente, die erst nach einer regionalen Identitätsprüfung verfügbar werden (derzeit: ModelScope), werden separat ausgewiesen: +~6 Mio. hinter einer regionalen Identitätsprüfung. Sie werden niemals zur Gesamtmenge hinzugerechnet. Das Ergebnis bleibt im Dashboard (
/dashboard/free-tiers) sichtbar.
Animierte Zusammenfassung der Live-Seite
/dashboard/free-tiers. Vollständige Methodik (Pool-Deduplizierung, Guthabenstufen, Anbieterbedingungen): docs/reference/FREE_TIERS.md.Diese Zahlen werden alle zwei Wochen erneut anhand des Live-Katalogs geprüft und können sich in beide Richtungen verändern — beendet ein Anbieter sein kostenloses Kontingent, sinkt die Zahl; kommt ein neues hinzu, steigt sie. Wir veröffentlichen, was der Katalog tatsächlich berechnet, und niemals einen aufgerundeten Bestwert.
⭐ Gib dem Repository einen Stern, wenn OMNIROUTE dir geholfen hat, Geld zu sparen und deine Arbeit zu erleichtern.
💬 Tritt der Community bei
👋 Folge dem Maintainer — erfahre als Erstes von neuen Anbietern, Releases und Tipps:
Fragen, Anbietertipps, Roadmap und Support → Discord · Telegram · WhatsApp 🌍 Global / 🇧🇷 Brasilien / Portal
📈 Das Gateway wächst weiter
| v3.8.49 | v3.8.50 | v3.8.51+ |
|
|---|---|---|---|
| 🌐 Anbieter | 290 | 352 | weitere vorgemerkt |
| 🧠 Eindeutige Chatmodell-IDs | 1185 | 1312 | — |
| 🖼️ Modalitätsbrücke | — | 🆕 Bild + Audio + Video | — |
| 📡 Kostenloser Radar-Katalog | — | 🆕 optional aktivierbar | — |
| ⚖️ Kontingentabhängige Planung | — | 🆕 Quota-Share | — |
| 📊 Kontingenttelemetrie | — | 🆕 in Echtzeit | — |
→ Roadmap — auf direktem Weg zu v3.9.0 LTS
🧩 Verfügbar
| 🚀 Start | 🚀 Schnellstart | 📦 Installation | 🆓 Keine Konfiguration |
| 💡 Lernen | 💥 Das Versprechen | 🤔 Warum OmniRoute? | 🏆 Was OmniRoute auszeichnet |
| ⚙️ Funktionen | 🎯 Combos | 🌐 Anbieter | 🔌 CLI & MCP |
| 🗜️ Komprimierung | 🖥️ Wo es läuft | 🔒 Privat | |
| 👀 Ansehen | 🎬 Im Einsatz | ✨ Neuigkeiten | 🤖 Kompatible CLIs |
| 💚 Unterstützen | 💚 Unterstützen / Spenden | 💬 Community | 💖 Sponsoren |
| 📦 Projekt | 🛠️ Technologie-Stack | 📖 Dokumentation | 👥 Mitwirkende |
🆓 Funktioniert sofort nach der Installation — keine Schlüssel, keine Konfiguration
# Frische Installation, keine Zugangsdaten — `auto` funktioniert bereits:
curl http://localhost:20128/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{"model":"auto","messages":[{"role":"user","content":"Hello!"}]}'
Bevorzugst du ein bestimmtes kostenloses Backend? Rufe oc/… (OpenCode Free) direkt auf. Wechsle anschließend zu auto und überlasse OmniRoute die Auswahl.
📦 Kopierfertige Schnellstartskripte für Python, Node.js, PHP und cURL → examples/quickstart/
💥 Das Versprechen
🤔 Warum OmniRoute?
🤝 Unterstützt von unseren Open-Source-Freunden
Möchten Sie Open-Source-Freund werden? Dies sind die Unternehmen, die Open Source unterstützen und dazu beitragen, OmniRoute voranzubringen — und wir legen öffentlich offen, wofür jeder Token verwendet wird, den sie uns zur Verfügung stellen. Kontaktieren Sie uns: diegosouza.pw@outlook.com
|
Kimi Moonshot AI |
Vielen Dank an Kimi (Moonshot AI), unseren ersten Open-Source-Freund, für die Unterstützung dieses Projekts! Kimi ist das KI-Labor hinter den Open-Weight-Modellfamilien K2 und K3 — Kimi K3 bietet ein Kontextfenster mit 1 Million Tokens, native Bildverarbeitung und Programmierfähigkeiten auf Spitzenniveau zu einem Bruchteil der Preise geschlossener Modelle und funktioniert sofort mit Claude Code, Codex und jedem von OmniRoute unterstützten Programmierwerkzeug.
Was durch Kimis Unterstützung ermöglicht wird: Kimis API-Guthaben finanzieren die KI-validierte Release-Pipeline von OmniRoute — die Phase Merge-Validierung mit Kimi K3, die jeden Pull Request vor der Veröffentlichung überprüft — sowie die tägliche Funktionsentwicklung. Erstklassige Kimi-Unterstützung wird auf beiden Wegen bereitgestellt: über die direkte Kimi API ( kimi-k3) und den Kimi Code-Programmiertarif (OAuth und API-Schlüssel). OmniRoute ist außerdem das erste brasilianische Open-Source-Projekt im Förderprogramm von Kimi. Holen Sie sich einen Kimi-API-Schlüssel mit 15 % zusätzlichem Guthaben →
|
|
Cheaper Inference cheaperinference.com |
Vielen Dank an Cheaper Inference, einen Open-Source-Freund von OmniRoute, für die Unterstützung dieses Projekts! Cheaper Inference ist ein nach Kosten geordnetes Gateway, das 42 Spitzenmodelle — Claude, GPT-5.x, Gemini, Kimi K3, GLM, DeepSeek, Grok und MiniMax — über einen einzigen OpenAI-kompatiblen Endpunkt weiterverkauft und jede Anfrage an den günstigsten geeigneten Anbieter weiterleitet, ohne jemals mehr als den Listenpreis des Modellherstellers zu berechnen.
Erstklassige Unterstützung in OmniRoute: Chat Completions, der native Endpunkt /v1/responses, Bildverarbeitung, Tool-Aufrufe und 3 Bildmodelle (grok-imagine, nano-banana-pro, nano-banana-2, erreichbar als cheaperinference/<model>). API-Schlüssel anfordern →
|
Mit aff=omniroute gekennzeichnete Links sind Partnerlinks. Sie finanzieren das Projekt, ohne dass Ihnen zusätzliche Kosten entstehen.
🎟️ Partneraktionen — kostenlose Anmeldegutscheine von Anbietern, die uns nicht sponsern (zum Aufklappen klicken)
Dieser Abschnitt ist ausschließlich für Empfehlungs- und Gutscheincodes vorgesehen. Gesponserte Partnerschaften finden Sie oben unter 🤝 Unterstützt von unseren Open-Source-Freunden. OmniRoute unterhält keine Sponsoring- oder Partnerschaftsbeziehung mit den hier aufgeführten Anbietern — dies sind öffentliche Gutscheine, die jeder nutzen kann.
|
AgentRouter agentrouter.org |
AgentRouter — Anmeldung über Partnerlink · $100 kostenloses Guthaben bei der Anmeldung (kostenloser Server, höhere Latenz zu erwarten — am besten zum Testen geeignet, nicht für den Produktivbetrieb). Erstklassige Unterstützung in OmniRoute seit v3.8.50: Chat Completions, das Anthropic-kompatible Übertragungsformat und der OpenAI-kompatible Pfad. Zu den verfügbaren Modellen gehören claude-opus-4-8, claude-opus-5, gpt-5.6-sol und weitere. Sichern Sie sich Ihre $100 →
⚠️ Partnerlink — OmniRoute unterhält keine Sponsoring- oder Partnerschaftsbeziehung mit diesem Anbieter. |
Kennen Sie einen weiteren Anbieter mit einem großzügigen kostenlosen Anmeldegutschein, von dem OmniRoute-Nutzer profitieren? Eröffnen Sie ein Issue, und wir fügen ihn hier hinzu.
🎯 Combos — Das Flaggschiff
Ein Combo ist eine Kette von Modellen, zwischen denen OmniRoute automatisch routet. Wenn das Kontingent erschöpft ist, ein Anbieter ausfällt oder die Kosten sprunghaft steigen, kann das Combo zum nächsten geeigneten und funktionsfähigen Modell wechseln. 🛡️
⚡ Keine Konfiguration — einfach auto verwenden
Es muss kein Combo erstellt werden. Setze dein Modell auf auto (oder eine Variante), und OmniRoute erstellt aus deinen verbundenen Anbietern ein virtuelles Combo, das in Echtzeit bewertet wird:
| Modell-ID | Wofür es optimiert ist |
|---|---|
auto | 🎯 Ausgewogener Standard (LKGP — bleibt bei deinem letzten funktionierenden Anbieter) |
auto/coding | 🧑💻 Qualitätsorientierte Gewichtung für die Codegenerierung |
auto/fast | ⚡ Niedrigste Latenz zuerst |
auto/cheap | 💰 Niedrigste Kosten pro Token zuerst |
auto/offline | 🔋 Größter Spielraum bei Kontingenten und Ratenbegrenzungen zuerst |
auto/smart | 🔭 Qualität zuerst + 10 % Exploration, um bessere Modelle zu entdecken |
auto/lkgp | 📌 Explizite Bindung an den letzten bekanntermaßen funktionierenden Anbieter |
auto/chaos | 🧪 Gewichtung für Fehlerinjektion zur Resilienzprüfung (Chaos Engineering) |
🔀 Oder erstelle dein eigenes — 19 Routing-Strategien
Alle 19 Strategien — pro Combo-Schritt frei kombinierbar:
| # | Strategie | Funktionsweise |
|---|---|---|
| 1 | priority |
Geordnete Liste mit bevorzugtem Ziel — jedes Ziel wird vor dem nächsten vollständig ausgeschöpft 🥇 |
| 2 | fill-first |
Das Kontingent jedes Ziels vollständig ausschöpfen, bevor zum nächsten gewechselt wird |
| 3 | weighted |
Gewichtete Zufallsauswahl anhand der Gewichtung pro Ziel |
| 4 | round-robin |
Ziele der Reihe nach durchlaufen |
| 5 | p2c |
Zufälliger Lastenausgleich nach dem „Power of Two Choices“-Prinzip |
| 6 | least-used |
Das Ziel mit der aktuell geringsten Auslastung auswählen |
| 7 | random |
Gleichverteilte Zufallsauswahl (ohne Duplikate) |
| 8 | strict-random |
Zufallsauswahl, ohne Wiederholungen zu entfernen 🎲 |
| 9 | cost-optimized |
Kosten pro Anfrage anhand aktueller Katalogpreise minimieren 💸 |
| 10 | headroom |
Das Ziel mit dem größten verbleibenden Kontingent auswählen |
| 11 | reset-window |
Das Ziel bevorzugen, dessen Kontingentfenster am frühesten zurückgesetzt wird |
| 12 | reset-aware |
Nach dem Zeitpunkt der Kontingent-Rücksetzung priorisieren — kurze Zeitfenster zuerst 📊 |
| 13 | context-relay |
Kontext bei langen Unterhaltungen zwischen Zielen übergeben 🧠 |
| 14 | context-optimized |
Das am besten zur aktuellen Kontextgröße passende Ziel auswählen |
| 15 | cache-optimized |
Jedes wiederverwendbare Prompt-Präfix demselben Konto zuordnen — Treffer im Prompt-Cache maximieren 🎯 |
| 16 | lkgp |
Last-Known-Good Path — bindet Anfragen an den letzten erfolgreichen Anbieter und greift anschließend auf Regeln zurück |
| 17 | auto |
Echtzeitbewertung aller Verbindungen anhand von 16 Faktoren 🤖 |
| 18 | fusion |
Anfragen parallel an ein Modellgremium senden; ein Bewertungsmodell fasst die Ergebnisse zu einer Antwort zusammen 🧬 |
| 19 | pipeline |
Schritte verketten — die Ausgabe jedes Ziels dient als Eingabe für das nächste 🔗 |
Die Auto-Combo-Engine bewertet jeden Kandidaten anhand von 16 Faktoren (Zustand, Kontingent, Kosten, Latenz, Aufgabeneignung, Qualität, Sitzungsverfügbarkeit …) — siehe docs/routing/AUTO-COMBO.md.
🧱 Resilienz ist integriert (3 unabhängige Ebenen)
📖 Auto-Combo-Engine · Ausfallsicherheitsleitfaden
🏆 Was OmniRoute auszeichnet
📊 Vollständige Methodik & Details zu den einzelnen Funktionen im Vergleich zu 9router, OpenRouter, CLIProxyAPI & LiteLLM → docs/comparison/OMNIROUTE_VS_ALTERNATIVES.md
💚 OmniRoute unterstützen
OmniRoute ist MIT-lizenziert und wird offen weiterentwickelt. Wenn es Ihnen Zeit oder Geld spart, können Sie so dazu beitragen, dass es unabhängig bleibt — wählen Sie einfach, was zu Ihnen passt. Sponsoring beeinflusst niemals die Routing-Priorität; es verschafft Sichtbarkeit, keine bessere Platzierung.
| ⭐ Repository mit einem Stern markieren | Kostenlos — hilft wirklich bei der Sichtbarkeit | OmniRoute mit einem Stern markieren |
| 🐙 GitHub Sponsors | Einmalig oder monatlich · keine Plattformgebühr | github.com/sponsors/diegosouzapw |
| ☕ Ko-fi | Schnelle einmalige Spende, keine Registrierung für Spendende erforderlich | ko-fi.com/diegosouzapw |
| 🧋 Buy Me a Coffee | Kleine, informelle Geste | buymeacoffee.com/diegosouzapw |
| 🖐 Liberapay | Wiederkehrend · gemeinnützig · Open Source | liberapay.com/diegosouzapw |
| 🇧🇷 PIX (Brasilien) | Sofort, gebührenfrei | Schlüssel & QR-Code unten |
| ₿ Kryptowährungen | BTC · ETH · USDT-TRC20 · USDC-Solana | Adressen unten |
🇧🇷 PIX — sofort, gebührenfrei (Brasilien)
Schlüssel (zufällig): 5d865059-bc44-483a-962d-43ceb80126eb
Pix copia-e-cola:
00020101021126580014br.gov.bcb.pix01365d865059-bc44-483a-962d-43ceb80126eb5204000053039865802BR5922OMNIROUTE CONTRIBUICAO6006BRASIL62070503***630475DD
₿ Kryptowährungen — BTC · ETH · USDT-TRC20 · USDC-Solana (zum Aufklappen anklicken)
| ₿ BTC | Bitcoin (SegWit) | bc1qh00smz004sy85wyl28v77tenkt3ckl6eaep7fd |
| Ξ ETH | Ethereum (ERC20) | 0x64Cf6B68A6Ff34288e89172950a2d00102337a84 |
| ₮ USDT | Tron (TRC20) | TKAF41JpuQrHbKTnsQa9svJE2T192Hvsc2 |
| $ USDC | Solana | 2emNNZzVVWQc3FQ2wk9M6qXUQmW8AKdjjL174fXR28Tu |
⚠️ Senden Sie jede Kryptowährung ausschließlich über das angegebene Netzwerk — beim Senden über das falsche Netzwerk können die Mittel verloren gehen.
🐛 Einen Fehler gefunden oder Feedback? Eröffnen Sie eine Diskussion.
Hinweise für Entwickler: Das Projekt kann während npm install/postinstall der Einfachheit halber eine lokale .env-Datei für Entwickler erstellen. Diese Datei wird absichtlich über .gitignore ignoriert (siehe .gitignore) und darf niemals committet werden — falls sie versehentlich committet wurde, ändern Sie alle offengelegten Geheimnisse und entfernen Sie die Datei aus dem Verlauf. Hinweise zur Verwaltung lokaler Umgebungsdateien und Geheimnisse finden Sie unter docs/DEVELOPER-ENVIRONMENT.md.
📡 OmniRoute Radar
Das wichtigste kostenlose Kontingent umfasst weiterhin ~1.47B Token/Monat aus dem oben dokumentierten, um Überschneidungen zwischen Pools bereinigten Katalog. Temporäre Guthaben für die Registrierung bei Anbietern können den ersten Monat zusätzlich auf ~2.07B erhöhen. Radar ist eine optionale, signierte Katalogerweiterung für alle, die zwischen OmniRoute-Versionen aktuellere Informationen zur Verfügbarkeit kostenloser Modelle wünschen; der Community-Katalog und alle bestehenden kostenlosen Funktionen bleiben kostenfrei.
Unterstützer können den Live-Katalog und zusätzliche Anbieteroptionen erhalten. Dessen separate, veränderliche Obergrenze liegt – abhängig von der Verfügbarkeit der Anbieter – bei höchstens etwa 3B Token/Monat. Diese Obergrenze ist keine Garantie: Anbieter können Kontingente, Berechtigungskriterien, Modelle oder Regionen jederzeit ändern.
Radar ist optional und verwendet ausschließlich GET-Anfragen. Der OmniRoute-Client lädt keine Prompts, Datenverkehrsdaten, Anbieter- konfigurationen, Nutzungstelemetrie oder den lokalen Status verworfener Ankündigungen hoch. Weitere Informationen zur Teilnahmeberechtigung und zum aktuellen Katalog finden Sie unter radar.omniroute.online/planos.
✨ Was ist neu?
Aktuelle Highlights von v3.8.20 → v3.8.50. Den vollständigen Verlauf finden Sie in
CHANGELOG.md.
- 🎛️ OmniConductor — eingehende A2A-Delegierung an Ihre Agentenflotte, Conductor-Skills auf der Agent Card und ein Dashboard-Panel mit Faro-Push-to-Talk-Sprachchat. → A2A-Server
- 🛂 Adaptive Zulassung & Überlastungsschutz — ressourcenintensive Chatanfragen werden in eine Warteschlange gestellt, statt einen 503-Fehler auszulösen, mit atomaren gleitenden RPM-Leases pro Verbindung. → Resilienzleitfaden
- 🗂️ Kanonische
/v1/models-Reihenfolge — ein zusammenhängender, nach Provider gruppierter Block pro Provider (Combos zuerst fixiert), stabil über alle Katalogquellen hinweg. → API-Referenz - 🗜️ Gehärtete Komprimierung — standardmäßig aktivierter Inflationsschutz, Caveman-Pakete für DE / FR / JA + Chinesisch (wényán), RTK-Filter für Gradle & .NET. → Komprimierung
- 💸 Ehrliche Pauschalkosten — Abonnement-/Coding-Plan-Provider werden in der Kostenanalyse mit $0 ausgewiesen; Budget, Kontingent & Routing nehmen weiterhin Schätzungen vor. → API-Referenz
- ⚖️ Quota-Share-Routing — teilt das Kontingent eines gemeinsamen Kontos fair auf gebündelte Schlüssel auf und bleibt dabei auslastungserhaltend, sodass ungenutzte Anteile verliehen werden. → Resilienzleitfaden
- 🤖 CLI-/Agenten-Einrichtung mit einem Befehl — 13 registrierte
setup-*-Befehle;omniroute runstartet 7 CLIs (Claude Code, Codex, Aider, Goose, OpenCode, Qwen Code, Gemini CLI);omniroute configureunterstützt 10 Ziele mit einer interaktiven Provider- und Modellauswahl sowie kontextspezifischen Favoriten. → CLI-Integrationen - 🛰️ Remote-Modus — steuern Sie eine entfernte OmniRoute-Instanz mit bereichsgebundenen Tokens (
connect/contexts/tokens) sowie einemantigravity-OAuth-Helfer für VPS-Installationen. → Remote-Modus - 🧭 Intelligenteres automatisches Routing —
auto/<category>:<tier>-Combos, Fusion (Modellpanel + Bewerter), aufgabenbezogenes Routing sowie anfragespezifische Überschreibungen für Modell / Modus / USD-Budget. → Auto-Combo - 🗜️ Erweiterbare Komprimierung — 12 kombinierbare Engines + Compression Studios: LLMLingua-2, zweistufiges Ultra, omniglyph, Fidelity-Gate pro Schritt, GCF v3.2, Editor mit Drag-and-drop-Neuanordnung. → Komprimierung
- 🕵️ Transparente MITM-Entschlüsselung (TPROXY) — erfasst CLIs, die Proxy-Umgebungsvariablen ignorieren, mit einer CA pro SNI und einem Trust-Store-Installationsprogramm. → MITM/TPROXY
- 💸 Kosten-Telemetrie überall —
X-OmniRoute-*-Header für Kosten/Nutzung an jedem Endpunkt, Header für Cache-HIT-Einsparungen, USD-Ausgabenkontingente pro Schlüssel. → API-Referenz - 🧠 Speicher unter Ihrer Kontrolle — standardmäßig deaktiviert, optionale int8-Vektorquantisierung + typisierter Verfall, anfragespezifisches
x-omniroute-no-memory. → Speicher - 🛡️ Sicherheit — Schutz vor Prompt-Injection auf jeder LLM-Route (Red-Team-Suite), optionale Schutzvorkehrung zur Maskierung von Zugangsdaten (schwärzt offengelegte API-Schlüssel/Geheimnisse in beide Richtungen), kostenlose DuckDuckGo-Websuche als letzte Rückfallebene und eine optionale OIDC-Anmeldeschranke für das Dashboard (die Passwortanmeldung bleibt stets verfügbar). → Schutzvorkehrungen
- 🖼️ Neue Endpunkte —
/v1/ocr(Mistral OCR) und/v1/audio/translations(im Whisper-Stil) vervollständigen die Medienfunktionen. → API-Referenz - 🎨 Bild-/Video-/Audiogenerierung — eine API für Medien: xAI Grok Imagine & Novita AI Video, ComfyUI, Magnific, Adobe Firefly, Segmind sowie Sprachanbieter wie ElevenLabs. → API-Referenz
- 🌍 Bereitstellung & Betrieb — Reverse-Proxy-
basePath, automatische Erkennung der Browsersprache, Geräteverfolgung pro Schlüssel, MITM-Vertrauen ohne Root-Rechte, zh-TW-Lokalisierung. → Umgebung - 🤝 Mehr Provider & Agenten — Cloud-Agenten (Codex Cloud, Cursor, Devin, Jules), Grok Build (xAI) mit Browser- + OAuth-Anmeldung, vollwertige Ollama-Karte, Claude Opus 5 & Sonnet 5, offizielle Kimi-Partnerschaft (Code/Web/Moonshot), Zed, Requesty, SenseNova, Yuanbao, Agnes AI … und ein aktualisierter Katalog mit 352 Providern. → Provider
- 📡 Routing-Transparenz — jede Antwort enthält einen
X-OmniRoute-Decision-Header, der die verwendete Strategie, den Provider und die Latenz angibt; eine neuecache-optimized-Combo-Strategie + der Auto-Combo-FaktorcacheAffinityleiten wiederholte Anfragen zurück an die Verbindung, die das zwischengespeicherte Präfix hält; und ein schreibgeschützter Endpunkt/v1/auto-combo/{channel}/candidatesstellt den aktuellen Kandidatenpool einesauto/*-Kanals bereit. → Auto-Combo - ⚡ Lokale Leistung & Infrastruktur — lokales Redis mit einem Klick, Relay-Deployments für Cloudflare Workers / Deno Deploy, Bifrost & Mux als überwachte eingebettete Dienste. → Eingebettete Dienste
- 🧩 Ebenfalls enthalten — Plugin-Framework + Marktplatz, Omni-/Agent-/GitHub-Skills-Frameworks, Obsidian-Vault-Integration (22 MCP-Tools), OpenAI-kompatible Batch- & Files-APIs, semantischer Antwort-Cache, Gamification mit Bestenlisten, ACP-Agentenerkennung (15 integrierte Agenten), planmäßiger Log-Export nach BigQuery,
auto/chaos-Fehlerinjektion, eine Telegram-Bot-Bridge, ein integrierter Versionsmanager und LMArena-ELO-Ranglisten kostenloser Provider. → Dokumentation
🤖 Kompatible CLIs & Coding-Agenten
Eine Konfiguration —
http://localhost:20128/v1— und jede KI-IDE oder CLI läuft mit kostenlosen und kostengünstigen Modellen.
Claude Code |
Codex CLI |
Cline |
Kilo Code |
Zoo Code |
Continue |
Aider |
ForgeCode |
jcode |
DeepSeek TUI |
CodeWhale |
OpenCode |
Factory Droid |
Copilot CLI |
Cursor CLI |
Smelt |
Pi |
Grok Build |
Hermes Agent |
OpenClaw |
Goose |
Open Interpreter |
Warp AI |
Agent Deck |
📖 Einrichtung pro Tool für alle 36 Tools (26 CLI-Code-Tools + 10 CLI-Agenten) → docs/reference/CLI-TOOLS.md · 🧩 OpenCode-Plugin → @omniroute/opencode-provider
Starte jede unterstützte CLI mit einem einzigen Befehl über OmniRoute — es werden keine Konfigurationsdateien geschrieben, Anmeldedaten werden pro Prozess injiziert und Qwen/Gemini erhalten ein temporäres, isoliertes Home-Verzeichnis:
omniroute run claude --model openai/gpt-5.4 # Claude Code
omniroute run codex --model glm/glm-5.2 # OpenAI Codex CLI
omniroute run aider --model glm/glm-5.2 -- --message "reply OK"
omniroute run goose --model glm/glm-5.2
omniroute run opencode --model glm/glm-5.2 -- run "reply OK"
omniroute run qwen --model glm/glm-5.2 -- -p "reply OK"
omniroute run gemini --model glm/glm-5.2 -- --skip-trust -p "reply OK"
# Oder Anbieter und Modell interaktiv auswählen und die eigene Konfiguration des Tools schreiben:
omniroute configure codex # außerdem: claude opencode qwen aider goose gemini cline continue kilo
Jeder Befehl berücksichtigt den aktiven Remote-Kontext (omniroute connect <host>), --dry-run
zeigt die exakten Umgebungsvariablen/Argumente in einer Vorschau an, ohne sie auszuführen, und --api-key-env NAME hält Geheimnisse
aus deinem Shell-Verlauf fern. → CLI-Integrationen
🌐 352 KI-Anbieter — 152 im Katalog als kostenlos gekennzeichnet
352 registrierte Anbieter in den kanonischen Sammlungen für Chat, Medien, Suche, lokale Dienste, Cloud-Agenten und Systeme, darunter 152 mit den Erkennungsmetadaten
hasFree: true. Das Chat-Modellregister umfasst 229 Anbieter / 2.554 unterschiedliche Anbieter-Modell-Paare / 1.283 unverarbeitete Modell-IDs; der separate Katalog für kostenlose Kontingente enthält 443 modellspezifische Einträge, 34 wiederkehrende Pools und 53 wiederkehrend kostenlose bzw. schlüssellose, dauerhaft kostenlose Anbieter. Diese Nenner unterscheiden sich bewusst; Definitionen und um Pool-Duplikate bereinigte Berechnungen finden Sie in der Anbieterreferenz und unter Kostenlose Tarife.
🏢 Jedes große KI-Labor — über einen einzigen Endpunkt
OpenAI |
Anthropic |
Gemini |
xAI Grok |
DeepSeek |
Mistral |
Qwen |
Meta Llama |
Groq |
NVIDIA |
MiniMax |
Cohere |
Perplexity |
HuggingFace |
Together |
Fireworks |
Cloudflare |
Baidu |
…und über 330 weitere — jedes Symbol wird live aus dem Anbieterkatalog des Dashboards geladen. 📖 Anbieterreferenz
🆓 Dauerhaft kostenlos — $0, keine Kreditkarte erforderlich
📖 Vollständiger maschinenlesbarer Katalog → docs/reference/PROVIDER_REFERENCE.md
🖥️ Wo OmniRoute läuft — überall
Dieselbe App, dein Rechner, deine Regeln. Von einer globalen npm-Installation bis hin zu deinem Smartphone über Termux.
| Plattform | Installation | Highlights |
|---|---|---|
| 📦 npm (global) | npm install -g omniroute | Ein Befehl, jedes Betriebssystem |
| 🐳 Docker | docker run … diegosouzapw/omniroute | Multi-Architektur: AMD64 + ARM64 |
| 🖥️ Desktop (Electron) | npm run electron:build | Natives Fenster + Taskleiste — Windows / macOS / Linux |
| 🎩 Menüleiste (OmniRouteTray) | brew install --cask zoispag/tap/omniroute-tray | Überwacht und aktualisiert den Server automatisch — macOS |
| 💪 ARM | nativ für arm64 | Raspberry Pi, ARM-Server, Apple Silicon |
| 📱 Android (Termux) | pkg install nodejs && npx -y omniroute | Läuft auf deinem Smartphone, rund um die Uhr, ohne Root-Zugriff |
| 📲 PWA | „Zum Startbildschirm hinzufügen“ | Vollbildmodus, offline, über den Browser installierbar |
| 🧩 OpenCode-Plugin | @omniroute/opencode-provider | Native OpenCode-Integration |
| 🤖 VS Code Copilot Chat | OmniCopilot-Erweiterung installieren | Jedes OmniRoute-Modell in der nativen Copilot-Chat-Auswahl — Stable & Insiders |
| 🛠️ Aus dem Quellcode | npm install && npm run dev | Anpassen und mitwirken |
📖 Docker-Anleitung · Desktop · Menüleisten-App · Termux · PWA · OpenCode
🧩 Neu: OmniRoute im nativen Copilot Chat von VS Code
Keine neue Seitenleiste, keine neue Chat-Oberfläche — jedes von OmniRoute bereitgestellte Modell erscheint direkt in der bereits verwendeten Modellauswahl von Copilot Chat. Seit VS Code 1.122 funktionieren Anbietermodelle ohne GitHub-Anmeldung oder Copilot-Abonnement — Agentenmodus, Tool-Aufrufe und Bildverarbeitung, kostenlos.
Installiere die Erweiterung OmniCopilot, verbinde sie
mit deinem OmniRoute-Server (standardmäßig localhost:20128) und öffne dann Copilot Chat → Modellauswahl
→ Modelle verwalten… → OmniRoute.
| Store | Link | Kompatibel mit |
|---|---|---|
| 🧩 VS Code Marketplace | Installieren → | VS Code — Stable & Insiders |
| 🔓 Open VSX Registry | Installieren → | Cursor, Windsurf, VSCodium, Theia, code-server, Gitpod, Antigravity, Kiro… |
Im Editor: Öffne die Ansicht Erweiterungen, suche nach „OmniRoute“ und klicke auf Installieren — funktioniert in beiden Stores auf dieselbe Weise. Quellcode, Issues und das Runbook für die Veröffentlichung findest du unter diegosouzapw/OmniCopilot.
📖 Anleitung für VS Code Copilot Chat — Einrichtung, Anzeige in der Modellauswahl, Dashboard in einem Tab, Fehlerbehebung
🎩 Neu: OmniRouteTray — dein Gateway in der Menüleiste
omniroute servefunktioniert am besten, wenn es immer läuft. OmniRouteTray macht daraus eine einmalig einzurichtende Menüleisten-App für macOS: Sie startet den Server, hält ihn auch nach Neustarts am Laufen, aktualisiert ihn direkt und macht dein aktuelles Token-Budget mit einem Klick verfügbar — kein offenes Terminalfenster und keine globale Installation mitnpm install -g omniroute, um die du dich kümmern musst.
Die App basiert auf Tauri v2 (mit einem winzigen Rust-Kern) und bringt
eine eigene signierte Node-24-Laufzeitumgebung mit. Sie verwaltet eine app-eigene OmniRoute-Installation und gerät daher nie mit deinem
globalen node/bun in Konflikt. Sie verwendet deine vorhandene Konfiguration und Datenbank unter ~/.omniroute/ — es ist also
dasselbe OmniRoute, das du bereits ausführst, nur mit Hut. 🎩
| Funktion | Funktionsweise |
|---|---|
| 🟢 Überwacht den Server | Startet omniroute serve und übernimmt eine bereits laufende Instanz, statt sie zu duplizieren |
| 📊 Live-Nutzung auf einen Blick | Kontingentanzeigen der Anbieter, Sitzungs- und Wochenlimits von Claude mit Countdown bis zur Zurücksetzung sowie Kostenaufschlüsselung für 30 Tage |
| 🔄 Automatische direkte Updates | Mehrstufige Installation, atomarer Austausch und Rollback bei Fehlern — immer auf dem neuesten Release |
| 🚀 Beim Anmelden starten | Optionaler Start bei der Anmeldung; nur in der Menüleiste, ohne Dock-Symbol |
| 🩺 Diagnose & Protokolle | Diagnose mit einem Klick und Zugriff auf die Serverprotokolle |
brew install --cask zoispag/tap/omniroute-tray
Bevorzugen Sie einen Download? Laden Sie die neueste .dmg-Datei unter
Releases herunter. Quellcode, Issues und Build-Dokumentation
finden Sie unter zoispag/omniroute-tray.
💛 Ein Community-Projekt von @zoispag — keine offizielle OmniRoute-Veröffentlichung.
🔒 Privat & Local-First
📖 Autorisierung · Schutzmechanismen · Compliance
🔌 Vollständige CLI + A2A & MCP
Neben dem Server ist OmniRoute eine vollständige Kommandozeilen-Schaltzentrale mit über 80 Befehlen sowie offenen Agentenprotokollen, sodass ein KI-Agent sie eigenständig steuern kann.
⌨️ Eine echte CLI (nicht nur start)
omniroute # Gateway + Dashboard bereitstellen (Port 20128)
omniroute chat # interaktiver TUI-Chat-Client (Slash-Befehle: /model /combo /skill /memory)
omniroute setup # geführter Assistent für die Ersteinrichtung
omniroute doctor # Anbieter, Ports und native Abhängigkeiten diagnostizieren
🛰️ Remote-Modus — CLI hier ausführen, OmniRoute auf einem VPS
OmniRoute auf einem Server? Steuern Sie es von Ihrem Laptop aus mit derselben CLI. Melden Sie sich einmal mit einem eingeschränkten Zugriffstoken an; anschließend wird jeder Befehl an das Remote-System gesendet.
omniroute connect 192.168.0.15 # Passwort → eingeschränktes Token, als Kontext gespeichert
omniroute models list # ← wird auf dem REMOTE-Server ausgeführt
omniroute configure codex # ← wählt ein Remote-Modell aus und schreibt ein lokales Codex-Profil
omniroute tokens create --name ci --scope read # eingeschränktere Token für andere Rechner erstellen
omniroute contexts use default # ← zurück zum lokalen Server wechseln
Token sind auf read / write / admin beschränkt; Routen, die Prozesse starten, bleiben ausschließlich über Loopback erreichbar.
📖 Remote-Modus
🤝 Einen Agenten verbinden — und er steuert OmniRoute selbst
Stellen Sie OmniRoute über MCP, A2A, eine REST API, Webhooks oder eine Remote-CLI bereit — jeder geeignete Agent (oder Ihr eigener Code) erhält die Kontrolle über das gesamte Gateway: Routing, Anbieter, Kombinationen, Cache, Komprimierung und Speicher — autonom. Die nachfolgenden HTTP-Endpunkte werden unter http://localhost:20128 bereitgestellt.
| Schnittstelle | Endpunkt / Befehl | Verwendungszweck |
|---|---|---|
| 🧰 MCP (stdio) | omniroute --mcp | In Claude Desktop, Cursor oder jeden beliebigen MCP-Client integrieren |
| 🌊 MCP (HTTP) | /api/mcp/stream | Remote-MCP — 110 Werkzeuge, 33 Berechtigungsbereiche (Durchsetzung optional), vollständiges Audit-Protokoll |
| 📡 MCP (SSE) | /api/mcp/sse | Streaming-Transport für MCP |
| 🤝 A2A | /.well-known/agent.json | Agent-zu-Agent-Kommunikation, JSON-RPC 2.0 + SSE, 6 Fähigkeiten |
| 🌐 REST API | /v1/* | OpenAI-kompatibel — Chat, Einbettungen, Bilder, Audio, OCR |
| 🔔 Webhooks | /api/webhooks | Anfrage- und Kontingentereignisse an Slack, Discord, Telegram oder eine beliebige URL senden |
| 🛰️ Remote-CLI | omniroute connect | Eine Remote-Instanz mit eingeschränkten Zugriffstoken steuern |
# Claude Code über MCP den vollständigen OmniRoute-Werkzeugsatz bereitstellen:
claude mcp add-server omniroute --type http --url http://localhost:20128/api/mcp/stream
📖 MCP-Server · A2A-Server · Agentenprotokolle
🗜️ Automatisch 15–95 % Tokens sparen
📖 Funktionsweise — Pipeline, Architektur & Berechnung der Einsparungen
Die standardmäßig kombinierte Konfiguration führt RTK → Caveman aus. Wenn beide dieselben Tool-/Kontextdaten verarbeiten, multiplizieren sich die Einsparungen:
kombiniert = 1 − (1 − RTK) × (1 − Caveman_Eingabe)
Durchschnitt = 1 − (1 − 0.80) × (1 − 0.46) = 89.2%
Spanne = 78.4 – 94.6%
Codeblöcke, URLs, JSON und strukturierte Daten werden durch die Schutz-Engine immer geschützt.
Warum viele Tokens verwenden, wenn wenige ausreichen? Jede Anfrage durchläuft OmniRoutes Komprimierungspipeline transparent — ohne Änderungen am Client. Sie besteht jetzt aus einem Stack aus 12 kombinierbaren Engines, die der Reihe nach ausgeführt und je nach Routing-Kombination flexibel zusammengestellt werden — basierend auf Ideen von RTK, Caveman (⭐ 90K+), LLMLingua-2 und Troglodita (PT-BR).
🧱 Der Stack aus 12 Engines
Die Engines werden in der Reihenfolge der Pipeline ausgeführt; jede kann unabhängig aktiviert oder deaktiviert und je Kombination konfiguriert werden:
| # | Engine | Funktionsweise |
|---|---|---|
| 1 | Session-Dedup | Entfernt über mehrere Interaktionen hinweg wiederholte Inhalte (inhaltsadressiert, interaktionsübergreifend) |
| 2 | CCR | Archiviert große Blöcke hinter Abrufmarkierungen, die bei Bedarf abgerufen werden |
| 3 | Lite | Reduziert Leerraum und Bild-URLs (latenzarme Basisvariante) |
| 4 | RTK | Intelligentes Filtern, Deduplizieren und Kürzen von Tool-Ergebnissen (befehlsabhängig) |
| 5 | Responses Tool Output | Primär verlustfreie JSON-Komprimierung plus begrenzte Diagnosekomprimierung für Shell-/Patch-/Such-/Build-Ausgaben (Responses API) |
| 6 | Headroom | Verlustfreie tabellarische Komprimierung von JSON-Arrays (~30 %) über einen eingebundenen GCF-Codec |
| 7 | Relevance | Extraktive Bewertung von Sätzen anhand der letzten Benutzeranfrage |
| 8 | Caveman | Regelbasierte Textkomprimierung (~65–75 % bei der Ausgabe) |
| 9 | Aggressive | Zusammenfassung und schrittweise Alterung früherer Interaktionen |
| 10 | LLMLingua-2 | Semantische ML-Bereinigung über MobileBERT ONNX — codesicher, asynchron |
| 11 | Ultra | Heuristische Token-Bereinigung mit optionaler Small-Model-Stufe (SLM) |
| 12 | OmniGlyph | Experimentelle Kodierung von Kontext als Bild für das gemessene Claude Fable 5 über die direkte Anthropic-Verbindung; GPT 5.6 Transformers bleiben bis zum Vorliegen von Anbieterbelegen nach dem Fail-Closed-Prinzip deaktiviert. Vier Komprimierungsprofile (standardmäßig aggressiv, ausgewogen, codesicher, unverändert) (am aggressivsten; optionale Aktivierung) |
Codeblöcke, URLs und strukturierte Daten bleiben immer bytegenau erhalten. Ein-Klick-Voreinstellungen kombinieren die Engines:
| Modus | Einsparungen | Am besten geeignet für |
|---|---|---|
| 🪶 Lite | ~15 % | Sichere, dauerhaft aktive Standardeinstellung |
| 🪨 Standard (Caveman) | ~30 % | Tägliche Programmierarbeit |
| ⚡ Aggressive | ~50 % | Lange Sitzungen mit intensiver Tool-Nutzung |
| 🔥 Ultra | ~75 % | Maximale Einsparungen |
| 🧰 RTK | 60–90 % | Shell-/Test-/Build-/git-Ausgaben |
| 🔗 Kombiniert (RTK → Caveman) | 78–95 % | Gemischte Prompts und Tool-Protokolle |
Praxisbeispiel — Standardmodus:
Vorher (69 Tokens): „Der Grund dafür, dass deine React-Komponente erneut gerendert wird, liegt wahrscheinlich darin, dass du bei jedem Renderzyklus eine neue Objektreferenz erstellst. Wenn du ein Inline-Objekt als Prop übergibst, erkennt Reacts flacher Vergleich es jedes Mal als ein anderes Objekt, was ein erneutes Rendern auslöst. Ich würde empfehlen, useMemo zu verwenden, um das Objekt zu memoizieren.“
Nachher (19 Tokens): „Neue Objektreferenz bei jedem Rendern. Inline-Objekt-Prop = neue Referenz = erneutes Rendern. Mit useMemo umschließen.“
Gleiche Antwort. 72 % weniger Tokens. Kein Genauigkeitsverlust. ✅
PT-BR-Beispiel — Troglodita-Modus:
Vorher (42 Tokens): „Das Problem ist, dass die Komponente erneut gerendert wird, weil in jedem Renderzyklus eine neue Objektreferenz erstellt wird. Ich würde empfehlen, useMemo zu verwenden.“
Nachher (12 Tokens): „Erneutes Rendern: neue Referenz je Zyklus (Inline-Objekt neu erstellt).
useMemoverwenden.“Gleiche Antwort. ~70 % weniger Tokens. Technische Präzision unverändert. ✅
🎚️ Mehr als nur Engines — Ausgabestile, die adaptive Steuerung und Kontrolle pro Anfrage
Die 12 Engines oben reduzieren, was hineingeht. Drei weitere Ebenen bestimmen, wie, wann und was herauskommt:
- 🪄 Ausgabestile (Steuerung der Ausgabeachse) — fügen deterministische, Cache-sichere Anweisungen zur Antwortgestaltung ein; kombinierbar, jeweils mit der Intensität
lite/full/ultra. Zum Hinzufügen eines Stils genügt ein einzeiliger Registry-Eintrag:- Knappe Prosa — Füllwörter / Artikel / Einschränkungen weglassen; technische Substanz exakt beibehalten.
- Weniger Code — „fauler Senior-Entwickler“-YAGNI: kleinste funktionierende Änderung, kein nicht angefordertes Gerüst.
- Pferdeschwanz (fauler Senior-Entwickler) — die YAGNI-Leiter erklimmen, die eigentliche Ursache beheben, kleinster funktionierender Diff.
- Ich habe ADHS (handlungsorientiert) — nächste Aktion zuerst, nummerierte Schritte, ein konkreter nächster Schritt, keine Einleitung.
- Knappes CJK (文言) — ultraknapper Stil in klassischem Chinesisch (durch Gebietsschema auf
zhbeschränkt).
- 🎯 Adaptives Kontextbudget (die Steuerung) — statt eines einzelnen Ein-/Aus-Token-Schwellenwerts werden die günstigsten Engines mit den geringsten Verlusten nur so weit hochgestuft, wie nötig ist, damit alles in das Kontextfenster des Modells passt. Richtlinie:
reserve-output(Standard, modellabhängig) ·percentage·absolute. Modus:floor(garantiert die Einhaltung) ·replace-autotrigger(Ihre explizite Auswahl hat Vorrang) ·off(veralteter Schwellenwert). - 🎛️ Wo über die Komprimierung entschieden wird (Priorität, hoch → niedrig) —
x-omniroute-compression-Header pro Anfrage › Überschreibung durch Routing-Kombination › aktives benanntes Profil › adaptiv / automatische Auslösung › Panel-Standard › aus. Der angewendete Plan wird im Antwort-HeaderX-OmniRoute-Compression: <mode>; source=<source>zurückgegeben.
Automatische Auslösung anhand eines Token-Schwellenwerts, Aktivierung der adaptiven Steuerung, Festlegen eines benannten Profils, einmalige Einstellung pro Anfrage oder Zuweisen einer Pipeline pro Routing-Kombination — je nachdem, was zur Arbeitslast passt. Ein optionales lokales Evaluierungswerkzeug (npm run eval:compression) bewertet die Wiedergabetreue im Verhältnis zur Einsparung anhand eines festgelegten Korpus, bevor Sie eine Änderung übernehmen.
📖 COMPRESSION_GUIDE.md · RTK_COMPRESSION.md · COMPRESSION_ENGINES.md
⚡ Schnellstart
1) Installieren und ausführen
npm install -g omniroute
omniroute
💡 Sehen Sie
npm warn ERESOLVEoder Peer-Dependency-Warnungen? Sie sind harmlos.
Dashboard unter http://localhost:20128 · API unter http://localhost:20128/v1.
2) Einen KOSTENLOSEN Anbieter verbinden (keine Registrierung)
Dashboard → Anbieter → Kiro AI (kostenloses Claude, ~50 Credits/Monat pro Konto) oder OpenCode Free (keine Authentifizierung) verbinden → fertig.
3) Ihr Programmierwerkzeug konfigurieren
Basis-URL: http://localhost:20128/v1
API-Schlüssel: [aus Dashboard → Endpunkte kopieren]
Modell: auto (intelligentes Routing ohne Konfiguration — oder beliebiger Anbieter/beliebiges Modell)
4) Funktion überprüfen
curl http://localhost:20128/v1/models -H "Authorization: Bearer YOUR_KEY"
Ihre verbundenen Modelle sollten aufgelistet werden. 🎉 Das war's — beginnen Sie mit dem Programmieren; OmniRoute übernimmt automatisch das Routing und weicht bei Bedarf auf Alternativen aus.
Falls Ihr Client keine benutzerdefinierten Header senden kann, stellt OmniRoute außerdem tokenisierte Kompatibilitätsaliase bereit:
OpenAI-Katalog: http://localhost:20128/vscode/YOUR_KEY/
OpenAI-Modelle: http://localhost:20128/vscode/YOUR_KEY/models
OpenAI-Chat: http://localhost:20128/vscode/YOUR_KEY/chat/completions
OpenAI-Antworten: http://localhost:20128/vscode/YOUR_KEY/responses
Ollama-Chat: http://localhost:20128/vscode/YOUR_KEY/api/chat
Ollama-Tags: http://localhost:20128/vscode/YOUR_KEY/api/tags
Verwenden Sie diese nur für Clients, die Authorization: Bearer ... nicht anhängen können. Die Authentifizierung per Header bleibt der bevorzugte Modus.
📦 Weitere Installationsmethoden — Docker, Quellcode, pnpm, Arch
🐳 Docker
docker run -d --name omniroute --restart unless-stopped --stop-timeout 40 \
-p 127.0.0.1:20128:20128 -v omniroute-data:/app/data diegosouzapw/omniroute:latest
:latest folgt der höchsten veröffentlichten stabilen SemVer-Version. Es folgt nicht dem Git-Branch main. Verwenden Sie für GitOps eine feste Version mit :X.Y.Z. Siehe Docker-Veröffentlichungskanäle. Das Image setzt OMNIROUTE_MEMORY_MB=1024 fest. Das reicht für das Dashboard und einen einfachen Chat. Coding-Agenten (POST /v1/responses von Claude Code, Codex, Grok, …) benötigen einen wesentlich größeren V8-Heap, andernfalls kommt es bei zwei sich überschneidenden langen Kontexten bei etwa 12 GiB zu einem FATAL ERROR. Dimensionieren Sie den Container größer als den Heap (native Puffer befinden sich außerhalb von V8):
| Arbeitslast | Heap (-e OMNIROUTE_MEMORY_MB) |
Container (--memory) |
|---|---|---|
| Dashboard / einfacher Chat | 1024 (Image-Standardwert) |
≥2 g |
| Ein Coding-Agent | 8192 |
≥10 g |
Zwei gleichzeitige lange /v1/responses |
10240–12288 |
≥12–16 g |
docker run -d --name omniroute --restart unless-stopped --stop-timeout 40 \
-e OMNIROUTE_MEMORY_MB=8192 --memory=10g \
-p 127.0.0.1:20128:20128 -v omniroute-data:/app/data diegosouzapw/omniroute:latest
Vollständige Tabelle: Docker-Leitfaden — Laufzeit-RAM.
Docker-Kanal für Vorabversionen:
diegosouzapw/omniroute:nextunddiegosouzapw/omniroute:next-webfolgen dem aktuellen standardmäßigenrelease/v*- Branch. Diese veränderlichen Tags sind ausschließlich zum Testen unveröffentlichter Korrekturen vorgesehen und werden für den Produktionseinsatz nicht unterstützt. Siehe Docker-Veröffentlichungskanäle.
🥟 Bun
Die standardmäßige Installation mit bun install sowie die globale Installation (bun install -g omniroute) werden über die Bun-Laufzeiterkennung unterstützt:
- Integriertes
bun:sqlite: OmniRoute verwendet bei der Ausführung unter Bun dessen integriertenbun:sqlite-Treiber und greift unter Node.js aufbetter-sqlite3odersql.jszurück. - Automatische Auswahl des Webpack-Bundlers in der Entwicklungsumgebung: Die Entwicklungsumgebung (
bun run dev) erkennt Bun automatisch und deaktiviert Turbopack zugunsten von Webpack, um Inkompatibilitäten mit nativen V8-Bindings zu vermeiden. Produktions-Builds (bun run build) folgenOMNIROUTE_USE_TURBOPACKgenau wie unter Node: standardmäßig Turbopack, mitOMNIROUTE_USE_TURBOPACK=0wird mit Webpack gebaut (Dockerfile.bunstellt dies als--build-argbereit). - Dediziertes Bun-Dockerfile: Mehrstufiges
Dockerfile.bunfür native Bun-Produktionsbereitstellungen (docker build -f Dockerfile.bun -t omniroute:bun .).
# Mit Bun installieren und ausführen
bun install
bun run dev
🛠️ Aus dem Quellcode
cp .env.example .env && npm install
PORT=20128 npm run dev
📦 pnpm
pnpm add -g omniroute@latest --allow-build=better-sqlite3 --allow-build=@swc/core && omniroute
🐧 Arch Linux (AUR)
yay -S omniroute-bin && systemctl --user enable --now omniroute.service
🔧 Nix (Flake)
# Mit Nix-Flakes
nix develop
npm run dev
# Oder mit devbox
devbox run npm run dev
📖 Docker-Leitfaden — Compose-Profile, Caddy HTTPS, Cloudflare-Tunnel.
🦭 Podman
# 1. Das per Bind-Mount eingebundene Datenverzeichnis vorbereiten
mkdir -p data
# 2. Nur unter Linux + lokalem Rootless-Podman (niemals mit einem entfernten Podman-Machine-Client):
podman unshare chown 1000:1000 ./data
# 3. Den Laufzeithinweis festlegen, das lokale Compose-Image erstellen und starten
echo "CONTAINER_HOST=podman" >> .env
podman compose --profile base up -d --build
Unter macOS oder Windows verwendet Podman eine entfernte Podman Machine: Überspringen Sie podman unshare und
befolgen Sie die topologiespezifischen Hinweise zum Datenverzeichnis.
📖 Podman-Leitfaden — Compose-Builds, Podman Machine und Linux/systemd-Quadlet-Einrichtung.
⚡ Schnellere / schlankere Installation (nativen Build überspringen)
Die native SQLite-Engine (better-sqlite3) ist eine optionale Abhängigkeit, daher wird eine globale
Installation niemals durch die Kompilierung aus dem Quellcode blockiert: Sie verwendet ein vorkompiliertes Binärprogramm, wenn eines zu
Ihrer Plattform/Node-Version passt, und greift andernfalls transparent auf eine reine JS-Engine zurück
(node:sqlite unter Node 22+, andernfalls das mitgelieferte sql.js-WASM) — keine Build-Werkzeuge erforderlich.
So überspringen Sie die native Aufwärmphase nach der Installation vollständig (CI, Headless-Systeme oder langsame Rechner):
OMNIROUTE_SKIP_POSTINSTALL=1 npm install -g omniroute # CI=1 überspringt sie ebenfalls
Für die schnellsten Installationen empfiehlt sich pnpm (inhaltsadressierter Speicher + Hardlinks — siehe oben).
Für eine Headless-Laufzeitumgebung ohne Dashboard verwenden Sie das Docker-Profil base (siehe oben) oder den
Termux-Leitfaden. Die CLI und das Web-Dashboard werden vom
gleichen Prozess über einen einzigen Port bereitgestellt, daher gibt es derzeit kein separates reines CLI-Paket.
🎬 OmniRoute in Aktion
📹 Videoanleitungen
Momentaufnahme des Dashboards vom 2026-08-24 · Rohkatalog: YT 809 | TT 137 | IG 124 · Aktualität (Tage): YT 1 | TT 21 | IG 22
Vollständige Rangliste (deduplizierte kanonische URLs, v > 0, größte Reichweite):
| #1 | #2 | #3 | #4 | #5 |
|---|---|---|---|---|
| nick_saraev — Instagram — 3,042,474 | theopenstack — Instagram — 692,419 | milesreevesai — TikTok — 620,400 | Vaibhav Sisinty — YouTube — 391,109 | buildwithai.club — Instagram — 347,652 |
| #6 | #7 | #8 | #9 | #10 |
|---|---|---|---|---|
| nivedan.ai — Instagram — 331,973 | vaibhavsisinty — Instagram — 263,744 | Nick Automates — YouTube Shorts — 218,174 | theroshankrishna — Instagram — 186,786 | midudev — TikTok — 177,800 |
Kanonische Kennzahlen vom 2026-08-24: 1.029 einzigartige Videos · 11.132.922 bekannte Aufrufe (v > 0) · 639 Kanäle/Profile nach Netzwerk. Das Roh-Dashboard enthält 1.070 Zeilen; 41 Instagram-Duplikate wurden anhand der kanonischen URL normalisiert, wobei die höchste Aufrufzahl pro Video beibehalten wurde.
🎬 Du hast ein Video über OmniRoute erstellt? Eröffne ein Issue oder eine Diskussion mit dem Link — wir stellen es hier vor.
📧 Community & Hilfe
Alles an einem Ort — folge dem Maintainer, chatte mit der Community oder eröffne ein Issue.
| Kanal | Wo / wie |
|---|---|
| 💼 LinkedIn — dem Maintainer folgen | linkedin.com/in/diegosouzapw |
| 🐙 GitHub — für Releases & Tipps folgen | @diegosouzapw |
| 💬 Discord | discord.gg/U47eFqAXCn |
| ✈️ Telegram | t.me/omnirouteOficial |
| 🟢 WhatsApp — 🌍 Global | der Gruppe beitreten |
| 🟢 WhatsApp — 🇧🇷 Brasilien | der Gruppe beitreten |
| 🌍 Website | omniroute.online |
| 🌍 🌍StHub OmniRoute-Community (kostenlos) | StHub-Portal |
| 📦 Quellcode | github.com/diegosouzapw/OmniRoute |
| 🐛 Fehler melden | Issue erstellen — Ausgabe von npm run system-info anhängen |
| 🤝 Mitwirken | CONTRIBUTING.md · Branching- & Release-Modell · ein good first issue auswählen |
| 💚 Das Projekt unterstützen | Möglichkeiten zur Unterstützung ↑ · GitHub Sponsors |
🛠️ Technologie-Stack
| Schicht | Technologie |
|---|---|
| Laufzeitumgebung | Node.js 22.x / 24.x LTS — >=22.22.2 <23 || >=24.0.0 <27 |
| Sprache | TypeScript 6.0 — 100 % TypeScript in src/ und open-sse/ (seit v2.0 kein any im Kern) |
| Framework | Next.js 16 + React 19 + Tailwind CSS 4 |
| Datenbank | better-sqlite3 (SQLite, WAL-Journaling) + LowDB (JSON-Altsystem) — 122 Domänenmodule, 176 Migrationen |
| Speicher | SQLite-FTS5-Volltextsuche + int8-quantisierte Vektoreinbettungen, typisierter Verfall |
| Schemata | Zod 4 — Validierung der Ein- und Ausgaben von MCP-Tools + API-Verträge |
| Protokolle | MCP (stdio / HTTP / SSE) + A2A v0.3 (JSON-RPC 2.0 + SSE) |
| Streaming | Server-Sent Events (SSE) + WebSocket-Bridge (/v1/ws) |
| Komprimierung | Pipeline mit 12 Engines — RTK, Caveman, LLMLingua-2 (MobileBERT ONNX), GCF, OmniGlyph |
| Authentifizierung & Sicherheit | OAuth 2.0 (PKCE) + JWT + API-Schlüssel + bereichsgebundene MCP-Authentifizierung · AES-256-GCM für ruhende Daten · DOMPurify |
| Tarnung | wreq-js — Nachahmung von JA3-/JA4-TLS-Fingerabdrücken, dreistufiger Proxy |
| Ausfallsicherheit | Schutzschalter, exponentieller Backoff, Schutz vor Anfragelawinen, selbstheilende automatische Kombinationen |
| Protokollierung | pino — strukturierte JSON-Protokolle mit Anfragekontext |
| Tests | Node.js-Test-Runner + Vitest — mehr als 39.000 statische Testdeklarationen in mehr als 5.100 nachverfolgten Testdateien (Unit-, Integrations-, E2E-, Sicherheits- und Ökosystemtests) |
| Plattformen | Desktop (Electron) · Android (Termux) · PWA (beliebiger Browser) |
| CI/CD | GitHub Actions — automatische Veröffentlichung auf npm und Docker Hub bei Releases |
| Links | Website · npm · Docker Hub |
📖 Dokumentation
📘 Erste Schritte
| Dokument | Beschreibung |
|---|---|
| Benutzerhandbuch | Anbieter, Kombinationen, CLI-Integration, Bereitstellung |
| Einrichtungsanleitung | Alle Installationsmethoden, Konfigurationen für CLI-Tools, Protokolleinrichtung, Timeout-Optimierung |
| Leitfaden für CLI-Tools | Toolspezifische Einrichtung für Claude Code, Codex, Cursor, Cline, OpenClaw, Kilo, Copilot |
| Remote-Modus | Eine entfernte OmniRoute-Instanz (VPS) über die CLI Ihres Laptops mithilfe bereichsgebundener Zugriffstoken steuern |
| Claude-Code-Konfiguration | Claude Code über launch und modellspezifische Profile mit OmniRoute (lokal/remote) verbinden |
| Schnellstart | Installation in 3 Schritten → verbinden → konfigurieren |
🔧 Betrieb und Bereitstellung
| Dokument | Beschreibung |
|---|---|
| Docker-Leitfaden | Docker-Ausführung, Compose-Profile, Caddy HTTPS, Tunnel, Image-Tags |
| Podman-Leitfaden | Quadlet-systemd-Integration, podman-compose, SELinux |
| VM-Bereitstellung | Vollständiger Leitfaden: Einrichtung von VM + nginx + Cloudflare |
| Fly.io-Bereitstellung | Bereitstellung auf Fly.io mit persistentem Speicher |
| Termux-Leitfaden | OmniRoute über Termux unter Android ausführen |
| PWA-Leitfaden | Installation, Caching und Architektur der Progressive Web App |
| Deinstallationsanleitung | Saubere Entfernung für alle Installationsmethoden |
| Umgebungskonfiguration | Vollständige .env-Variablen und Referenzen |
🧠 Funktionen und Architektur
| Dokument | Beschreibung |
|---|---|
| Architektur | Systemarchitektur, Datenfluss und interne Abläufe |
| Komprimierungsleitfaden | Pipeline mit 7 Optionen: aus / leicht / standard / aggressiv / ultra / RTK / gestapelt |
| RTK-Komprimierung | Komprimierung von Befehlsausgaben, Filter, Vertrauensprüfung, Verifizierung, Wiederherstellung der Rohausgabe |
| Komprimierungs-Engines | Caveman, RTK, gestapelte Pipelines, Dashboard-/API-/MCP-Oberflächen |
| Format der Komprimierungsregeln | JSON-Regelpaketschemas für Caveman- und RTK-Filter |
| Sprachpakete für die Komprimierung | Spracherkennung und Erstellung von Caveman-Regelpaketen |
| Resilienzleitfaden | Leistungsschalter, Abkühlzeiten, Warteschlange, Schutz vor Anfragestürmen, TLS-Spoofing |
| Auto-Combo-Engine | Bewertung anhand von 16 Faktoren, Moduspakete, Selbstheilung |
| Proxy-Leitfaden | 3-stufiges Proxy-System, 1proxy-Marktplatz, Registry-CRUD |
| Kostenlose Kontingente | Konsolidiertes Verzeichnis: 34 dokumentierte wiederkehrende Pools / 452 katalogisierte Einträge mit kostenlosem Kontingent |
| Funktionsübersicht | Visuelle Dashboard-Tour mit Screenshots |
| Codebasis-Dokumentation | Einsteigerfreundlicher Rundgang durch die Codebasis |
🤖 Protokolle und APIs
| Dokument | Beschreibung |
|---|---|
| API-Referenz | Alle Endpunkte mit Beispielen |
| OpenAPI-Spezifikation | OpenAPI-3.0-Spezifikation |
| MCP-Server | 110 MCP-Tools, IDE-Konfigurationen, Python-/TS-/Go-Clients |
| MCP-Server-Leitfaden | MCP-Installation, Transportmethoden und Tool-Referenz |
| A2A-Server | JSON-RPC-2.0-Protokoll, Fähigkeiten, Streaming, Aufgabenverwaltung |
| A2A-Server-Leitfaden | A2A-Agentenkarte, Aufgaben, Fähigkeiten und Streaming |
📋 Projekt und Qualität
| Dokument | Beschreibung |
|---|---|
| Mitwirken | Einrichtung der Entwicklungsumgebung und Richtlinien |
| Branching- und Release-Modell | Auf welche Branches PRs abzielen (release/*) und was main und Tags bedeuten |
| Änderungsprotokoll | Vollständiger Release-Verlauf nach Version |
| Sicherheitsrichtlinie | Meldung von Schwachstellen und Sicherheitspraktiken |
| i18n-Leitfaden | Unterstützung für 42 Sprachen, Übersetzungsworkflow, RTL |
| Release-Checkliste | Validierungsschritte vor dem Release |
| Abdeckungsplan | Testabdeckungsstrategie für über 39.000 statische Testdeklarationen in über 5.100 erfassten Testdateien |
⭐ Wichtigste Mitwirkende
OmniRoute wird von einer engagierten Open-Source-Community geprägt. Diese Personen haben außergewöhnliche Beiträge geleistet, die sich direkt auf die Qualität, Stabilität und Reichweite des Projekts auswirken. Vielen Dank.
Externe Mitwirkende nach zusammengeführten Pull Requests
| Rang | Mitwirkende | Zusammengeführte PRs | ~Geänderte Zeilen |
|---|---|---|---|
| 1 | backryun | 190 | 227,977 |
| 2 | oyi77 | 180 | 407,678 |
| 3 | rdself | 145 | 80,663 |
| 4 | JxnLexn | 128 | 387,049 |
| 5 | KooshaPari | 101 | 125,747 |
| 6 | herjarsa | 88 | 230,872 |
| 7 | RaviTharuma | 79 | 55,106 |
| 8 | maxmad64bis | 69 | 394,715 |
| 9 | artickc | 59 | 33,260 |
| 10 | HouMinXi | 51 | 47,334 |
| 10 | chirag127 | 51 | 5,153 |
| 12 | xz-dev | 50 | 245,976 |
| 13 | hartmark | 47 | 52,185 |
| 14 | rqzbeh | 39 | 143,181 |
| 15 | dhaern | 34 | 19,559 |
| 16 | Dingding-leo | 33 | 1,986 |
| 17 | NomenAK | 32 | 13,854 |
| 18 | MumuTW | 30 | 16,953 |
| 19 | benzntech | 29 | 11,641 |
| 20 | pacocartones | 24 | 9,331 |
| 20 | Prudhvivuda | 24 | 6,312 |
Stand des aktiven release/v3.8.50-Heads dafb4ae808, einschließlich Merges bis zum 2026-08-24 05:26:03 UTC. Die paginierte GitHub-GraphQL-Erhebung umfasst 5.911 zusammengeführte PRs: 2.707 vom Repository-Eigentümer, 179 von Dependabot und 3.025 externe PRs von 535 verschiedenen Mitwirkenden. „Geänderte Zeilen“ entspricht den GitHub-Additionen und -Löschungen und umfasst generierte Dateien, Lockfiles, Kataloge, Übersetzungen und Dokumentation; die Zahl gibt die Änderungsmenge und nicht die selbst verfassten Quellcodezeilen an. Gleichstände an der Aufnahmegrenze werden beibehalten.
Von GitHub zugeordnete Commits
|
backryun 🥇 220 von GitHub zugeordnete Commits |
Paijo 🥈 219 von GitHub zugeordnete Commits |
Randi 🥉 108 von GitHub zugeordnete Commits |
Ravi Tharuma 🏅 81 von GitHub zugeordnete Commits |
Chris 🏅 70 von GitHub zugeordnete Commits |
Markus Hartung 🏅 69 von GitHub zugeordnete Commits · geteilter 6. Platz |
|
Dizzle 🏅 69 von GitHub zugeordnete Commits · geteilter 6. Platz |
Jan Leon 🏅 64 von GitHub zugeordnete Commits |
zenobit 🏅 62 von GitHub zugeordnete Commits |
Bob.Hou 🏅 51 von GitHub zugeordnete Commits · geteilter 10. Platz |
Xiangzhe 🏅 51 von GitHub zugeordnete Commits · geteilter 10. Platz |
Erneut überprüft am 2026-08-24 um 06:14:31 UTC: von GitHub zugeordnete Commits, die von der Contributors API des Repositorys für den Standard-Branch release/v3.8.50 gemeldet wurden. Die API lieferte 525 Identitäten zurück (415 Benutzer, 2 Bots, 108 anonyme); diese Tabelle schließt den Maintainer, Bots und anonyme Identitäten aus und berücksichtigt geteilte Platzierungen. Sie unterscheidet sich sowohl von der Rangliste der zusammengeführten PRs oben als auch von der auf Git-Metadaten basierenden Erhebung mit 639 Personen unten.
🙏 Die Funktionen, Fehlerbehebungen und Infrastrukturverbesserungen dieser Mitwirkenden sind ein wesentlicher Bestandteil dessen, was OmniRoute zuverlässig und funktionsreich macht. Jeder Pull Request, jeder Testfall und jede i18n-Übersetzungsdatei zählt. Open Source wird von Menschen wie ihnen geschaffen.
💖 Sponsoren
Ein herzliches Dankeschön an die Menschen, die OmniRoute aus eigener Tasche finanzieren — jeder Beitrag sorgt dafür, dass das Projekt kostenlos, unabhängig und in Bewegung bleibt.
![]() Andrew 💛 Aktiver monatlicher Sponsor |
![]() Vlad I 💛 Aktiver monatlicher Sponsor |
![]() Paco Cartones 💛 Aktiver einmaliger Sponsor |
![]() Prof. Igor Morais 💛 Ehemaliger einmaliger Unterstützer |
![]() longtao 💛 Ehemaliger einmaliger Unterstützer |
… und weitere Personen, die lieber anonym bleiben 💛
Öffentliche GitHub-Sponsoren wurden am 2026-08-24 erneut validiert. Der activeOnly-Status von GitHub bestimmt die oben aufgeführten Aktiv-Kennzeichnungen; zuvor offengelegte öffentliche einmalige Unterstützer werden weiterhin gewürdigt, und private Sponsoren bleiben anonym.
💖 Sponsor werden → — jeder Dollar trägt dazu bei, dass OmniRoute kostenlos und unabhängig bleibt.
👥 Über 600 Mitwirkende
Geprüft am 2026-08-24 auf der eingefrorenen Basis ac02c5b42f und erneut an der aktuellen Spitze von release/v3.8.50 mit dafb4ae808 überprüft: 639 normalisierte menschliche Git-Identitäten — 407 erscheinen als Commit-Autoren (einschließlich des Maintainers) und 232 ausschließlich in expliziten Co-authored-by-Trailern. Die Erhebung normalisiert GitHub-Noreply-Handles, schließt 26 Bot-, Agenten-, Dienst- oder Platzhalteridentitäten aus und führt gewöhnliche E-Mail-Adressen nicht allein deshalb zusammen, weil ihre Anzeigenamen übereinstimmen.
So können Sie beitragen
- Forken Sie das Repository
- Erstellen Sie Ihren Branch von der Spitze des aktiven
release/vX.Y.Z-Branches (nicht vonmain) — siehe Branching- und Release-Modell - Erstellen Sie Ihren Feature-Branch (
git checkout -b feat/amazing-feature) - Committen Sie Ihre Änderungen (
git commit -m 'feat: add amazing feature') - Pushen Sie in den Branch (
git push origin feat/amazing-feature) - Öffnen Sie einen Pull Request mit base = diesem
release/vX.Y.Z-Branch
Ausführliche Richtlinien finden Sie in CONTRIBUTING.md.
Veröffentlichung einer neuen Version
# Release erstellen — npm publish erfolgt automatisch
VERSION=x.y.z
gh release create "v${VERSION}" --title "v${VERSION}" --generate-notes
📊 Sterne
🙏 Danksagungen
OmniRoute steht auf den Schultern von Giganten. Es begann als Fork von 9router und als TypeScript-Portierung des Go-Projekts CLIProxyAPI — und von da an wurde jedes der unten aufgeführten Subsysteme von einem Open-Source-Projekt inspiriert, das diesen Weg bereits zuvor beschritten hatte. Jedes davon hat einen konkreten Teil von OmniRoute geprägt. Dies ist unser Dank an sie alle. 🙏
⭐ Die Anzahl der Sterne wurde am 24. August 2026 über die REST API von GitHub verifiziert — gebt diesen Projekten einen Stern. Die Angaben sind eine exakte, datierte Momentaufnahme und werden sich selbstverständlich ändern.
🧬 Abstammung & Gateway
| Projekt | ⭐ | Wie es OmniRoute inspiriert hat |
|---|---|---|
| 9router | 26,161 | Das ursprüngliche Projekt, auf dem dieser Fork basiert — hier um multimodale APIs erweitert und vollständig in TypeScript neu geschrieben. |
| CLIProxyAPI | 48,497 | Die Go-Implementierung, die als Inspiration für diese JavaScript-/TypeScript-Portierung diente. |
| LiteLLM | 57,100 | Das KI-Gateway, dessen öffentlicher Preisdatenbestand unsere Synchronisierung zur Kostenverfolgung speist und dessen Modell zur Anbieter-Normalisierung unser Routing geprägt hat. |
| codex-chatgpt-web | 1,410 | MIT-lizenzierter Quellcode, der für die integrierte Brücke von ChatGPT Web zu Codex Responses angepasst wurde, einschließlich Adaptern für Browsersitzungen, Antwortformatierung, Nutzung und Websuche. |
| free-claude-code | 48,112 | Muster, die in die Stream-Wiederherstellung, Aliasse ohne Denkmodus, die ersatzweise Websuche, Sliding-Window-Limits, die Schwärzung von Protokolldaten und gehärtete Startabläufe portiert wurden. |
| composer-api | 322 | Muster von Cursor Composer für Werkzeugauswahl, Ausgabebeschränkungen und Werkzeugübermittlung, die für den nativen Cursor-Executor angepasst wurden. |
| codex-multi-auth | 457 | Muster für Neuanmeldung und Refresh-Token-Rotation, die in die erneute Codex-OAuth-Authentifizierung portiert wurden. |
| opencode-anthropic-auth | 510 | Claude-Code-kompatible Transformationsvorgaben und das Verhalten von Abrechnungs-Headern, die in OmniRoutes konfigurationsgesteuerter Brücke verallgemeinert wurden. |
| grok2api-merged | 2 | Seine Grok-Modellzuordnungen, der Fake-TypeError-Statsig-Generator, Anfrage- und Gerätevorgaben sowie der NDJSON-Antwortprozessor wurden in wesentlichem Umfang für OmniRoutes Grok-Web-Executor angepasst. |
| TQZHR/grok2api | 705 | Die wichtigste transitive Codequelle hinter grok2api-merged; ihre Implementierungen für Modelle, Header, Nutzlasten, Statsig und Prozessoren bleiben in der Entwicklungslinie von Grok Web erhalten. |
| chenyme/grok2api | 7,520 | Der zugrunde liegende MIT-lizenzierte Quellcode für Grok-Nutzlast- und Gerätevorgaben, den Statsig-Generator und den über TQZHR und grok2api-merged übernommenen result.response-Prozessor. |
| grok2api-pro | 27 | Eine transitive Quelle, die von grok2api-merged für dessen Proxy-Pool-Schicht genannt wird; OmniRoute bewahrt diesen Herkunftshinweis, beansprucht jedoch keine Portierung des Proxy-Pools in seinem klar abgegrenzten Grok-Web-Executor. |
| GrokProxy | 50 | Sein Cookie-authentifizierter Grok-Proxy und sein Streaming-Muster mit result.response.token dienten als Grundlage für OmniRoutes Grok-Web-Transport. |
| GrokBridge | 5 | Bei der ursprünglichen Grok-Web-Implementierung wurde dessen HTTP-/Browser-Upstream-Design herangezogen; da sein direkter HTTP-Pfad von GrokProxy abgeleitet ist, wird keine eigenständige Codeportierung beansprucht. |
| grok-web-api | 14 | Seine Rust-Schemas für ChatOptions und Antwortumschläge dienten als Grundlage für OmniRoutes TypeScript-Typen für Grok-Anfragen und Streaming-Antworten. |
🗜️ Kontext- und Token-Komprimierung — Engines
| Projekt | ⭐ | Wie es OmniRoute inspiriert hat |
|---|---|---|
| Caveman | 100,538 | Das virale „warum viele Token verwenden, wenn wenige Token reichen“-Projekt — seine Höhlenmenschen-Sprech-Philosophie bildet die Grundlage unseres Standardkomprimierungsmodus und von mehr als 30 Regeln zur Entfernung von Füllwörtern und zur Verdichtung. |
| RTK – Rust Token Killer | 77,185 | Hochleistungsfähige Komprimierung von Befehlsausgaben — inspirierte unsere RTK-Engine, die JSON-Filter-DSL, die Wiederherstellung von Rohausgaben und die gestapelte RTK-→-Caveman-Pipeline. |
| headroom | 67,310 | Reversible Kontextkomprimierung (SmartCrusher) — inspirierte unsere headroom-Engine und das ccr-Abrufmarkermuster. |
| LLMLingua | 6,598 | Forschung zur Prompt-Komprimierung (LLMLingua / LLMLingua-2) — inspirierte unsere asynchrone, codesichere und nach dem Fail-open-Prinzip arbeitende llmlingua-Engine. |
| llmlingua-2-js | 31 | Der JS/ONNX-Port (MobileBERT / XLM-RoBERTa), der als Worker-Thread-Backend für unsere LLMLingua-Engine verwendet wird. |
| Troglodita | 40 | PT-BR-Tokenkomprimierung — bildet die Grundlage unseres pt-BR-Sprachpakets: Reduzierung von Pleonasmen und Entfernung von Füllwörtern, abgestimmt auf die brasilianisch-portugiesische Grammatik. |
| ponytail | 108,957 | Der virale „faule Senior-Entwickler“-YAGNI-Coder-Skill — inspirierte unseren less-code-Ausgabestil: Ausrichtung auf die kleinstmögliche funktionierende Änderung, die den _generierten_ Code reduziert (das Pendant auf der Ausgabeachse zu Cavemans knapper Prosa). |
| i-have-adhd | 23,526 | Sein handlungsorientierter, ADHS-freundlicher Antwortstil wurde für OmniRoutes prägnanten Ausgabestil in fünf Sprachen adaptiert. |
🧩 Kompakte Formate, Token-Forschung & codebewusste Werkzeuge
| Projekt | ⭐ | Wie es OmniRoute inspiriert hat |
|---|---|---|
| TOON | 25,233 | Token-Oriented Object Notation — sein spaltenorientiertes Modell aus Kopfzeile und Zeilen prägte unsere tabellarische Komprimierungsstufe. |
| GCF – Graph Compact Format | 41 | Sein kompaktes Graphformat und das generische Profildesign flossen in OmniRoutes tabellarische Komprimierung und das Headroom-Codec-Format ein. |
| gcf-typescript | 4 | Die MIT-TypeScript-Implementierung, die direkt eingebunden und als generischer Headroom-Profil-Codec erweitert wurde. |
| token-optimizer-mcp | 494 | Brotli/SQLite-Cache + sitzungsbezogene Kontextdeltas — inspirierte unsere session-dedup-Engine. |
| token-savior | 1,122 | Komprimierung von Bash-Ausgaben + MCP-Profile — inspirierte unsere disziplinierte Abbruchstrategie bei der Komprimierung und die Reduzierung von MCP-Werkzeugmanifesten. |
| token-saver | 138 | Inhaltsabhängige Ausgabekomprimierung pro Dateityp mit fehlertoleranter Abbruchstrategie — bestätigte unsere typabhängige Weiterleitung und das Überspringen bei zu geringem Gewinn. |
| token-optimizer | 1,951 | „Finde die Geister-Token“ — sein Muster aus Auslagerung und wiederherstellbarem Handle prägte unsere Überlegungen zur CCR-Auslagerung. |
| TokenMizer | 28 | Eine Blaupause aus Sitzungsgraph und rundenübergreifender Zeilendeduplizierung, die unser session-dedup-Design prägte. |
| OmniCompress | 3 | Spaltenorientiertes JSON in Rust + inhaltsadressierter Abruf + nachrichtenübergreifende Deduplizierung — bestätigte das Design unserer headroom/ccr/session-dedup-Engines und die cache-stabile Invariante „die komprimierte Form ist positionsunabhängig“. |
| mcp-compressor | 113 | Komprimierung von MCP-Werkzeugschemata und -beschreibungen — floss in unsere Kardinalitätsreduktion von MCP-Werkzeugmanifesten ein. |
| RepoMapper | 197 | Repository-Karten-Rangfolge im Aider-Stil — floss in unsere Erkundung von Repository-Karten und Abrufrangfolgen ein. |
| quiet-shell-mcp | 4 | Deklarative Reduzierung von Shell-Ausgaben über MCP — bestätigte unsere deklarative Komprimierung von Bash-Ausgaben. |
| ts-morph | 6,162 | Toolkit für die TypeScript Compiler API — inspirierte unsere parserbasierte Entfernung von Kommentaren, bei der String-, Template- und Regex-Literale erhalten bleiben. |
🧠 Speicher & RAG
| Projekt | ⭐ | Wie es OmniRoute inspiriert hat |
|---|---|---|
| Mem0 | 63,902 | Universelle Speicherschicht — ihr Proxy-Modell als Schreib-/Lesegrenze prägte unsere Speicherarchitektur. |
| Letta (MemGPT) | 24,382 | Zustandsbehaftete Agenten mit mehrstufigem Speicher — inspirierten unser mehrstufiges Modell für Context Control & Recovery (CCR). |
| WFGY | 1,781 | Die ProblemMap-Taxonomie von 16 wiederkehrenden RAG-/LLM-Fehlermodi — das gemeinsame Vokabular in unserem Leitfaden zur Fehlerbehebung. |
🛰️ Datenverkehrsanalyse, MITM & transparenter Proxy
| Projekt | ⭐ | Wie es OmniRoute inspiriert hat |
|---|---|---|
| llm-interceptor | 66 | Die MITM-Überwachung/-Analyse des Datenverkehrs zwischen Programmierassistenten und LLMs floss in die frühen Anforderungen an den Traffic Inspector ein. Vier zuvor abgeleitete Module — SSE-Zusammenführung, Konversationsnormalisierung, Maskierung geheimer Daten und Header-Bereinigung — wurden durch unabhängige Clean-Room-Implementierungen ersetzt, die auf öffentlichen Protokollstandards basieren. Die beiden Oberflächen für Host-Passthrough (passthrough.ts und _internal/bypass.cjs) bleiben interne OmniRoute-Implementierungen, die unabhängig klassifiziert sind; sie wurden im Rahmen dieser Ersetzung nicht neu geschrieben. |
| ProxyBridge | 5,995 | Transparente, prozessbezogene Proxy-Weiterleitung — inspirierte unseren absturzsicheren MITM-Abbau, Socket-Leerlaufzeitüberschreitungen, die Prozesszuordnung über /proc und die TPROXY-Erfassung. |
📚 Modelldaten, Observability & Benutzeroberfläche
| Projekt | ⭐ | Wie es OmniRoute inspiriert hat |
|---|---|---|
| models.dev | 6,555 | Offene Datenbank mit Spezifikationen, Preisen und Fähigkeiten von KI-Modellen — wird nativ mit unserem Modellkatalog synchronisiert. |
| React Flow / xyflow | 38,108 | Die knotenbasierte Graphbibliothek, auf der unser Compression Studio und Combo/Routing Studio in Echtzeit basieren. |
| LangGraph | 40,314 | Die Live-Visualisierung von Workflow-Graphen in LangGraph Studio inspirierte die Echtzeit-Kaskadenansicht unserer Studios. |
| Langfuse | 33,592 | Sein Observability-Modell „Trace → Span → Generation“ prägte die Wasserfallansicht unseres Compression Studio. |
| Kiali | 3,631 | Observability für Istio-Service-Meshes — inspirierte unsere Circuit-Breaker-Badges und die visuelle Darstellung von Fehlerkanten im Routing/Combo Studio. |
| lobe-icons | 2,428 | KI-/LLM-Markenlogos, die zur Darstellung der Anbieter-Symbole in unserem Dashboard dienen. |
| flag-icons | 12,354 | Stellt die MIT-lizenzierten SVG-Flaggen bereit, die von der Sprachauswahl in der README verwendet werden. |
🛡️ Sicherheit
| Projekt | ⭐ | Wie es OmniRoute inspiriert hat |
|---|---|---|
| awesome-secure-defaults | 721 | Eine kuratierte Liste standardmäßig sicherer Bibliotheken, die unsere Sicherheitsentscheidungen leitet (Helmet.js, DOMPurify, ssrf-req-filter, safe-regex, Google Tink). |
🧭 Ergänzende Werkzeuge
| Projekt | ⭐ | Wie es OmniRoute inspiriert hat |
|---|---|---|
| ClawRouter | 6,564 | Inspirierte die Deduplizierung von Anfragen, einen kostenlosen Notfall-Fallback, austauschbare Auto-Combo-Strategien und die mehrsprachige Absichtsklassifizierung. |
| Antigravity-Manager | 30,652 | Seine kontobasierte Modellneuzuordnung, die Validierung ausführbarer Pfade und das Verhalten von Tarifbezeichnungen flossen in die Antigravity-Laufzeitumgebung von OmniRoute ein. |
| vscode-antigravity-cockpit | 4,817 | Sein kompaktes Countdown-Format für das Zurücksetzen von Kontingenten inspirierte die entsprechende Anzeige von Anbieterlimits in OmniRoute. |
| AionUi | 32,230 | Seine ACP-Integrationen inspirierten die automatische Erkennung installierter CLI-Agenten durch OmniRoute. |
| CodexBar | 20,507 | Identifizierte die Grok-Build-Kontingentschnittstelle; OmniRoute überprüfte und korrigierte anschließend das aktuelle Übertragungsformat unabhängig. |
📄 Lizenz
MIT-Lizenz – Details finden Sie unter LICENSE.
⬆ Zurück nach oben · Mit ❤️ für die Open-Source-KI-Community entwickelt.
OmniRoute v3.8.51 · Node ≥22.22.2 · MIT-Lizenz · omniroute.online





