# đ OmniRoute â Das kostenlose KI-Gateway
### Hören Sie nie auf zu programmieren. Intelligentes Routing zu **KOSTENLOSEN und kostengĂŒnstigen KI-Modellen** mit automatischem Fallback.
_Ihr universeller API-Proxy â ein Endpunkt, mehr als 36 Anbieter, keine Ausfallzeiten. Jetzt mit **MCP & A2A** Agenten-Orchestrierung._
**Chat-AbschlĂŒsse âą Einbettungen âą Bildgenerierung âą Video âą Musik âą Audio âą Reranking âą MCP-Server âą A2A-Protokoll âą 100 % TypeScript**
---
[](https://www.npmjs.com/package/omniroute)
[](https://hub.docker.com/r/diegosouzapw/omniroute)
[](https://github.com/diegosouzapw/OmniRoute/blob/main/LICENSE)
[](https://omniroute.online)
[](https://chat.whatsapp.com/JI7cDQ1GyaiDHhVBpLxf8b?mode=gi_t)
[đ Website](https://omniroute.online) âą [đ Schnellstart](#-quick-start) âą [đĄ Funktionen](#-key-features) âą [đ Dokumente](#-documentation) âą [đ° Preise](#-pricing-at-a-glance) âą [đŹ WhatsApp](https://chat.whatsapp.com/JI7cDQ1GyaiDHhVBpLxf8b?mode=gi_t)
đ **VerfĂŒgbar in:** đșđž [Englisch](README.md) | đ§đ· [PortuguĂȘs (Brasilien)](README.pt-BR.md) | đȘđž [Español](README.es.md) | đ«đ· [Français](README.fr.md) | đźđč [Italienisch](README.it.md) | đ·đș [Đ ŃŃŃĐșĐžĐč](README.ru.md) | đšđł [äžæ (çźäœ)](README.zh-CN.md) | đ©đȘ [Deutsch](README.de.md) | đźđł [à€čà€żà€šà„à€Šà„](README.in.md) | đčđ [àčàžàžą](README.th.md) | đșđŠ [ĐŁĐșŃаŃĐœŃŃĐșа](README.uk-UA.md) | đžđŠ [ۧÙŰč۱ۚÙŰ©](README.ar.md) | đŻđ” [æ„æŹèȘ](README.ja.md) | đ»đł [Tiáșżng Viá»t](README.vi.md) | đ§đŹ [ĐŃлгаŃŃĐșĐž](README.bg.md) | đ©đ° [DĂ€nisch](README.da.md) | đ«đź [Suomi](README.fi.md) | đźđ± [ŚąŚŚšŚŚȘ](README.he.md) | đđș [Magyar](README.hu.md) | đźđ© [Bahasa Indonesia](README.id.md) | đ°đ· [íê”ìŽ](README.ko.md) | đČđŸ [Bahasa Melayu](README.ms.md) | đłđ± [Niederlande](README.nl.md) | đłđŽ [Norsk](README.no.md) | đ”đč [PortuguĂȘs (Portugal)](README.pt.md) | đ·đŽ [RomĂąnÄ](README.ro.md) | đ”đ± [Polski](README.pl.md) | đžđ° [SlovenÄina](README.sk.md) | đžđȘ [Svenska](README.sv.md) | đ”đ [Philippinisch](README.phi.md)
---
## đŒïž Haupt-Dashboard
---
## đž Dashboard-Vorschau
Klicken Sie hier, um Dashboard-Screenshots anzuzeigen
| Seite | Screenshot |
| ---------------------- | -------------------------------------------------- |
| **Anbieter** |  |
| **Kombinationen** |  |
| **Analytik** |  |
| **Gesundheit** |  |
| **Ăbersetzer** |  |
| **Einstellungen** |  |
| **CLI-Tools** |  |
| **Nutzungsprotokolle** |  |
| **Endpunkt** |  |
---
### đ€ Kostenloser KI-Anbieter fĂŒr Ihre bevorzugten Programmieragenten
_Verbinden Sie jedes KI-gestĂŒtzte IDE- oder CLI-Tool ĂŒber OmniRoute â kostenloses API-Gateway fĂŒr unbegrenzte Codierung._
đĄ Alle Agenten verbinden sich ĂŒber http://localhost:20128/v1 oder quote
---
## đ€ Warum OmniRoute?
**Hören Sie auf, Geld zu verschwenden und an Grenzen zu stoĂen:**
- Das Abonnementkontingent lÀuft jeden Monat ungenutzt ab
- Ratenbegrenzungen verhindern, dass Sie mitten in der Codierung sind
- Teure APIs (20â50Â $/Monat pro Anbieter)
- Manueller Wechsel zwischen Anbietern
**OmniRoute löst dieses Problem:**
- â
**Abonnements maximieren** - Verfolgen Sie das Kontingent, nutzen Sie jedes Bit vor dem ZurĂŒcksetzen
- â
**Auto-Fallback** â Abonnement â API-SchlĂŒssel â GĂŒnstig â Kostenlos, keine Ausfallzeiten
- â
**Mehrere Konten** â Round-Robin zwischen Konten pro Anbieter
- â
**Universell** â Funktioniert mit Claude Code, Codex, Gemini CLI, Cursor, Cline, OpenClaw und jedem CLI-Tool
---
## đ§ UnterstĂŒtzung> đŹ **Treten Sie unserer Community bei!** [WhatsApp-Gruppe](https://chat.whatsapp.com/JI7cDQ1GyaiDHhVBpLxf8b?mode=gi_t) â Holen Sie sich Hilfe, tauschen Sie Tipps aus und bleiben Sie auf dem Laufenden.
- **Website**: [omniroute.online](https://omniroute.online)
- **GitHub**: [github.com/diegosouzapw/OmniRoute](https://github.com/diegosouzapw/OmniRoute)
- **Probleme**: [github.com/diegosouzapw/OmniRoute/issues](https://github.com/diegosouzapw/OmniRoute/issues)
- **WhatsApp**: [Community-Gruppe](https://chat.whatsapp.com/JI7cDQ1GyaiDHhVBpLxf8b?mode=gi_t)
- **Mitwirken**: Siehe [CONTRIBUTING.md](CONTRIBUTING.md), öffnen Sie eine PR oder wÀhlen Sie eine `good first issue` aus
- **Originalprojekt**: [9router von decolua](https://github.com/decolua/9router)
---
## đ Wie es funktioniert
```
âââââââââââââââ
â Your CLI â (Claude Code, Codex, Gemini CLI, OpenClaw, Cursor, Cline...)
â Tool â
ââââââââŹâââââââ
â http://localhost:20128/v1
â
âââââââââââââââââââââââââââââââââââââââââââ
â OmniRoute (Smart Router) â
â âą Format translation (OpenAI â Claude) â
â âą Quota tracking + Embeddings + Images â
â âą Auto token refresh â
ââââââââŹâââââââââââââââââââââââââââââââââââ
â
âââ [Tier 1: SUBSCRIPTION] Claude Code, Codex, Gemini CLI
â â quota exhausted
âââ [Tier 2: API KEY] DeepSeek, Groq, xAI, Mistral, NVIDIA NIM, etc.
â â budget limit
âââ [Tier 3: CHEAP] GLM ($0.6/1M), MiniMax ($0.2/1M)
â â budget limit
âââ [Tier 4: FREE] iFlow, Qwen, Kiro (unlimited)
Result: Never stop coding, minimal cost
```
---
## đŻ Was OmniRoute löst â 30 echte Problempunkte und AnwendungsfĂ€lle
> **Jeder Entwickler, der KI-Tools verwendet, ist tĂ€glich mit diesen Problemen konfrontiert.** OmniRoute wurde entwickelt, um sie alle zu lösen â von KostenĂŒberschreitungen bis hin zu regionalen Blockaden, von unterbrochenen OAuth-FlĂŒssen bis hin zu ProtokollvorgĂ€ngen und Unternehmensbeobachtbarkeit.
đž 1. âIch bezahle ein teures Abonnement, werde aber trotzdem durch Limits unterbrochenâ
Entwickler zahlen 20â200 US-Dollar/Monat fĂŒr Claude Pro, Codex Pro oder GitHub Copilot. Auch wenn das Kontingent bezahlt wird, gibt es eine Obergrenze â 5 Stunden Nutzung, wöchentliche Limits oder Tariflimits pro Minute. WĂ€hrend der Codierungssitzung reagiert der Anbieter nicht mehr und der Entwickler verliert an Fluss und ProduktivitĂ€t.
**So löst OmniRoute das Problem:**
- **Intelligenter 4-Stufen-Fallback** â Wenn das Abonnementkontingent aufgebraucht ist, wird automatisch zu API Key â GĂŒnstig â Kostenlos weitergeleitet, ohne dass ein manueller Eingriff erforderlich ist
- **Kontingentverfolgung in Echtzeit** â Zeigt den Token-Verbrauch in Echtzeit mit Reset-Countdown an (5 Stunden, tĂ€glich, wöchentlich)
- **UnterstĂŒtzung mehrerer Konten** â Mehrere Konten pro Anbieter mit automatischem Round-Robin â wenn eines aufgebraucht ist, wird zum nĂ€chsten gewechselt
- **Benutzerdefinierte Kombinationen** â Anpassbare Fallback-Ketten mit 6 Ausgleichsstrategien (Fill-First, Round-Robin, P2C, Random, Least-Used, Kostenoptimiert)
- **Codex Business Quotas** â Ăberwachung der GeschĂ€fts-/Team-Arbeitsbereichskontingente direkt im Dashboard
đ 2. âIch muss mehrere Anbieter verwenden, aber jeder hat eine andere APIâ
OpenAI verwendet ein Format, Claude (Anthropic) verwendet ein anderes, Gemini noch ein anderes. Wenn ein Entwickler Modelle verschiedener Anbieter testen oder zwischen ihnen wechseln möchte, muss er SDKs neu konfigurieren, Endpunkte Ă€ndern und mit inkompatiblen Formaten umgehen. Benutzerdefinierte Anbieter (FriendLI, NIM) verfĂŒgen ĂŒber nicht standardmĂ€Ăige Modellendpunkte.
**So löst OmniRoute das Problem:**
- **Einheitlicher Endpunkt** â Ein einzelner `http://localhost:20128/v1` dient als Proxy fĂŒr alle ĂŒber 36 Anbieter
- **FormatĂŒbersetzung** â Automatisch und transparent: OpenAI â Claude â Gemini â Responses API
- **Antwortbereinigung** â Entfernt nicht standardmĂ€Ăige Felder (`x_groq`, `usage_breakdown`, `service_tier`), die OpenAI SDK v1.83+ beschĂ€digen
- **Rollennormalisierung** â Konvertiert `developer` â `system` fĂŒr Nicht-OpenAI-Anbieter; `system` â `user` fĂŒr GLM/ERNIE
- **Think Tag Extraction** â Extrahiert ``-Blöcke aus Modellen wie DeepSeek R1 in das standardisierte `reasoning_content`
- **Strukturierte Ausgabe fĂŒr Gemini** â `json_schema` â `responseMimeType`/`responseSchema` automatische Konvertierung
- **`stream` ist standardmĂ€Ăig `false`** â Entspricht der OpenAI-Spezifikation und vermeidet unerwartetes SSE in Python/Rust/Go-SDKs
đ 3. âMein KI-Anbieter blockiert meine Region/mein Landâ
Anbieter wie OpenAI/Codex blockieren den Zugriff aus bestimmten geografischen Regionen. Benutzer erhalten bei OAuth- und API-Verbindungen Fehler wie `unsupported_country_region_territory`. Dies ist besonders frustrierend fĂŒr Entwickler aus EntwicklungslĂ€ndern.
**So löst OmniRoute das Problem:**
- **3-Level-Proxy-Konfiguration** â Konfigurierbarer Proxy auf 3 Ebenen: global (gesamter Datenverkehr), pro Anbieter (nur ein Anbieter) und pro Verbindung/SchlĂŒssel
- **Farbcodierte Proxy-Abzeichen** â Visuelle Indikatoren: đą globaler Proxy, đĄ Anbieter-Proxy, đ” Verbindungs-Proxy, immer mit IP-Adresse
- **OAuth-Token-Austausch ĂŒber Proxy** â Der OAuth-Fluss lĂ€uft auch ĂŒber den Proxy und löst `unsupported_country_region_territory`
- **Verbindungstests ĂŒber Proxy** â Verbindungstests verwenden den konfigurierten Proxy (keine direkte Umgehung mehr)
- **SOCKS5-UnterstĂŒtzung** â VollstĂ€ndige SOCKS5-Proxy-UnterstĂŒtzung fĂŒr ausgehendes Routing
- **TLS-Fingerabdruck-Spoofing** â BrowserĂ€hnlicher TLS-Fingerabdruck ĂŒber `wreq-js` zur Umgehung der Bot-Erkennung
đ 4. âIch möchte KI zum Codieren verwenden, habe aber kein Geldâ
Nicht jeder kann 20â200 $/Monat fĂŒr KI-Abonnements bezahlen. Studenten, Entwickler aus SchwellenlĂ€ndern, Bastler und Freiberufler benötigen Zugang zu hochwertigen Modellen zum Nulltarif.
**So löst OmniRoute das Problem:**
- **Integrierte kostenlose Anbieter** â Native UnterstĂŒtzung fĂŒr 100 % kostenlose Anbieter: iFlow (8 unbegrenzte Modelle), Qwen (3 unbegrenzte Modelle), Kiro (Claude kostenlos), Gemini CLI (180.000/Monat kostenlos)
- **Nur kostenlose Combos** â Kette `gc/gemini-3-flash â if/kimi-k2-thinking â qw/qwen3-coder-plus` = 0 $/Monat ohne Ausfallzeit
- **NVIDIA NIM Free Credits** â 1000 kostenlose Credits integriert
- **Kostenoptimierte Strategie** â Routing-Strategie, die automatisch den gĂŒnstigsten verfĂŒgbaren Anbieter auswĂ€hlt
đ 5. âIch muss mein KI-Gateway vor unbefugtem Zugriff schĂŒtzenâ
Wenn ein KI-Gateway dem Netzwerk (LAN, VPS, Docker) zugĂ€nglich gemacht wird, kann jeder mit der Adresse die Token/Kontingente des Entwicklers verbrauchen. Ohne Schutz sind APIs anfĂ€llig fĂŒr Missbrauch, sofortige Injektion und Missbrauch.
**So löst OmniRoute das Problem:**
- **API-SchlĂŒsselverwaltung** â Generierung, Rotation und Scoping pro Anbieter mit einer dedizierten `/dashboard/api-manager`-Seite
- **Berechtigungen auf Modellebene** â BeschrĂ€nken Sie API-SchlĂŒssel auf bestimmte Modelle (`openai/*`, Platzhaltermuster) mit der Umschaltfunktion âAlle zulassen/EinschrĂ€nkenâ.
- **API Endpoint Protection** â Fordern Sie einen SchlĂŒssel fĂŒr `/v1/models` an und blockieren Sie bestimmte Anbieter aus der Liste
- **Auth Guard + CSRF-Schutz** â Alle Dashboard-Routen sind mit `withAuth`-Middleware + CSRF-Tokens geschĂŒtzt
- **Ratenbegrenzer** â Ratenbegrenzung pro IP mit konfigurierbaren Fenstern
- **IP-Filterung** â Zulassungs-/Blockierungsliste fĂŒr die Zugriffskontrolle
- **Prompt Injection Guard** â Bereinigung gegen bösartige Eingabeaufforderungsmuster
- **AES-256-GCM-VerschlĂŒsselung** â Anmeldeinformationen im Ruhezustand verschlĂŒsselt
đ 6. âMein Provider ist ausgefallen und ich habe meinen Codierungsfluss verlorenâ KI-Anbieter können instabil werden, 5xx-Fehler zurĂŒckgeben oder vorĂŒbergehende Ratengrenzen erreichen. Wenn ein Entwickler von einem einzelnen Anbieter abhĂ€ngig ist, wird er unterbrochen. Ohne Schutzschalter können wiederholte Versuche zum Absturz der Anwendung fĂŒhren.
**So löst OmniRoute das Problem:**
- **Leistungsschalter pro Anbieter** â Automatisches Ăffnen/SchlieĂen mit konfigurierbaren Schwellenwerten und Abklingzeit (geschlossen/offen/halb offen)
- **Exponentielles Backoff** â Progressive Wiederholungsverzögerungen
- **Anti-Thundering Herd** â Mutex + Semaphor-Schutz gegen gleichzeitige WiederholungsstĂŒrme
- **Combo-Fallback-Ketten** â Wenn der primĂ€re Anbieter ausfĂ€llt, fĂ€llt er automatisch durch die Kette, ohne dass ein Eingreifen erforderlich ist
- **Combo Circuit Breaker** â Deaktiviert automatisch ausgefallene Anbieter innerhalb einer Combo-Kette
- **Gesundheits-Dashboard** â BetriebszeitĂŒberwachung, LeistungsschalterzustĂ€nde, Sperren, Cache-Statistiken, p50/p95/p99-Latenz
đ§ 7. âDie Konfiguration jedes KI-Tools ist mĂŒhsam und repetitivâ
Entwickler verwenden Cursor, Claude Code, Codex CLI, OpenClaw, Gemini CLI, Kilo Code ... Jedes Tool benötigt eine andere Konfiguration (API-Endpunkt, SchlĂŒssel, Modell). Eine Neukonfiguration bei einem Anbieter- oder Modellwechsel ist Zeitverschwendung.
**So löst OmniRoute das Problem:**
- **CLI Tools Dashboard** â Spezielle Seite mit Ein-Klick-Einrichtung fĂŒr Claude Code, Codex CLI, OpenClaw, Kilo Code, Antigravity, Cline
- **GitHub Copilot Config Generator** â Generiert `chatLanguageModels.json` fĂŒr VS-Code mit Massenmodellauswahl
- **Onboarding-Assistent** â GefĂŒhrte Einrichtung in 4 Schritten fĂŒr Erstbenutzer
- **Ein Endpunkt, alle Modelle** â Konfigurieren Sie `http://localhost:20128/v1` einmal und greifen Sie auf ĂŒber 36 Anbieter zu
đ 8. âOAuth-Tokens von mehreren Anbietern zu verwalten ist die Hölleâ
Claude Code, Codex, Gemini CLI, Copilot â alle verwenden OAuth 2.0 mit ablaufenden Token. Entwickler mĂŒssen sich stĂ€ndig neu authentifizieren, sich mit `client_secret is missing`, `redirect_uri_mismatch` und Fehlern auf Remote-Servern auseinandersetzen. Besonders problematisch ist OAuth auf LAN/VPS.
**So löst OmniRoute das Problem:**
- **Automatische Token-Aktualisierung** â OAuth-Tokens werden vor Ablauf im Hintergrund aktualisiert
- **OAuth 2.0 (PKCE) integriert** â Automatischer Ablauf fĂŒr Claude Code, Codex, Gemini CLI, Copilot, Kiro, Qwen, iFlow
- **Multi-Account OAuth** â Mehrere Konten pro Anbieter ĂŒber JWT/ID-Token-Extraktion
- **OAuth LAN/Remote Fix** â Private IP-Erkennung fĂŒr `redirect_uri` + manueller URL-Modus fĂŒr Remote-Server
- **OAuth Behind Nginx** â Verwendet `window.location.origin` fĂŒr Reverse-Proxy-KompatibilitĂ€t
- **Remote OAuth Guide** â Schritt-fĂŒr-Schritt-Anleitung fĂŒr Google Cloud-Anmeldeinformationen auf VPS/Docker
đ 9. âIch weiĂ nicht, wie viel ich ausgebe oder woâ
Entwickler nutzen mehrere kostenpflichtige Anbieter, haben jedoch keine einheitliche Sicht auf die Ausgaben. Jeder Anbieter verfĂŒgt ĂŒber ein eigenes Abrechnungs-Dashboard, es gibt jedoch keine konsolidierte Ansicht. Unerwartete Kosten können sich hĂ€ufen.
**So löst OmniRoute das Problem:**
- **Kostenanalyse-Dashboard** â Kostenverfolgung pro Token und Budgetverwaltung pro Anbieter
- **Budgetgrenzen pro Stufe** â Ausgabenobergrenze pro Stufe, die einen automatischen Fallback auslöst
- **Preiskonfiguration pro Modell** â Konfigurierbare Preise pro Modell- **Nutzungsstatistiken pro API-SchlĂŒssel** â Anzahl der Anfragen und zuletzt verwendeter Zeitstempel pro SchlĂŒssel
- **Analytics-Dashboard** â Statistikkarten, Modellnutzungsdiagramm, Anbietertabelle mit Erfolgsraten und Latenz
đ 10. âIch kann Fehler und Probleme bei KI-Anrufen nicht diagnostizierenâ
Wenn ein Anruf fehlschlĂ€gt, weiĂ der Entwickler nicht, ob es sich um eine Ratenbegrenzung, ein abgelaufenes Token, ein falsches Format oder einen Anbieterfehler handelt. Fragmentierte Protokolle ĂŒber verschiedene Terminals hinweg. Ohne Beobachtbarkeit ist das Debuggen ein Versuch und Irrtum.
**So löst OmniRoute das Problem:**
- **Unified Logs Dashboard** â 4 Registerkarten: Anforderungsprotokolle, Proxy-Protokolle, Audit-Protokolle, Konsole
- **Console Log Viewer** â Echtzeit-Viewer im Terminal-Stil mit farbcodierten Ebenen, automatischem Scrollen, Suche und Filter
- **SQLite-Proxy-Protokolle** â Persistente Protokolle, die Serverneustarts ĂŒberdauern
- **Translator Playground** â 4 Debugging-Modi: Playground (FormatĂŒbersetzung), Chat Tester (Round-Trip), Test Bench (Batch), Live Monitor (Echtzeit)
- **Telemetrie anfordern** â p50/p95/p99-Latenz + X-Request-Id-Ablaufverfolgung
- **Dateibasierte Protokollierung mit Rotation** â Der Konsolen-Interceptor erfasst alles im JSON-Protokoll mit gröĂenbasierter Rotation
đïž 11. âDie Bereitstellung und Wartung des Gateways ist komplexâ
Die Installation, Konfiguration und Wartung eines KI-Proxys in verschiedenen Umgebungen (lokal, VPS, Docker, Cloud) ist arbeitsintensiv. Probleme wie hartcodierte Pfade, `EACCES` in Verzeichnissen, Portkonflikte und plattformĂŒbergreifende Builds sorgen fĂŒr zusĂ€tzliche Reibung.
**So löst OmniRoute das Problem:**
- **npm globale Installation** â `npm install -g omniroute && omniroute` â fertig
- **Docker Multi-Platform** â AMD64 + ARM64 nativ (Apple Silicon, AWS Graviton, Raspberry Pi)
- **Docker Compose-Profile** â `base` (keine CLI-Tools) und `cli` (mit Claude Code, Codex, OpenClaw)
- **Electron Desktop App** â Native App fĂŒr Windows/macOS/Linux mit Taskleiste, Autostart, Offline-Modus
- **Split-Port-Modus** â API und Dashboard auf separaten Ports fĂŒr erweiterte Szenarien (Reverse-Proxy, Container-Netzwerk)
- **Cloud Sync** â Konfigurieren Sie die gerĂ€teĂŒbergreifende Synchronisierung ĂŒber Cloudflare Workers
- **DB-Backups** â Automatische Sicherung, Wiederherstellung, Export und Import aller Einstellungen
đ 12. âDie BenutzeroberflĂ€che ist nur auf Englisch verfĂŒgbar und mein Team spricht kein Englischâ
Teams in nicht englischsprachigen LÀndern, insbesondere in Lateinamerika, Asien und Europa, haben Probleme mit rein englischsprachigen BenutzeroberflÀchen. Sprachbarrieren verringern die Akzeptanz und erhöhen die Zahl von Konfigurationsfehlern.
**So löst OmniRoute das Problem:**
- **Dashboard i18n â 30 Sprachen** â Alle ĂŒber 500 Tasten ĂŒbersetzt, einschlieĂlich Arabisch, Bulgarisch, DĂ€nisch, Deutsch, Spanisch, Finnisch, Französisch, HebrĂ€isch, Hindi, Ungarisch, Indonesisch, Italienisch, Japanisch, Koreanisch, Malaiisch, NiederlĂ€ndisch, Norwegisch, Polnisch, Portugiesisch (PT/BR), RumĂ€nisch, Russisch, Slowakisch, Schwedisch, ThailĂ€ndisch, Ukrainisch, Vietnamesisch, Chinesisch, Philippinisch, Englisch
- **RTL-UnterstĂŒtzung** â Rechts-nach-links-UnterstĂŒtzung fĂŒr Arabisch und HebrĂ€isch
- **Mehrsprachige READMEs** â 30 vollstĂ€ndige DokumentationsĂŒbersetzungen
- **Sprachauswahl** â Globussymbol in der Kopfzeile zum Umschalten in Echtzeit
đ 13. âIch brauche mehr als nur Chat â ich brauche Einbettungen, Bilder, Audioâ
KI ist nicht nur der Abschluss eines Chats. Entwickler mĂŒssen Bilder generieren, Audio transkribieren, Einbettungen fĂŒr RAG erstellen, Dokumente neu einordnen und Inhalte moderieren. Jede API hat einen anderen Endpunkt und ein anderes Format.
**So löst OmniRoute das Problem:**
- **Einbettungen** â `/v1/embeddings` mit 6 Anbietern und 9+ Modellen
- **Bildgenerierung** â `/v1/images/generations` mit 10 Anbietern und ĂŒber 20 Modellen (OpenAI, xAI, Together, Fireworks, Nebius, Hyperbolic, NanoBanana, Antigravity, SD WebUI, ComfyUI)
- **Text-zu-Video** â `/v1/videos/generations` â ComfyUI (AnimateDiff, SVD) und SD WebUI
- **Text-zu-Musik** â `/v1/music/generations` â ComfyUI (Stable Audio Open, MusicGen)
- **Audiotranskription** â `/v1/audio/transcriptions` â Whisper + Nvidia NIM, HuggingFace, Qwen3
- **Text-to-Speech** â `/v1/audio/speech` â ElevenLabs, Nvidia NIM, HuggingFace, Coqui, Tortoise, Qwen3, + bestehende Anbieter
- **Moderationen** â `/v1/moderations` â ĂberprĂŒfung der Inhaltssicherheit
- **Neueinstufung** â `/v1/rerank` â Neueinstufung der Dokumentenrelevanz
- **Antwort-API** â VollstĂ€ndige `/v1/responses`-UnterstĂŒtzung fĂŒr Codex
đ§Ș 14. âIch habe keine Möglichkeit, die QualitĂ€t verschiedener Modelle zu testen und zu vergleichenâ
Entwickler möchten wissen, welches Modell fĂŒr ihren Anwendungsfall am besten geeignet ist â Code, Ăbersetzung, Argumentation â, aber ein manueller Vergleich ist langsam. Es sind keine integrierten Evaluierungstools vorhanden.
**So löst OmniRoute das Problem:**
- **LLM-Bewertungen** â Golden-Set-Test mit 10 vorinstallierten FĂ€llen zu BegrĂŒĂungen, Mathematik, Geografie, Codegenerierung, JSON-KonformitĂ€t, Ăbersetzung, Markdown und Sicherheitsverweigerung
- **4 Match-Strategien** â `exact`, `contains`, `regex`, `custom` (JS-Funktion)
- **Translator Playground Test Bench** â Batch-Tests mit mehreren Eingaben und erwarteten Ausgaben, anbieterĂŒbergreifender Vergleich
- **Chat-Tester** â VollstĂ€ndiger Roundtrip mit visueller Antwortwiedergabe
- **Live-Monitor** â Echtzeit-Stream aller Anfragen, die ĂŒber den Proxy flieĂen
đ 15. âIch muss skalieren, ohne an Leistung einzubĂŒĂenâ
Wenn das Anfragevolumen wĂ€chst, verursachen dieselben Fragen ohne Zwischenspeicherung doppelte Kosten. Ohne Idempotenz verschwenden doppelte Anfragen die Verarbeitung. Die Tarifbegrenzungen pro Anbieter mĂŒssen eingehalten werden.
**So löst OmniRoute das Problem:**
- **Semantischer Cache** â Zweistufiger Cache (Signatur + Semantik) reduziert Kosten und Latenz
- **Request Idempotency** â 5-Sekunden-Deduplizierungsfenster fĂŒr identische Anfragen
- **Ratenbegrenzungserkennung** â Provider-RPM, minimale LĂŒcke und maximale gleichzeitige Verfolgung
- **Bearbeitbare Ratengrenzen** â Konfigurierbare Standardeinstellungen unter Einstellungen â Ausfallsicherheit mit Persistenz
- **API Key Validation Cache** â 3-stufiger Cache fĂŒr Produktionsleistung
- **Gesundheits-Dashboard mit Telemetrie** â p50/p95/p99-Latenz, Cache-Statistiken, Betriebszeit
đ€ 16. âIch möchte das Modellverhalten global steuernâ Entwickler, die alle Antworten in einer bestimmten Sprache oder mit einem bestimmten Ton wĂŒnschen oder die Argumentationstoken einschrĂ€nken möchten. Dies in jedem Tool/jeder Anfrage zu konfigurieren, ist unpraktisch.
**So löst OmniRoute das Problem:**
- **System Prompt Injection** â Globale Eingabeaufforderung, die auf alle Anfragen angewendet wird
- **Thinking Budget Validation** â Reasoning-Token-Zuteilungskontrolle pro Anfrage (Passthrough, automatisch, benutzerdefiniert, adaptiv)
- **6 Routing-Strategien** â Globale Strategien, die bestimmen, wie Anfragen verteilt werden
- **Wildcard-Router** â `provider/*`-Muster leiten dynamisch an jeden Anbieter weiter
- **Combo-Aktivierung/Deaktivierung umschalten** â Combos direkt ĂŒber das Dashboard umschalten
- **Provider Toggle** â Alle Verbindungen fĂŒr einen Anbieter mit einem Klick aktivieren/deaktivieren
- **Blockierte Anbieter** â Bestimmte Anbieter aus der `/v1/models`-Liste ausschlieĂen
đ§° 17. âIch brauche MCP-Tools als erstklassige Produktfunktionenâ
Viele KI-Gateways stellen MCP nur als verstecktes Implementierungsdetail zur VerfĂŒgung. Teams benötigen eine sichtbare, ĂŒberschaubare Betriebsebene.
**So löst OmniRoute das Problem:**
â MCP wird in der Dashboard-Navigation und auf der Registerkarte âEndpunktprotokollâ angezeigt
- Dedizierte MCP-Verwaltungsseite mit Prozess, Tools, Bereichen und Audit
â Integrierter Schnellstart fĂŒr `omniroute --mcp` und Kunden-Onboarding
đ§ 18. âIch benötige A2A-Orchestrierung mit Synchronisierungs- und Stream-Aufgabenpfadenâ
Agenten-Workflows erfordern sowohl direkte Antworten als auch eine lang andauernde gestreamte AusfĂŒhrung mit Lebenszykluskontrolle.
**So löst OmniRoute das Problem:**
â A2A JSON-RPC-Endpunkt (`POST /a2a`) mit `message/send` und `message/stream`
- SSE-Streaming mit Terminal-State-Propagation
â Task-Lebenszyklus-APIs fĂŒr `tasks/get` und `tasks/cancel`
đ°ïž 19. âIch benötige den echten Zustand des MCP-Prozesses, keinen erratenen Statusâ
Betriebsteams mĂŒssen wissen, ob MCP tatsĂ€chlich aktiv ist, und nicht nur, ob eine API erreichbar ist.
**So löst OmniRoute das Problem:**
â Laufzeit-Heartbeat-Datei mit PID, Zeitstempeln, Transport, Werkzeuganzahl und Oszilloskopmodus
- MCP-Status-API, die Heartbeat + aktuelle AktivitÀt kombiniert
- UI-Statuskarten fĂŒr Prozess-/VerfĂŒgbarkeits-/Heartbeat-AktualitĂ€t
đ 20. âIch benötige eine ĂŒberprĂŒfbare MCP-Tool-AusfĂŒhrungâ
Wenn Tools die Konfiguration verĂ€ndern oder operative Aktionen auslösen, benötigen Teams forensische RĂŒckverfolgbarkeit.
**So löst OmniRoute das Problem:**
â SQLite-gestĂŒtzte Audit-Protokollierung fĂŒr MCP-Tool-Aufrufe
- Filtert nach Tool, Erfolg/Misserfolg, API-SchlĂŒssel und Paginierung
- Dashboard-Audit-Tabelle + Statistik-Endpunkte fĂŒr die Automatisierung
đ 21. âIch benötige bereichsweise MCP-Berechtigungen pro Integrationâ
Verschiedene Clients sollten Zugriff auf die Werkzeugkategorien mit den geringsten Rechten haben.
**So löst OmniRoute das Problem:**
- 9 granulare MCP-Bereiche fĂŒr kontrollierten Werkzeugzugriff
- Geltungsbereichsdurchsetzung und Sichtbarkeit in der MCP-Management-BenutzeroberflÀche
- Sichere Standardhaltung fĂŒr Betriebswerkzeuge
âïž 22. âIch benötige Betriebskontrollen ohne erneute Bereitstellungâ
Teams benötigen bei VorfÀllen oder Kostenereignissen schnelle LaufzeitÀnderungen.
**So löst OmniRoute das Problem:**
- Schalten Sie die Combo-Aktivierung direkt ĂŒber das MCP-Dashboard um
- Wenden Sie Ausfallsicherheitsprofile aus vordefinierten Richtlinienpaketen an
- Setzen Sie den Leistungsschalterstatus ĂŒber dasselbe Bedienfeld zurĂŒck
đ 23. âIch benötige Live-Sichtbarkeit und Abbruch des A2A-Aufgabenlebenszyklusâ
Ohne Sichtbarkeit des Lebenszyklus wird es schwierig, AufgabenvorfÀlle zu selektieren.
**So löst OmniRoute das Problem:**
- Aufgabenliste/Filterung nach Bundesland/FĂ€higkeit mit Paginierung
- Drilldown zu Aufgabenmetadaten, Ereignissen und Artefakten
- Endpunkt zum Abbrechen von Aufgaben und UI-Aktion mit BestÀtigung
đ 24. âIch benötige aktive Stream-Metriken fĂŒr die A2A-Lastâ
Streaming-Workflows erfordern betriebliche Einblicke in ParallelitÀt und Live-Verbindungen.
**So löst OmniRoute das Problem:**
- Aktive Stream-ZĂ€hler im A2A-Status integriert
- Zeitstempel der letzten Aufgabe und Anzahl pro Status
- A2A-Dashboard-Karten fĂŒr die Echtzeit-BetriebsĂŒberwachung
đȘȘ 25. âIch benötige Standard-Agent-Erkennung fĂŒr Clientsâ
Externe Kunden und Orchestratoren benötigen fĂŒr das Onboarding maschinenlesbare Metadaten.
**So löst OmniRoute das Problem:**
â Agentenkarte unter `/.well-known/agent.json` ausgestellt
- FÀhigkeiten und Fertigkeiten werden in der Management-BenutzeroberflÀche angezeigt
â Die A2A-Status-API enthĂ€lt Erkennungsmetadaten fĂŒr die Automatisierung
đ§ 26. âIch benötige Protokollauffindbarkeit in der Produkt-UXâ
Wenn Benutzer ProtokolloberflÀchen nicht entdecken können, sinken Akzeptanz und SupportqualitÀt.
**So löst OmniRoute das Problem:**
- SeitenleisteneintrĂ€ge fĂŒr MCP und A2A
- Registerkarte âProtokolleâ auf der Endpunktseite mit Schnellstart und Status
- Links von der Ăbersicht zu speziellen Management-Dashboards
đ§Ș 27. âIch benötige eine End-to-End-Protokollvalidierung mit echten Clientsâ
Probetests reichen nicht aus, um die ProtokollkompatibilitĂ€t vor der Veröffentlichung zu ĂŒberprĂŒfen.
**So löst OmniRoute das Problem:**
â E2E-Suite, die die App startet und echten MCP SDK-Client-Transport verwendet
- A2A-Clienttests fĂŒr Erkennungs-, Sende-, Stream-, Get- und AbbruchflĂŒsse
- Vergleichen Sie Behauptungen mit MCP-Audit- und A2A-Aufgaben-APIs
đĄ 28. âIch brauche eine einheitliche Beobachtbarkeit ĂŒber alle Schnittstellen hinwegâ
Die Aufteilung der Beobachtbarkeit nach Protokoll fĂŒhrt zu blinden Flecken und einer lĂ€ngeren MTTR.
**So löst OmniRoute das Problem:**
- Einheitliche Dashboards/Protokolle/Analysen in einem Produkt
- Gesundheits-, Audit- und Anforderungstelemetrie ĂŒber OpenAI-, MCP- und A2A-Ebenen hinweg
- Operative APIs fĂŒr Status und Automatisierung
đŒ 29. âIch benötige eine Laufzeit fĂŒr Proxy + Tools + Agent-Orchestrierungâ
Die AusfĂŒhrung vieler separater Dienste erhöht die Betriebskosten und erhöht die FehlerhĂ€ufigkeit.
**So löst OmniRoute das Problem:**- OpenAI-kompatibler Proxy, MCP-Server und A2A-Server in einem Stack
â Gemeinsame Authentifizierung, Ausfallsicherheit, Datenspeicher und Beobachtbarkeit
- Konsistentes Richtlinienmodell ĂŒber alle InteraktionsoberflĂ€chen hinweg
đ 30. âIch muss Agenten-Workflows ohne Glue-Code-Ausbreitung versendenâ
Teams verlieren an Geschwindigkeit, wenn sie mehrere Ad-hoc-Dienste und -Skripte zusammenfĂŒgen.
**So löst OmniRoute das Problem:**
- Einheitliche Endpunktstrategie fĂŒr Kunden und Agenten
- Integrierte Protokollverwaltungs-BenutzeroberflÀchen und Rauchvalidierungspfade
- Produktionsreife Grundlagen (Sicherheit, Protokollierung, Ausfallsicherheit, Backup)
### Beispiel-Playbooks (Integrierte AnwendungsfÀlle)
**Playbook A: Bezahltes Abonnement maximieren + gĂŒnstiges Backup**
```txt
Combo: "maximize-claude"
1. cc/claude-opus-4-6
2. glm/glm-4.7
3. if/kimi-k2-thinking
Monthly cost: $20 + small backup spend
Outcome: higher quality, near-zero interruption
```
**Playbook B: Kostenfreier Codierungsstack**
```txt
Combo: "free-forever"
1. gc/gemini-3-flash
2. if/kimi-k2-thinking
3. qw/qwen3-coder-plus
Monthly cost: $0
Outcome: stable free coding workflow
```
**Playbook C: 24/7 Always-On-Fallback-Kette**
```txt
Combo: "always-on"
1. cc/claude-opus-4-6
2. cx/gpt-5.2-codex
3. glm/glm-4.7
4. minimax/MiniMax-M2.1
5. if/kimi-k2-thinking
Outcome: deep fallback depth for deadline-critical workloads
```
**Playbook D: Agentenoperationen mit MCP + A2A**
```txt
1) Start MCP transport (`omniroute --mcp`) for tool-driven operations
2) Run A2A tasks via `message/send` and `message/stream`
3) Observe via /dashboard/mcp and /dashboard/a2a
4) Control incidents with resilience profile + task cancellation
```
---
## ⥠Schnellstart
### 1) Installieren und ausfĂŒhren
```bash
npm install -g omniroute
omniroute
```
Das Dashboard wird unter `http://localhost:20128` geöffnet und die API-Basis-URL lautet `http://localhost:20128/v1`.
| Befehl | Beschreibung |
| ----------------------- | ------------------------------------------------------------------- |
| `omniroute` | Server starten (`PORT=20128`, API und Dashboard auf demselben Port) |
| `omniroute --port 3000` | Setzen Sie den kanonischen/API-Port auf 3000 |
| `omniroute --mcp` | Starten Sie den MCP-Server (STDIO-Transport) |
| `omniroute --no-open` | Browser nicht automatisch öffnen |
| `omniroute --help` | Hilfe anzeigen |
Optionaler Split-Port-Modus:
```bash
PORT=20128 DASHBOARD_PORT=20129 omniroute
# API: http://localhost:20128/v1
# Dashboard: http://localhost:20129
```
### 2) Verbinden Sie Anbieter und erstellen Sie Ihren API-SchlĂŒssel
1. Ăffnen Sie Dashboard â `Providers` und verbinden Sie mindestens einen Anbieter (OAuth oder API-SchlĂŒssel).
2. Ăffnen Sie Dashboard â `Endpoint` und erstellen Sie einen API-SchlĂŒssel.
3. (Optional) Ăffnen Sie Dashboard â `Combos` und legen Sie Ihre Fallback-Kette fest.
### 3) Richten Sie Ihr Codierungstool auf OmniRoute
```txt
Base URL: http://localhost:20128/v1
API Key: [copy from Endpoint page]
Model: if/kimi-k2-thinking (or any provider/model prefix)
```
Funktioniert mit Claude Code, Codex CLI, Gemini CLI, Cursor, Cline, OpenClaw, OpenCode und OpenAI-kompatiblen SDKs.
### 4) Protokolle aktivieren und validieren (v2.0)
**MCP (fĂŒr werkzeuggesteuerte VorgĂ€nge):**
```bash
omniroute --mcp
```
Verbinden Sie dann Ihren MCP-Client ĂŒber `stdio` und testen Sie Tools wie:
- `omniroute_get_health`
- `omniroute_list_combos`
**A2A (fĂŒr Agent-zu-Agent-Workflows):**
```bash
curl http://localhost:20128/.well-known/agent.json
```
```bash
curl -X POST http://localhost:20128/a2a \
-H 'content-type: application/json' \
-d '{"jsonrpc":"2.0","id":"quickstart","method":"message/send","params":{"skill":"quota-management","messages":[{"role":"user","content":"Give me a short quota summary."}]}}'
```
### 5) Alles durchgÀngig validieren (empfohlen)
```bash
npm run test:protocols:e2e
```
Diese Suite validiert echte MCP- und A2A-Client-Flows anhand einer laufenden App.
### Alternative: Von der Quelle ausfĂŒhren
```bash
cp .env.example .env
npm install
PORT=20128 DASHBOARD_PORT=20129 NEXT_PUBLIC_BASE_URL=http://localhost:20129 npm run dev
```
---
## đł Docker
OmniRoute ist als öffentliches Docker-Image auf [Docker Hub](https://hub.docker.com/r/diegosouzapw/omniroute) verfĂŒgbar.
**Schneller Lauf:**
```bash
docker run -d \
--name omniroute \
--restart unless-stopped \
-p 20128:20128 \
-v omniroute-data:/app/data \
diegosouzapw/omniroute:latest
```
**Mit Umgebungsdatei:**
```bash
# Copy and edit .env first
cp .env.example .env
docker run -d \
--name omniroute \
--restart unless-stopped \
--env-file .env \
-p 20128:20128 \
-v omniroute-data:/app/data \
diegosouzapw/omniroute:latest
```
**Verwendung von Docker Compose:**
```bash
# Base profile (no CLI tools)
docker compose --profile base up -d
# CLI profile (Claude Code, Codex, OpenClaw built-in)
docker compose --profile cli up -d
```
| Bild | Tag | GröĂe | Beschreibung |
| ------------------------ | -------- | ------- | ----------------------- |
| `diegosouzapw/omniroute` | `latest` | ~250 MB | Neueste stabile Version |
| `diegosouzapw/omniroute` | `1.0.3` | ~250 MB | Aktuelle Version |
---
## đ„ïž
FĂŒhren Sie OmniRoute als eigenstĂ€ndige Desktop-App aus â kein Terminal, kein Browser, keine Internetverbindung fĂŒr lokale Modelle erforderlich. Die Electron-basierte App umfasst:
- đ„ïž **Natives Fenster** â Spezielles App-Fenster mit Integration in die Taskleiste
- đ **Auto-Start** â OmniRoute bei der Systemanmeldung starten
- đ **Native Benachrichtigungen** â Erhalten Sie Benachrichtigungen bei Kontingentausschöpfung oder Anbieterproblemen
- ⥠**One-Click-Installation** â NSIS (Windows), DMG (macOS), AppImage (Linux)
- đ **Offline-Modus** â Funktioniert vollstĂ€ndig offline mit dem gebĂŒndelten Server
### Schnellstart
```bash
# Development mode
npm run electron:dev
# Build for your platform
npm run electron:build # Current platform
npm run electron:build:win # Windows (.exe)
npm run electron:build:mac # macOS (.dmg) â x64 & arm64
npm run electron:build:linux # Linux (.AppImage)
```
### Systemablage
Wenn OmniRoute minimiert ist, befindet es sich mit schnellen Aktionen in Ihrer Taskleiste:
- Dashboard öffnen
- Server-Port Àndern
- Anwendung beenden
đ VollstĂ€ndige Dokumentation: [`electron/README.md`](electron/README.md)
---
## đ° Preise im Ăberblick
| Stufe | Anbieter | Kosten | Kontingent zurĂŒcksetzen | Am besten fĂŒr |
| -------------------- | ----------------- | ---------------------------------------- | ------------------------- | ---------------------- |
| **đł ABO** | Claude Code (Pro) | 20 $/Monat | 5h + wöchentlich | Bereits abonniert |
| | Codex (Plus/Pro) | 20â200 $/Monat | 5h + wöchentlich | OpenAI-Benutzer |
| | Gemini CLI | **KOSTENLOS** | 180.000/Monat + 1.000/Tag | Alle! |
| | GitHub-Copilot | 10â19 $/Monat | Monatlich | GitHub-Benutzer |
| **đ API-SCHLĂSSEL** | NVIDIA NIM | **KOSTENLOS** (1000 Credits) | Einmalig | Kostenlose Tier-Tests |
| | DeepSeek | Pay-per-Use | Keine | Bestes Preis/QualitÀt |
| | Groq | Kostenloses Kontingent + kostenpflichtig | Tarif begrenzt | Ultraschnelle Inferenz |
| | xAI (Grok) | Pay-per-Use | Keine | Grok-Modelle |
| | Mistral | Kostenloses Kontingent + kostenpflichtig | Tarif begrenzt | EuropÀische KI |
| | OpenRouter | Pay-per-Use | Keine | Ăber 100 Modelle |
| **đ° GĂNSTIG** | GLM-4.7 | 0,6 $/1 Mio. | TĂ€glich 10 Uhr | Budgetsicherung |
| | MiniMax M2.1 | 0,2 $/1 Mio. | 5-Stunden-Rollen | GĂŒnstigste Option |
| | Kimi K2 | $9/Monat pauschal | 10 Millionen Token/Monat | Vorhersehbare Kosten |
| **đ KOSTENLOS** | iFlow | $0 | Unbegrenzt | 8 Modelle kostenlos |
| | Qwen | $0 | Unbegrenzt | 3 Modelle kostenlos |
| | Kiro | $0 | Unbegrenzt | Claude frei |
**đĄ Profi-Tipp:** Beginnen Sie mit der Kombination Gemini CLI (180.000 kostenlos/Monat) + iFlow (unbegrenzt kostenlos) = 0 $ Kosten!
---
## đĄ Hauptfunktionen
OmniRoute v2.0 ist als Betriebsplattform konzipiert und nicht nur als Relay-Proxy.
### đ€ Agenten- und Protokolloperationen (v2.0)| Funktion | Was es tut |
| ------------------------------------ | -------------------------------------------------------------------------------- |
| đ§ **MCP-Server (16 Tools)** | IDE-/Agent-Tools steuern Routing, Zustand, Kombinationen, Grenzwerte und VorgĂ€nge |
| đ€ **A2A-Server (JSON-RPC + SSE)** | AusfĂŒhrung von Agent-zu-Agent-Aufgaben mit Synchronisierungs- und Streaming-Flows |
| đ§ **MCP/A2A-Dashboards** | Dedizierte Verwaltungsseiten (`/dashboard/mcp`, `/dashboard/a2a`) |
| đ°ïž **MCP Runtime Heartbeat** | Echter Prozessstatus (PID, Betriebszeit, Heartbeat-Alter, Transport, Scope-Modus) |
| đ **MCP Audit Trail** | Filterbare Audit-Protokolle mit Erfolg/Misserfolg und SchlĂŒsselzuordnung |
| đ **Durchsetzung des MCP-Geltungsbereichs** | 9 granulare Umfangsberechtigungen fĂŒr kontrollierten Werkzeugzugriff |
| đĄ **A2A Task Lifecycle Management** | Aufgaben auflisten/filtern, Ereignisse/Artefakte prĂŒfen, laufende Aufgaben abbrechen |
| đ **Agentenkartenerkennung** | `/.well-known/agent.json` fĂŒr die automatische Client-Erkennung |
| đ§Ș **Protokoll-E2E-Testkabel** | Echtes MCP SDK + A2A-Client flieĂt in `test:protocols:e2e` |
| âïž **Betriebskontrollen** | Schaltkombination, Anwenden von Resilienzprofilen, ZurĂŒcksetzen von Leistungsschaltern ĂŒber eine BedienoberflĂ€che |
### đ§ Routing und Intelligenz
| Funktion | Was es tut |
| ---------------------------------------- | ------------------------------------------------------------------------------------- |
| đŻ **Intelligenter 4-Stufen-Fallback** | Automatische Route: Abonnement â API-SchlĂŒssel â GĂŒnstig â Kostenlos |
| đ **Kontingentverfolgung in Echtzeit** | Live-Token-ZĂ€hlung + Reset-Countdown pro Anbieter |
| đ **FormatĂŒbersetzung** | OpenAI â Claude â Gemini â Antworten mit schemasicheren Konvertierungen |
| đ„ **UnterstĂŒtzung mehrerer Konten** | Mehrere Konten pro Anbieter mit intelligenter Auswahl |
| đ **Automatische Token-Aktualisierung** | OAuth-Token werden bei Wiederholung automatisch aktualisiert |
| đš **Benutzerdefinierte Kombinationen** | 6 Ausgleichsstrategien + Fallback-Kettenkontrolle |
| đ **Wildcard-Router** | `provider/*` dynamisches Routing |
| đ§ **Budgetkontrollen denken** | Passthrough-, automatische, benutzerdefinierte und adaptive Reasoning-Grenzwerte |
| đ **Modell-Aliase** | Integrierte + benutzerdefinierte Modell-Aliasing- und Migrationssicherheit |
| ⥠**Hintergrundverschlechterung** | Hintergrundaufgaben mit niedriger PrioritĂ€t an gĂŒnstigere Modelle weiterleiten |
| đŹ **System-Prompt-Injektion** | Globale Verhaltenskontrollen werden konsequent angewendet |
| đ **Antwort-API-KompatibilitĂ€t** | VollstĂ€ndige `/v1/responses`-UnterstĂŒtzung fĂŒr Codex und erweiterte Agenten-Workflows |
### đ” Multimodale APIs
| Funktion | Was es tut || -------------------------- | ------------------------------------------------------------- |
| đŒïž **Bilderzeugung** | `/v1/images/generations` mit Cloud- und lokalen Backends |
| đ **Einbettungen** | `/v1/embeddings` fĂŒr Such- und RAG-Pipelines |
| đ€ **Audio-Transkription** | `/v1/audio/transcriptions` (Whisper und zusĂ€tzliche Anbieter) |
| đ **Text-to-Speech** | `/v1/audio/speech` (mehrere Engines/Anbieter) |
| đŹ **Videogenerierung** | `/v1/videos/generations` (ComfyUI + SD WebUI-Workflows) |
| đ” **Musikgeneration** | `/v1/music/generations` (ComfyUI-Workflows) |
| đĄïž **Moderationen** | `/v1/moderations` SicherheitsprĂŒfungen |
| đ **Neueinstufung** | `/v1/rerank` fĂŒr Relevanzbewertung |
### đĄïž Resilienz, Sicherheit und Governance
| Funktion | Was es tut |
| ---------------------------------------- | ------------------------------------------------------------------------------ |
| đ **Leistungsschalter** | Auslösung/Wiederherstellung auf Anbieterebene mit Schwellenwertkontrollen |
| đĄïž **Anti-Donnerende Herde** | Mutex- und Semaphorschutz bei Wiederholungs-/Ratenereignissen |
| đ§ **Semantik + Signatur-Cache** | Kosten-/Latenzreduzierung mit zwei Cache-Schichten |
| ⥠**Idempotenz anfordern** | Doppeltes Schutzfenster |
| đ **TLS-Fingerabdruck-Spoofing** | Bessere KompatibilitĂ€t mit Anti-Bot-gefilterten Anbietern |
| đ **IP-Filterung** | Zulassungs-/Blocklistenkontrolle fĂŒr exponierte Bereitstellungen |
| đ **Bearbeitbare Ratenlimits** | Konfigurierbare globale/Provider-Level-Limits mit Persistenz |
| đ **API-SchlĂŒsselverwaltung + Scoping** | Sichere SchlĂŒsselausgabe/-rotation und Modell-/Anbieterkontrollen |
| đĄïž **GeschĂŒtzt `/models`** | Optionales Authentifizierungs-Gating und Provider-Ausblenden fĂŒr Modellkatalog |
### đ Beobachtbarkeit und Analyse
| Funktion | Was es tut |
| ---------------------------------------- | ------------------------------------------------------------------- |
| đ **Anfrage + Proxy-Protokollierung** | VollstĂ€ndige Anfrage/Antwort- und Proxy-Protokollierung |
| đ **Einheitliches Protokoll-Dashboard** | Anforderungs-, Proxy-, Audit- und Konsolenansichten auf einer Seite |
| đ **Telemetrie anfordern** | p50/p95/p99-Latenz und Anforderungsverfolgung |
| đ„ **Gesundheits-Dashboard** | Betriebszeit, Breaker-ZustĂ€nde, Sperrungen, Cache-Statistiken |
| đ° **Kostenverfolgung** | Budgetkontrolle und Preistransparenz pro Modell |
| đ **Analysevisualisierungen** | Einblicke in die Modell-/Anbieternutzung und Trendansichten |
| đ§Ș **Bewertungsrahmen** | Golden-Set-Test mit konfigurierbaren Match-Strategien |
### âïž Bereitstellung und Plattform
| Funktion | Was es tut |
| ------------------------------------------- | ------------------------------------------------------------------------------ | --- | ----------------------------- | ------------------------------------------------ |
| đ **Ăberall bereitstellen** | Localhost, VPS, Docker, Cloud-Umgebungen | | đŸ **Cloud-Synchronisierung** | Konfigurationssynchronisierung ĂŒber Cloud Worker |
| đ **Sichern/Wiederherstellen** | Export-/Import- und Disaster-Recovery-AblĂ€ufe |
| đ§ **Onboarding-Assistent** | Erstmaliges gefĂŒhrtes Setup |
| đ§ **CLI-Tools-Dashboard** | Ein-Klick-Setup fĂŒr beliebte Codierungstools |
| đ **i18n (30 Sprachen)** | VollstĂ€ndige SprachunterstĂŒtzung fĂŒr Dashboard und Dokumente mit RTL-Abdeckung |
| đ **Benutzerdefiniertes Datenverzeichnis** | `DATA_DIR`-Ăberschreibung fĂŒr Speicherort |
### Feature Deep Dive
#### Smarter Fallback mit praktischer Kostenkontrolle
```txt
Combo: "my-coding-stack"
1. cc/claude-opus-4-6
2. nvidia/llama-3.3-70b
3. glm/glm-4.7
4. if/kimi-k2-thinking
```
Wenn Kontingent, Rate oder IntegritÀt fehlschlagen, wechselt OmniRoute automatisch zum nÀchsten Kandidaten, ohne dass ein manueller Wechsel erforderlich ist.
#### Protokollverwaltung, die sichtbar und bedienbar ist
- MCP + A2A sind in der BenutzeroberflÀche und in den Dokumenten erkennbar (nicht ausgeblendet)
â Protokollstatus-APIs stellen Live-Betriebsdaten bereit (`/api/mcp/*`, `/api/a2a/*`)
- Dashboards umfassen Aktionen fĂŒr Tag-2-Operationen (Kombinationsumschaltung, ZurĂŒcksetzen von Leistungsschaltern, Aufgabenabbruch).
#### Ăbersetzer- und Validierungsworkflow
Der Ăbersetzerbereich umfasst:
- **Spielplatz**: TransformationsprĂŒfungen anfordern
- **Chat-Tester**: vollstÀndiger Anfrage-/Antwort-Roundtrip
- **PrĂŒfstand**: mehrere FĂ€lle in einem Durchgang
- **Live Monitor**: Echtzeit-Verkehrsansicht
Plus Protokollvalidierung mit echten Clients ĂŒber `npm run test:protocols:e2e`.
> đ **[MCP Server README](open-sse/mcp-server/README.md)** â Tool-Referenz, IDE-Konfigurationen und Client-Beispiele
>
> đ **[A2A Server README](src/lib/a2a/README.md)** â FĂ€higkeiten, JSON-RPC-Methoden, Streaming und Aufgabenlebenszyklus
## đ§Ș Bewertungen (Evals)
OmniRoute umfasst ein integriertes Bewertungsframework zum Testen der LLM-AntwortqualitĂ€t anhand eines Golden Sets. Greifen Sie darauf ĂŒber **Analytics â Evals** im Dashboard zu.
### Eingebautes goldenes Set
Das vorinstallierte âOmniRoute Golden Setâ enthĂ€lt TestfĂ€lle fĂŒr:
- GrĂŒĂe, Mathematik, Geographie, Codegenerierung
- Einhaltung des JSON-Formats, Ăbersetzung, Markdown-Generierung
- Sicherheitsverweigerung (schÀdlicher Inhalt), ZÀhlung, boolesche Logik
### Bewertungsstrategien
| Strategie | Beschreibung | Beispiel |
| ---------- | -------------------------------------------------------------------------------------------- | --------------------------------------- |
| `exact` | Die Ausgabe muss genau mit | ĂŒbereinstimmen `"4"` |
| `contains` | Die Ausgabe muss eine Teilzeichenfolge enthalten (GroĂ-/Kleinschreibung wird nicht beachtet) | `"Paris"` |
| `regex` | Die Ausgabe muss mit dem Regex-Muster | ĂŒbereinstimmen `"1.*2.*3"` |
| `custom` | Benutzerdefinierte JS-Funktion gibt true/false | zurĂŒck `(output) => output.length > 10` |
---
## đ Einrichtungsanleitung
### Protokoll-Setup (MCP + A2A)
đ§© MCP-Setup (Modellkontextprotokoll)
Starten Sie den MCP-Transport im Standardmodus:
```bash
omniroute --mcp
```
Empfohlener Validierungsablauf:
1. Verbinden Sie Ihren MCP-Client ĂŒber stdio.
2. FĂŒhren Sie `omniroute_get_health` aus.
3. FĂŒhren Sie `omniroute_list_combos` aus.
4. Ăffnen Sie `/dashboard/mcp`, um Heartbeat, AktivitĂ€t und Audit zu bestĂ€tigen.
NĂŒtzliche APIs fĂŒr die Automatisierung:
- `GET /api/mcp/status`
- `GET /api/mcp/tools`
- `GET /api/mcp/audit`
- `GET /api/mcp/audit/stats`
đ€ A2A-Setup (Agent2Agent)
Entdecken Sie den Agenten:
```bash
curl http://localhost:20128/.well-known/agent.json
```
Senden Sie eine Aufgabe:
```bash
curl -X POST http://localhost:20128/a2a \
-H 'content-type: application/json' \
-d '{"jsonrpc":"2.0","id":"setup-a2a","method":"message/send","params":{"skill":"quota-management","messages":[{"role":"user","content":"Summarize quota status."}]}}'
```
Lebenszyklus verwalten:
- `GET /api/a2a/status`
- `GET /api/a2a/tasks`
- `GET /api/a2a/tasks/:id`
- `POST /api/a2a/tasks/:id/cancel`
Operative BenutzeroberflÀche:
- `/dashboard/a2a` fĂŒr Task-/Status-/Stream-Beobachtbarkeit und Smoke-Aktionen
đ§Ș End-to-End-Protokollvalidierung
Validieren Sie beide Protokolle mit echten Clients:
```bash
npm run test:protocols:e2e
```
Dies bestÀtigt:
- MCP SDK-Client-Verbindung/Liste/Anruf
- A2A-Erkennung/Senden/Streamen/Get/Abbrechen
- Vergleichen Sie die Daten in MCP-Audit- und A2A-Aufgabenverwaltungs-APIs
đł Abonnementanbieter
### Claude Code (Pro/Max)
```bash
Dashboard â Providers â Connect Claude Code
â OAuth login â Auto token refresh
â 5-hour + weekly quota tracking
Models:
cc/claude-opus-4-6
cc/claude-sonnet-4-5-20250929
cc/claude-haiku-4-5-20251001
```
**Profi-Tipp:** Verwenden Sie Opus fĂŒr komplexe Aufgaben, Sonnet fĂŒr Geschwindigkeit. OmniRoute verfolgt das Kontingent pro Modell!
### OpenAI Codex (Plus/Pro)
```bash
Dashboard â Providers â Connect Codex
â OAuth login (port 1455)
â 5-hour + weekly reset
Models:
cx/gpt-5.2-codex
cx/gpt-5.1-codex-max
```
### Gemini CLI (KOSTENLOS 180.000/Monat!)
```bash
Dashboard â Providers â Connect Gemini CLI
â Google OAuth
â 180K completions/month + 1K/day
Models:
gc/gemini-3-flash-preview
gc/gemini-2.5-pro
```
**Bester Wert:** Riesiges kostenloses Kontingent! Verwenden Sie dies vor kostenpflichtigen Stufen.
### GitHub-Copilot
```bash
Dashboard â Providers â Connect GitHub
â OAuth via GitHub
â Monthly reset (1st of month)
Models:
gh/gpt-5
gh/claude-4.5-sonnet
gh/gemini-3-pro
```
đ API-SchlĂŒsselanbieter
### NVIDIA NIM (KOSTENLOSE 1000 Credits!)
1. Registrieren Sie sich: [build.nvidia.com](https://build.nvidia.com)
2. Holen Sie sich einen kostenlosen API-SchlĂŒssel (1000 Inferenz-Credits inbegriffen)
3. Dashboard â Anbieter hinzufĂŒgen â NVIDIA NIM:
- API-SchlĂŒssel: `nvapi-your-key`
**Modelle:** `nvidia/llama-3.3-70b-instruct`, `nvidia/mistral-7b-instruct` und ĂŒber 50 weitere
**Profi-Tipp:** OpenAI-kompatible API â funktioniert nahtlos mit der FormatĂŒbersetzung von OmniRoute!
### DeepSeek
1. Registrieren Sie sich: [platform.deepseek.com](https://platform.deepseek.com)
2. Holen Sie sich den API-SchlĂŒssel
3. Dashboard â Anbieter hinzufĂŒgen â DeepSeek
**Modelle:** `deepseek/deepseek-chat`, `deepseek/deepseek-coder`
### Groq (Kostenloses Kontingent verfĂŒgbar!)
1. Registrieren Sie sich: [console.groq.com](https://console.groq.com)
2. Holen Sie sich den API-SchlĂŒssel (kostenloses Kontingent inbegriffen)
3. Dashboard â Anbieter hinzufĂŒgen â Groq
**Modelle:** `groq/llama-3.3-70b`, `groq/mixtral-8x7b`
**Profi-Tipp:** Ultraschnelle Inferenz â am besten fĂŒr Echtzeit-Codierung!
### OpenRouter (ĂŒber 100 Modelle)
1. Registrieren Sie sich: [openrouter.ai](https://openrouter.ai)
2. Holen Sie sich den API-SchlĂŒssel
3. Dashboard â Anbieter hinzufĂŒgen â OpenRouter
**Modelle:** Greifen Sie ĂŒber einen einzigen API-SchlĂŒssel auf ĂŒber 100 Modelle aller groĂen Anbieter zu.
đ° GĂŒnstige Anbieter (Backup)
### GLM-4.7 (TĂ€glicher Reset, 0,6 $/1 Mio.)
1. Registrieren: [Zhipu AI](https://open.bigmodel.cn/)
2. Holen Sie sich den API-SchlĂŒssel vom Coding Plan
3. Dashboard â API-SchlĂŒssel hinzufĂŒgen:
- Anbieter: `glm`
- API-SchlĂŒssel: `your-key`
**Verwendung:** `glm/glm-4.7`
**Profi-Tipp:** Coding Plan bietet 3Ă Kontingent zu 1/7 Kosten! TĂ€glich um 10:00 Uhr zurĂŒckgesetzt.
### MiniMax M2.1 (5 Stunden ZurĂŒcksetzen, 0,20 $/1 Mio.)
1. Registrieren: [MiniMax](https://www.minimax.io/)
2. Holen Sie sich den API-SchlĂŒssel
3. Dashboard â API-SchlĂŒssel hinzufĂŒgen
**Verwendung:** `minimax/MiniMax-M2.1`
**Profi-Tipp:** GĂŒnstigste Option fĂŒr langen Kontext (1 Mio. Token)!
### Kimi K2 (9 $/Monat pauschal)
1. Abonnieren: [Moonshot AI](https://platform.moonshot.ai/)
2. Holen Sie sich den API-SchlĂŒssel
3. Dashboard â API-SchlĂŒssel hinzufĂŒgen
**Verwendung:** `kimi/kimi-latest`
**Profi-Tipp:** Feste 9 $/Monat fĂŒr 10 Mio. Token = 0,90 $/1 Mio. effektive Kosten!
đ KOSTENLOSE Anbieter (Notfall-Backup)
### iFlow (8 KOSTENLOSE Modelle)```bash
Dashboard â Connect iFlow
â iFlow OAuth login
â Unlimited usage
Models:
if/kimi-k2-thinking
if/qwen3-coder-plus
if/glm-4.7
if/minimax-m2
if/deepseek-r1
````
### Qwen (3 KOSTENLOSE Modelle)
```bash
Dashboard â Connect Qwen
â Device code authorization
â Unlimited usage
Models:
qw/qwen3-coder-plus
qw/qwen3-coder-flash
````
### Kiro (Claude KOSTENLOS)
```bash
Dashboard â Connect Kiro
â AWS Builder ID or Google/GitHub
â Unlimited usage
Models:
kr/claude-sonnet-4.5
kr/claude-haiku-4.5
```
đš Combos erstellen
### Beispiel 1: Abonnement maximieren â GĂŒnstiges Backup
```
Dashboard â Combos â Create New
Name: premium-coding
Models:
1. cc/claude-opus-4-6 (Subscription primary)
2. glm/glm-4.7 (Cheap backup, $0.6/1M)
3. minimax/MiniMax-M2.1 (Cheapest fallback, $0.20/1M)
Use in CLI: premium-coding
```
### Beispiel 2: Nur kostenlos (kostenlos)
```
Name: free-combo
Models:
1. gc/gemini-3-flash-preview (180K free/month)
2. if/kimi-k2-thinking (unlimited)
3. qw/qwen3-coder-plus (unlimited)
Cost: $0 forever!
```
đ§ CLI-Integration
### Cursor-IDE
```
Settings â Models â Advanced:
OpenAI API Base URL: http://localhost:20128/v1
OpenAI API Key: [from OmniRoute dashboard]
Model: cc/claude-opus-4-6
```
### Claude Code
Verwenden Sie die Seite **CLI-Tools** im Dashboard fĂŒr die Ein-Klick-Konfiguration oder bearbeiten Sie `~/.claude/settings.json` manuell.
### Codex-CLI
```bash
export OPENAI_BASE_URL="http://localhost:20128"
export OPENAI_API_KEY="your-omniroute-api-key"
codex "your prompt"
```
### OpenClaw
**Option 1 â Dashboard (empfohlen):**
```
Dashboard â CLI Tools â OpenClaw â Select Model â Apply
```
**Option 2 â Manuell:** Bearbeiten `~/.openclaw/openclaw.json`:
```json
{
"models": {
"providers": {
"omniroute": {
"baseUrl": "http://127.0.0.1:20128/v1",
"apiKey": "sk_omniroute",
"api": "openai-completions"
}
}
}
}
```
> **Hinweis:** OpenClaw funktioniert nur mit lokaler OmniRoute. Verwenden Sie `127.0.0.1` anstelle von `localhost`, um Probleme mit der IPv6-Auflösung zu vermeiden.
### Cline / Weiter / RooCode
```
Settings â API Configuration:
Provider: OpenAI Compatible
Base URL: http://localhost:20128/v1
API Key: [from OmniRoute dashboard]
Model: if/kimi-k2-thinking
```
### OpenCode
**Schritt 1:** OmniRoute als benutzerdefinierten Anbieter hinzufĂŒgen:
```bash
opencode
/connect
# Select "Other" â Enter ID: "omniroute" â Enter your OmniRoute API key
```
**Schritt 2:** Erstellen/bearbeiten Sie `opencode.json` in Ihrem Projektstamm:
```json
{
"$schema": "https://opencode.ai/config.json",
"provider": {
"omniroute": {
"npm": "@ai-sdk/openai-compatible",
"name": "OmniRoute",
"options": {
"baseURL": "http://localhost:20128/v1"
},
"models": {
"cc/claude-sonnet-4-20250514": { "name": "Claude Sonnet 4" },
"gg/gemini-2.5-pro": { "name": "Gemini 2.5 Pro" },
"if/kimi-k2-thinking": { "name": "Kimi K2 (Free)" }
}
}
}
}
```
**Schritt 3:** WĂ€hlen Sie das Modell in OpenCode aus:
```bash
/models
# Select any OmniRoute model from the list
```
> **Tipp:** FĂŒgen Sie alle in Ihrem OmniRoute `/v1/models`-Endpunkt verfĂŒgbaren Modelle zum Abschnitt `models` hinzu. Verwenden Sie das Format `provider/model-id` aus Ihrem OmniRoute-Dashboard.
---
## đ Fehlerbehebung
Klicken Sie hier, um den Leitfaden zur Fehlerbehebung zu erweitern
**âSprachmodell hat keine Nachrichten bereitgestelltâ**
- Anbieterkontingent erschöpft â ĂberprĂŒfen Sie den Dashboard-Kontingent-Tracker
- Lösung: Combo-Fallback verwenden oder auf gĂŒnstigere Stufe wechseln
**Ratenbegrenzung**
- Abonnementkontingent aufgebraucht â Fallback auf GLM/MiniMax
- Kombination hinzufĂŒgen: `cc/claude-opus-4-6 â glm/glm-4.7 â if/kimi-k2-thinking`
**OAuth-Token abgelaufen**
- Automatische Aktualisierung durch OmniRoute
- Wenn die Probleme weiterhin bestehen: Dashboard â Anbieter â Verbindung wiederherstellen
**Hohe Kosten**
- ĂberprĂŒfen Sie die Nutzungsstatistiken im Dashboard â Kosten
- PrimÀrmodell auf GLM/MiniMax umstellen
- Nutzen Sie das kostenlose Kontingent (Gemini CLI, iFlow) fĂŒr unkritische Aufgaben
**Dashboard-/API-Ports sind falsch**
- `PORT` ist der kanonische Basisport (und standardmĂ€Ăig API-Port)
â `API_PORT` ĂŒberschreibt nur OpenAI-kompatible API-Listener
â `DASHBOARD_PORT` ĂŒberschreibt nur Dashboard/Next.js-Listener
- Setzen Sie `NEXT_PUBLIC_BASE_URL` auf Ihr Dashboard/öffentliche URL (fĂŒr OAuth-RĂŒckrufe).
**Cloud-Synchronisierungsfehler**
â ĂberprĂŒfen Sie, ob `BASE_URL` auf Ihre laufende Instanz verweist
â ĂberprĂŒfen Sie, ob `CLOUD_URL` auf Ihren erwarteten Cloud-Endpunkt verweist
â Halten Sie die `NEXT_PUBLIC_*`-Werte an den serverseitigen Werten ausgerichtet
**Erste Anmeldung funktioniert nicht**
- ĂberprĂŒfen Sie `INITIAL_PASSWORD` in `.env`
â Wenn nicht festgelegt, lautet das Fallback-Passwort `123456`
**Keine Anfrageprotokolle**
- Setzen Sie `ENABLE_REQUEST_LOGS=true` in `.env`
**Verbindungstest zeigt âUngĂŒltigâ fĂŒr OpenAI-kompatible Anbieter**
â Viele Anbieter stellen keinen `/models`-Endpunkt bereit
â OmniRoute v1.0.6+ beinhaltet eine Fallback-Validierung ĂŒber Chat-AbschlĂŒsse
â Stellen Sie sicher, dass die Basis-URL das Suffix `/v1` enthĂ€lt
### đ OAuth auf Server Remoto
> **â ïž WICHTIG fĂŒr den Einsatz von OmniRoute auf VPS/Docker/Remote-Servern**
#### OAuth
Als OAuth-Anmeldeinformationen wurde OmniRoute nicht in die Liste eingetragen. **Zugelassen fĂŒr `localhost`**. Wenn Sie OmniRoute auf einem Remote-Server (z. B.
```
Error 400: redirect_uri_mismatch
```
#### Lösung: Konfigurieren Sie Ihre eigenen OAuth-Anmeldeinformationen
Sie schreiben bitte eine **OAuth 2.0-Client-ID** in der Google Cloud Console mit einem URI fĂŒr Ihren Server.
#### Passo a Passo
**1. Zugriff auf die Google Cloud Console**
Abra: [https://console.cloud.google.com/apis/credentials](https://console.cloud.google.com/apis/credentials)
**2. Rufen Sie eine neue OAuth 2.0-Client-ID auf**
- Klicken Sie auf **"+ Anmeldeinformationen erstellen"** â **"OAuth-Client-ID"**
- Anwendungstyp: **âWebanwendungâ**
- Name: Escolha qualquer nome (z. B. `OmniRoute Remote`)
**3. Adicione als autorisierte Weiterleitungs-URIs**
Nein, **"Autorisierte Weiterleitungs-URIs"**, Zusatz:
```
https://seu-servidor.com/callback
```
> Ersetzen Sie `seu-servidor.com` durch die Domain oder die IP Ihres Servers (einschlieĂlich eines Ports, der unbedingt erforderlich ist, z. B.: `http://45.33.32.156:20128/callback`).
**4. Als Anmeldedaten speichern und kopieren**
AnschlieĂend hat Google die **Client-ID** und das **Client-Geheimnis** angezeigt.
**5. Als Umgebungsvariationen konfigurieren**
Kein `.env` (oder mehrere Docker-Umgebungsvarianten):
```bash
# Para Antigravity:
ANTIGRAVITY_OAUTH_CLIENT_ID=seu-client-id.apps.googleusercontent.com
ANTIGRAVITY_OAUTH_CLIENT_SECRET=GOCSPX-seu-secret
# Para Gemini CLI:
GEMINI_OAUTH_CLIENT_ID=seu-client-id.apps.googleusercontent.com
GEMINI_OAUTH_CLIENT_SECRET=GOCSPX-seu-secret
GEMINI_CLI_OAUTH_CLIENT_SECRET=GOCSPX-seu-secret
```
**6. Neuzugang zu OmniRoute**
```bash
# Se usando npm:
npm run dev
# Se usando Docker:
docker restart omniroute
```
**7. Tente conectar novamente**
Dashboard â Anbieter â Antigravity (oder Gemini CLI) â OAuth
Jetzt hat Google die Nachricht an `https://seu-servidor.com/callback` weitergeleitet und eine Authentifizierungsfunktion durchgefĂŒhrt.
---
#### Workaround vorĂŒbergehend (nicht vorab konfiguriert)
Wenn Sie vorab keine Berechtigung erhalten möchten, besteht die Möglichkeit, das **URL-Handbuch** zu verwenden:
1. OmniRoute ruft eine von Google autorisierte URL auf
2. Nachdem Sie den Autor autorisiert haben, sendet Google eine Weiterleitung an `localhost` (diese wird jedoch nicht vom Server weitergeleitet).
3. **Kopieren Sie eine vollstÀndige URL**, um sie in Ihren Browser zu laden (bitte beachten Sie, dass die Seite noch nicht abgeschlossen ist).
4. Geben Sie die URL ein, die nicht zur Verbindung mit OmniRoute verwendet werden soll
5. Klicken Sie auf **âVerbindenâ**
> Diese Problemumgehung funktioniert aufgrund des Autorisierungscodes auf der URL und ist unabhĂ€ngig von der Weiterleitung oder Nicht-Weiterleitung gĂŒltig.
---
## đ ïž
Klicken Sie hier, um die Tech-Stack-Details zu erweitern
- **Laufzeit**: Node.js 18â22 LTS (â ïž Node.js 24+ wird **nicht unterstĂŒtzt** â native BinĂ€rdateien von `better-sqlite3` sind inkompatibel)
- **Sprache**: TypeScript 5.9 â **100 % TypeScript** fĂŒr `src/` und `open-sse/` (null `any` in Kernmodulen seit Version 2.0)
- **Framework**: Next.js 16 + React 19 + Tailwind CSS 4
- **Datenbank**: LowDB (JSON) + SQLite (DomĂ€nenstatus + Proxy-Protokolle + MCP-PrĂŒfung + Routing-Entscheidungen)
- **Schemas**: Zod (MCP-Tool-I/O-Validierung, API-VertrÀge)
- **Protokolle**: MCP (stdio/HTTP) + A2A v0.3 (JSON-RPC 2.0 + SSE)
- **Streaming**: Vom Server gesendete Ereignisse (SSE)
- **Auth**: OAuth 2.0 (PKCE) + JWT + API-SchlĂŒssel + MCP-bezogene Autorisierung
- **Testen**: Node.js-TestlĂ€ufer + Vitest (ĂŒber 900 Tests einschlieĂlich Einheit, Integration, E2E)- **CI/CD**: GitHub-Aktionen (automatische NPM-Veröffentlichung + Docker Hub bei Veröffentlichung)
- **Website**: [omniroute.online](https://omniroute.online)
- **Paket**: [npmjs.com/package/omniroute](https://www.npmjs.com/package/omniroute)
- **Docker**: [hub.docker.com/r/diegosouzapw/omniroute](https://hub.docker.com/r/diegosouzapw/omniroute)
- **Resilienz**: Leistungsschalter, exponentielles Backoff, Anti-Donner-Herde, TLS-Spoofing, automatische Kombinations-Selbstheilung
---
## đ Dokumentation
| Dokument | Beschreibung |
| ------------------------------------------------ | ------------------------------------------------------------------ |
| [Benutzerhandbuch](docs/USER_GUIDE.md) | Anbieter, Kombinationen, CLI-Integration, Bereitstellung |
| [API-Referenz](docs/API_REFERENCE.md) | Alle Endpunkte mit Beispielen |
| [MCP-Server](open-sse/mcp-server/README.md) | 16 MCP-Tools, IDE-Konfigurationen, Python/TS/Go-Clients |
| [A2A-Server](src/lib/a2a/README.md) | JSON-RPC 2.0-Protokoll, FĂ€higkeiten, Streaming, Aufgabenverwaltung |
| [Auto-Combo-Engine](docs/auto-combo.md) | 6-Faktor-Bewertung, Moduspakete, Selbstheilung |
| [Fehlerbehebung](docs/TROUBLESHOOTING.md) | HÀufige Probleme und Lösungen |
| [Architektur](docs/ARCHITECTURE.md) | Systemarchitektur und Interna |
| [Beitrag](CONTRIBUTING.md) | Entwicklungsaufbau und Richtlinien |
| [OpenAPI-Spezifikation](docs/openapi.yaml) | OpenAPI 3.0-Spezifikation |
| [Sicherheitsrichtlinie](SECURITY.md) | Schwachstellenmeldung und Sicherheitspraktiken |
| [VM-Bereitstellung](docs/VM_DEPLOYMENT_GUIDE.md) | VollstÀndige Anleitung: VM + Nginx + Cloudflare-Setup |
| [Features-Galerie](docs/FEATURES.md) | Visuelle Dashboard-Tour mit Screenshots |
| [Release-Checkliste](docs/RELEASE_CHECKLIST.md) | Validierungsschritte vor der Veröffentlichung |
---
## đșïž
FĂŒr OmniRoute sind **210+ Funktionen** in mehreren Entwicklungsphasen geplant. Hier sind die SchlĂŒsselbereiche:
| Kategorie | Geplante Funktionen | Höhepunkte |
| ------------------------------ | ------------------- | ------------------------------------------------------------------------------------------------------ |
| đ§ **Routing & Intelligenz** | 25+ | Routing mit der niedrigsten Latenz, Tag-basiertes Routing, Quoten-Preflight, P2C-Kontoauswahl |
| đ **Sicherheit & Compliance** | 20+ | SSRF-HĂ€rtung, Credential-Cloaking, Ratenbegrenzung pro Endpunkt, VerwaltungsschlĂŒssel-Scoping |
| đ **Beobachtbarkeit** | 15+ | OpenTelemetry-Integration, Echtzeit-KontingentĂŒberwachung, Kostenverfolgung pro Modell |
| đ **Anbieterintegrationen** | 20+ | Dynamische Modellregistrierung, Anbieter-Abklingzeiten, Multi-Account-Codex, Copilot-Kontingentanalyse |
| ⥠**Leistung** | 15+ | Duale Cache-Schicht, Prompt-Cache, Antwort-Cache, Streaming-Keepalive, Batch-API |
| đ **Ăkosystem** | 10+ | WebSocket-API, Hot-Reload der Konfiguration, verteilter Konfigurationsspeicher, kommerzieller Modus |
### đ Bald erhĂ€ltlich- đ **OpenCode-Integration** â Native AnbieterunterstĂŒtzung fĂŒr die OpenCode AI-Codierungs-IDE
- đ **TRAE-Integration** â Volle UnterstĂŒtzung fĂŒr das TRAE AI-Entwicklungsframework
- đŠ **Batch-API** â Asynchrone Stapelverarbeitung fĂŒr Massenanfragen
- đŻ **Tag-basiertes Routing** â Leiten Sie Anfragen basierend auf benutzerdefinierten Tags und Metadaten weiter
- đ° **Niedrigste Kostenstrategie** â WĂ€hlen Sie automatisch den gĂŒnstigsten verfĂŒgbaren Anbieter aus
> đ VollstĂ€ndige Funktionsspezifikationen verfĂŒgbar in [`docs/new-features/`](docs/new-features/) (217 detaillierte Spezifikationen)
---
## đ„ Mitwirkende
[](https://github.com/diegosouzapw/OmniRoute/graphs/contributors)
### So leisten Sie einen Beitrag
1. Forken Sie das Repository
2. Erstellen Sie Ihren Feature-Zweig (`git checkout -b feature/amazing-feature`)
3. Ăbernehmen Sie Ihre Ănderungen (`git commit -m 'Add amazing feature'`)
4. Push zum Zweig (`git push origin feature/amazing-feature`)
5. Ăffnen Sie eine Pull-Anfrage
Detaillierte Richtlinien finden Sie unter [CONTRIBUTING.md](CONTRIBUTING.md).
### Veröffentlichung einer neuen Version
```bash
# Create a release â npm publish happens automatically
gh release create v2.0.0 --title "v2.0.0" --generate-notes
```
---
## đ Sterngeschichte
---
## đ Danksagungen
Besonderer Dank geht an **[9router](https://github.com/decolua/9router)** von **[decolua](https://github.com/decolua)** â das ursprĂŒngliche Projekt, das diesen Fork inspiriert hat. OmniRoute baut auf dieser unglaublichen Grundlage mit zusĂ€tzlichen Funktionen, multimodalen APIs und einer vollstĂ€ndigen Neufassung von TypeScript auf.
Besonderer Dank geht an **[CLIProxyAPI](https://github.com/router-for-me/CLIProxyAPI)** â die ursprĂŒngliche Go-Implementierung, die diese JavaScript-Portierung inspiriert hat.
---
## đ Lizenz
MIT-Lizenz â Einzelheiten finden Sie unter [LIZENZ](LICENSE).
---
BErstellt mit â€ïž fĂŒr Entwickler, die rund um die Uhr programmieren
omniroute.online