75 KiB
đ OmniRoute â Das kostenlose KI-Gateway
Hören Sie nie auf zu programmieren. Intelligentes Routing zu KOSTENLOSEN und kostengĂŒnstigen KI-Modellen mit automatischem Fallback.
Ihr universeller API-Proxy â ein Endpunkt, mehr als 36 Anbieter, keine Ausfallzeiten. Jetzt mit MCP & A2A Agenten-Orchestrierung.
Chat-AbschlĂŒsse âą Einbettungen âą Bildgenerierung âą Video âą Musik âą Audio âą Reranking âą MCP-Server âą A2A-Protokoll âą 100 % TypeScript
đ€ Kostenloser KI-Anbieter fĂŒr Ihre bevorzugten Programmieragenten
Verbinden Sie jedes KI-gestĂŒtzte IDE- oder CLI-Tool ĂŒber OmniRoute â kostenloses API-Gateway fĂŒr unbegrenzte Codierung.
|
OpenClaw â 205K |
NanoBot â 20.9K |
PicoClaw â 14.6K |
ZeroClaw â 9.9K |
IronClaw â 2.1K |
|
OpenCode â 106K |
Codex CLI â 60.8K |
Claude Code â 67.3K |
Gemini CLI â 94.7K |
Kilo-Code â 15.5K |
đĄ Alle Agenten verbinden sich ĂŒber http://localhost:20128/v1 oder quote
đ What's New in v3.0.0
| Area | Change |
|---|---|
| đ CodeQL Security | Fixed 10+ CodeQL alerts: polynomial-redos, insecure-randomness, shell-injection |
| â Route Validation | All 176 API routes validated with Zod schemas + validateBody() |
| đ omniModel Tag Leak | Internal <omniModel> tags no longer leak to clients in SSE streams (#585) |
| đ Registered Keys API | Auto-provision API keys via POST /api/v1/registered-keys with quota enforcement |
| đïž Scoped API Key Reveal đ | Opt-in recovery of API keys via ALLOW_API_KEY_REVEAL |
| đš Provider Icons | 130+ provider logos via @lobehub/icons (SVG) with PNG fallback |
| đ Model Auto-Sync | 24h scheduler refreshes model lists for 16 providers |
| đ OpenCode Zen/Go | Two new providers: free tier + subscription tier |
| đ§ 926 Tests | Full test suite passes with 0 failures |
đ What's New in v3.0.0
| Area | Change |
|---|---|
| đ CodeQL Security | Fixed 10+ CodeQL alerts: polynomial-redos, insecure-randomness, shell-injection |
| â Route Validation | All 176 API routes validated with Zod schemas + validateBody() |
| đ omniModel Tag Leak | Internal <omniModel> tags no longer leak to clients in SSE streams (#585) |
| đ Registered Keys API | Auto-provision API keys via POST /api/v1/registered-keys with quota enforcement |
| đš Provider Icons | 130+ provider logos via @lobehub/icons (SVG) with PNG fallback |
| đ Model Auto-Sync | 24h scheduler refreshes model lists for 16 providers |
| đ OpenCode Zen/Go | Two new providers: free tier + subscription tier |
| đ§ 926 Tests | Full test suite passes with 0 failures |
đ€ Warum OmniRoute?
Hören Sie auf, Geld zu verschwenden und an Grenzen zu stoĂen:
Das Abonnementkontingent lÀuft jeden Monat ungenutzt ab
Ratenbegrenzungen verhindern, dass Sie mitten in der Codierung sind
Teure APIs (20â50Â $/Monat pro Anbieter)
Manueller Wechsel zwischen Anbietern
OmniRoute löst dieses Problem:
- â Abonnements maximieren - Verfolgen Sie das Kontingent, nutzen Sie jedes Bit vor dem ZurĂŒcksetzen
- â Auto-Fallback â Abonnement â API-SchlĂŒssel â GĂŒnstig â Kostenlos, keine Ausfallzeiten
- â Mehrere Konten â Round-Robin zwischen Konten pro Anbieter
- â Universell â Funktioniert mit Claude Code, Codex, Gemini CLI, Cursor, Cline, OpenClaw und jedem CLI-Tool
đ§ UnterstĂŒtzung> đŹ Treten Sie unserer Community bei! WhatsApp-Gruppe â Holen Sie sich Hilfe, tauschen Sie Tipps aus und bleiben Sie auf dem Laufenden.
- Website: omniroute.online
- GitHub: github.com/diegosouzapw/OmniRoute
- Probleme: github.com/diegosouzapw/OmniRoute/issues
- WhatsApp: Community-Gruppe
- Mitwirken: Siehe CONTRIBUTING.md, öffnen Sie eine PR oder wÀhlen Sie eine
good first issueaus - Originalprojekt: 9router von decolua
đ Wie es funktioniert
âââââââââââââââ
â Your CLI â (Claude Code, Codex, Gemini CLI, OpenClaw, Cursor, Cline...)
â Tool â
ââââââââŹâââââââ
â http://localhost:20128/v1
â
âââââââââââââââââââââââââââââââââââââââââââ
â OmniRoute (Smart Router) â
â âą Format translation (OpenAI â Claude) â
â âą Quota tracking + Embeddings + Images â
â âą Auto token refresh â
ââââââââŹâââââââââââââââââââââââââââââââââââ
â
âââ [Tier 1: SUBSCRIPTION] Claude Code, Codex, Gemini CLI
â â quota exhausted
âââ [Tier 2: API KEY] DeepSeek, Groq, xAI, Mistral, NVIDIA NIM, etc.
â â budget limit
âââ [Tier 3: CHEAP] GLM ($0.6/1M), MiniMax ($0.2/1M)
â â budget limit
âââ [Tier 4: FREE] iFlow, Qwen, Kiro (unlimited)
Result: Never stop coding, minimal cost
đŻ Was OmniRoute löst â 30 echte Problempunkte und AnwendungsfĂ€lle
Jeder Entwickler, der KI-Tools verwendet, ist tĂ€glich mit diesen Problemen konfrontiert. OmniRoute wurde entwickelt, um sie alle zu lösen â von KostenĂŒberschreitungen bis hin zu regionalen Blockaden, von unterbrochenen OAuth-FlĂŒssen bis hin zu ProtokollvorgĂ€ngen und Unternehmensbeobachtbarkeit.
đž 1. âIch bezahle ein teures Abonnement, werde aber trotzdem durch Limits unterbrochenâ
Entwickler zahlen 20â200 US-Dollar/Monat fĂŒr Claude Pro, Codex Pro oder GitHub Copilot. Auch wenn das Kontingent bezahlt wird, gibt es eine Obergrenze â 5 Stunden Nutzung, wöchentliche Limits oder Tariflimits pro Minute. WĂ€hrend der Codierungssitzung reagiert der Anbieter nicht mehr und der Entwickler verliert an Fluss und ProduktivitĂ€t.
So löst OmniRoute das Problem:
- Intelligenter 4-Stufen-Fallback â Wenn das Abonnementkontingent aufgebraucht ist, wird automatisch zu API Key â GĂŒnstig â Kostenlos weitergeleitet, ohne dass ein manueller Eingriff erforderlich ist
- Kontingentverfolgung in Echtzeit â Zeigt den Token-Verbrauch in Echtzeit mit Reset-Countdown an (5 Stunden, tĂ€glich, wöchentlich)
- UnterstĂŒtzung mehrerer Konten â Mehrere Konten pro Anbieter mit automatischem Round-Robin â wenn eines aufgebraucht ist, wird zum nĂ€chsten gewechselt
- Benutzerdefinierte Kombinationen â Anpassbare Fallback-Ketten mit 6 Ausgleichsstrategien (Fill-First, Round-Robin, P2C, Random, Least-Used, Kostenoptimiert)
- Codex Business Quotas â Ăberwachung der GeschĂ€fts-/Team-Arbeitsbereichskontingente direkt im Dashboard
đ 2. âIch muss mehrere Anbieter verwenden, aber jeder hat eine andere APIâ
OpenAI verwendet ein Format, Claude (Anthropic) verwendet ein anderes, Gemini noch ein anderes. Wenn ein Entwickler Modelle verschiedener Anbieter testen oder zwischen ihnen wechseln möchte, muss er SDKs neu konfigurieren, Endpunkte Ă€ndern und mit inkompatiblen Formaten umgehen. Benutzerdefinierte Anbieter (FriendLI, NIM) verfĂŒgen ĂŒber nicht standardmĂ€Ăige Modellendpunkte.
So löst OmniRoute das Problem:
- Einheitlicher Endpunkt â Ein einzelner
http://localhost:20128/v1dient als Proxy fĂŒr alle ĂŒber 36 Anbieter - FormatĂŒbersetzung â Automatisch und transparent: OpenAI â Claude â Gemini â Responses API
- Antwortbereinigung â Entfernt nicht standardmĂ€Ăige Felder (
x_groq,usage_breakdown,service_tier), die OpenAI SDK v1.83+ beschĂ€digen - Rollennormalisierung â Konvertiert
developerâsystemfĂŒr Nicht-OpenAI-Anbieter;systemâuserfĂŒr GLM/ERNIE - Think Tag Extraction â Extrahiert
<think>-Blöcke aus Modellen wie DeepSeek R1 in das standardisiertereasoning_content - Strukturierte Ausgabe fĂŒr Gemini â
json_schemaâresponseMimeType/responseSchemaautomatische Konvertierung streamist standardmĂ€Ăigfalseâ Entspricht der OpenAI-Spezifikation und vermeidet unerwartetes SSE in Python/Rust/Go-SDKs
đ 3. âMein KI-Anbieter blockiert meine Region/mein Landâ
Anbieter wie OpenAI/Codex blockieren den Zugriff aus bestimmten geografischen Regionen. Benutzer erhalten bei OAuth- und API-Verbindungen Fehler wie unsupported_country_region_territory. Dies ist besonders frustrierend fĂŒr Entwickler aus EntwicklungslĂ€ndern.
So löst OmniRoute das Problem:
- 3-Level-Proxy-Konfiguration â Konfigurierbarer Proxy auf 3 Ebenen: global (gesamter Datenverkehr), pro Anbieter (nur ein Anbieter) und pro Verbindung/SchlĂŒssel
- Farbcodierte Proxy-Abzeichen â Visuelle Indikatoren: đą globaler Proxy, đĄ Anbieter-Proxy, đ” Verbindungs-Proxy, immer mit IP-Adresse
- OAuth-Token-Austausch ĂŒber Proxy â Der OAuth-Fluss lĂ€uft auch ĂŒber den Proxy und löst
unsupported_country_region_territory - Verbindungstests ĂŒber Proxy â Verbindungstests verwenden den konfigurierten Proxy (keine direkte Umgehung mehr)
- SOCKS5-UnterstĂŒtzung â VollstĂ€ndige SOCKS5-Proxy-UnterstĂŒtzung fĂŒr ausgehendes Routing
- TLS-Fingerabdruck-Spoofing â BrowserĂ€hnlicher TLS-Fingerabdruck ĂŒber
wreq-jszur Umgehung der Bot-Erkennung
đ 4. âIch möchte KI zum Codieren verwenden, habe aber kein Geldâ
Nicht jeder kann 20â200 $/Monat fĂŒr KI-Abonnements bezahlen. Studenten, Entwickler aus SchwellenlĂ€ndern, Bastler und Freiberufler benötigen Zugang zu hochwertigen Modellen zum Nulltarif.
So löst OmniRoute das Problem:
- Integrierte kostenlose Anbieter â Native UnterstĂŒtzung fĂŒr 100 % kostenlose Anbieter: iFlow (8 unbegrenzte Modelle), Qwen (3 unbegrenzte Modelle), Kiro (Claude kostenlos), Gemini CLI (180.000/Monat kostenlos)
- Ollama Cloud â Cloud-hosted Ollama models at
api.ollama.comwith free "Light usage" tier; useollamacloud/<model>prefix - Nur kostenlose Combos â Kette
gc/gemini-3-flash â if/kimi-k2-thinking â qw/qwen3-coder-plus= 0 $/Monat ohne Ausfallzeit - NVIDIA NIM Free Credits â 1000 kostenlose Credits integriert
- Kostenoptimierte Strategie â Routing-Strategie, die automatisch den gĂŒnstigsten verfĂŒgbaren Anbieter auswĂ€hlt
đ 5. âIch muss mein KI-Gateway vor unbefugtem Zugriff schĂŒtzenâ
Wenn ein KI-Gateway dem Netzwerk (LAN, VPS, Docker) zugĂ€nglich gemacht wird, kann jeder mit der Adresse die Token/Kontingente des Entwicklers verbrauchen. Ohne Schutz sind APIs anfĂ€llig fĂŒr Missbrauch, sofortige Injektion und Missbrauch.
So löst OmniRoute das Problem:
- API-SchlĂŒsselverwaltung â Generierung, Rotation und Scoping pro Anbieter mit einer dedizierten
/dashboard/api-manager-Seite - Berechtigungen auf Modellebene â BeschrĂ€nken Sie API-SchlĂŒssel auf bestimmte Modelle (
openai/*, Platzhaltermuster) mit der Umschaltfunktion âAlle zulassen/EinschrĂ€nkenâ. - API Endpoint Protection â Fordern Sie einen SchlĂŒssel fĂŒr
/v1/modelsan und blockieren Sie bestimmte Anbieter aus der Liste - Auth Guard + CSRF-Schutz â Alle Dashboard-Routen sind mit
withAuth-Middleware + CSRF-Tokens geschĂŒtzt - Ratenbegrenzer â Ratenbegrenzung pro IP mit konfigurierbaren Fenstern
- IP-Filterung â Zulassungs-/Blockierungsliste fĂŒr die Zugriffskontrolle
- Prompt Injection Guard â Bereinigung gegen bösartige Eingabeaufforderungsmuster
- AES-256-GCM-VerschlĂŒsselung â Anmeldeinformationen im Ruhezustand verschlĂŒsselt
đ 6. âMein Provider ist ausgefallen und ich habe meinen Codierungsfluss verlorenâ
KI-Anbieter können instabil werden, 5xx-Fehler zurĂŒckgeben oder vorĂŒbergehende Ratengrenzen erreichen. Wenn ein Entwickler von einem einzelnen Anbieter abhĂ€ngig ist, wird er unterbrochen. Ohne Schutzschalter können wiederholte Versuche zum Absturz der Anwendung fĂŒhren.So löst OmniRoute das Problem:
- Leistungsschalter pro Anbieter â Automatisches Ăffnen/SchlieĂen mit konfigurierbaren Schwellenwerten und Abklingzeit (geschlossen/offen/halb offen)
- Exponentielles Backoff â Progressive Wiederholungsverzögerungen
- Anti-Thundering Herd â Mutex + Semaphor-Schutz gegen gleichzeitige WiederholungsstĂŒrme
- Combo-Fallback-Ketten â Wenn der primĂ€re Anbieter ausfĂ€llt, fĂ€llt er automatisch durch die Kette, ohne dass ein Eingreifen erforderlich ist
- Combo Circuit Breaker â Deaktiviert automatisch ausgefallene Anbieter innerhalb einer Combo-Kette | đŻ Endpoint-Aware Models | Custom models declare supported endpoints + API format |
- Gesundheits-Dashboard â BetriebszeitĂŒberwachung, LeistungsschalterzustĂ€nde, Sperren, Cache-Statistiken, p50/p95/p99-Latenz
đ§ 7. âDie Konfiguration jedes KI-Tools ist mĂŒhsam und repetitivâ
Entwickler verwenden Cursor, Claude Code, Codex CLI, OpenClaw, Gemini CLI, Kilo Code ... Jedes Tool benötigt eine andere Konfiguration (API-Endpunkt, SchlĂŒssel, Modell). Eine Neukonfiguration bei einem Anbieter- oder Modellwechsel ist Zeitverschwendung.
So löst OmniRoute das Problem:
- CLI Tools Dashboard â Spezielle Seite mit Ein-Klick-Einrichtung fĂŒr Claude Code, Codex CLI, OpenClaw, Kilo Code, Antigravity, Cline
- GitHub Copilot Config Generator â Generiert
chatLanguageModels.jsonfĂŒr VS-Code mit Massenmodellauswahl - Onboarding-Assistent â GefĂŒhrte Einrichtung in 4 Schritten fĂŒr Erstbenutzer
- Ein Endpunkt, alle Modelle â Konfigurieren Sie
http://localhost:20128/v1einmal und greifen Sie auf ĂŒber 36 Anbieter zu
đ 8. âOAuth-Tokens von mehreren Anbietern zu verwalten ist die Hölleâ
Claude Code, Codex, Gemini CLI, Copilot â alle verwenden OAuth 2.0 mit ablaufenden Token. Entwickler mĂŒssen sich stĂ€ndig neu authentifizieren, sich mit client_secret is missing, redirect_uri_mismatch und Fehlern auf Remote-Servern auseinandersetzen. Besonders problematisch ist OAuth auf LAN/VPS.
So löst OmniRoute das Problem:
- Automatische Token-Aktualisierung â OAuth-Tokens werden vor Ablauf im Hintergrund aktualisiert
- OAuth 2.0 (PKCE) integriert â Automatischer Ablauf fĂŒr Claude Code, Codex, Gemini CLI, Copilot, Kiro, Qwen, iFlow
- Multi-Account OAuth â Mehrere Konten pro Anbieter ĂŒber JWT/ID-Token-Extraktion
- OAuth LAN/Remote Fix â Private IP-Erkennung fĂŒr
redirect_uri+ manueller URL-Modus fĂŒr Remote-Server - OAuth Behind Nginx â Verwendet
window.location.originfĂŒr Reverse-Proxy-KompatibilitĂ€t - Remote OAuth Guide â Schritt-fĂŒr-Schritt-Anleitung fĂŒr Google Cloud-Anmeldeinformationen auf VPS/Docker
đ 9. âIch weiĂ nicht, wie viel ich ausgebe oder woâ
Entwickler nutzen mehrere kostenpflichtige Anbieter, haben jedoch keine einheitliche Sicht auf die Ausgaben. Jeder Anbieter verfĂŒgt ĂŒber ein eigenes Abrechnungs-Dashboard, es gibt jedoch keine konsolidierte Ansicht. Unerwartete Kosten können sich hĂ€ufen.
So löst OmniRoute das Problem:
- Kostenanalyse-Dashboard â Kostenverfolgung pro Token und Budgetverwaltung pro Anbieter
- Budgetgrenzen pro Stufe â Ausgabenobergrenze pro Stufe, die einen automatischen Fallback auslöst
- Preiskonfiguration pro Modell â Konfigurierbare Preise pro Modell- Nutzungsstatistiken pro API-SchlĂŒssel â Anzahl der Anfragen und zuletzt verwendeter Zeitstempel pro SchlĂŒssel
- Analytics-Dashboard â Statistikkarten, Modellnutzungsdiagramm, Anbietertabelle mit Erfolgsraten und Latenz
đ 10. âIch kann Fehler und Probleme bei KI-Anrufen nicht diagnostizierenâ
Wenn ein Anruf fehlschlĂ€gt, weiĂ der Entwickler nicht, ob es sich um eine Ratenbegrenzung, ein abgelaufenes Token, ein falsches Format oder einen Anbieterfehler handelt. Fragmentierte Protokolle ĂŒber verschiedene Terminals hinweg. Ohne Beobachtbarkeit ist das Debuggen ein Versuch und Irrtum.
So löst OmniRoute das Problem:
- Unified Logs Dashboard â 4 Registerkarten: Anforderungsprotokolle, Proxy-Protokolle, Audit-Protokolle, Konsole
- Console Log Viewer â Echtzeit-Viewer im Terminal-Stil mit farbcodierten Ebenen, automatischem Scrollen, Suche und Filter
- SQLite-Proxy-Protokolle â Persistente Protokolle, die Serverneustarts ĂŒberdauern
- Translator Playground â 4 Debugging-Modi: Playground (FormatĂŒbersetzung), Chat Tester (Round-Trip), Test Bench (Batch), Live Monitor (Echtzeit)
- Telemetrie anfordern â p50/p95/p99-Latenz + X-Request-Id-Ablaufverfolgung
- Dateibasierte Protokollierung mit Rotation â Der Konsolen-Interceptor erfasst alles im JSON-Protokoll mit gröĂenbasierter Rotation
đïž 11. âDie Bereitstellung und Wartung des Gateways ist komplexâ
Die Installation, Konfiguration und Wartung eines KI-Proxys in verschiedenen Umgebungen (lokal, VPS, Docker, Cloud) ist arbeitsintensiv. Probleme wie hartcodierte Pfade, EACCES in Verzeichnissen, Portkonflikte und plattformĂŒbergreifende Builds sorgen fĂŒr zusĂ€tzliche Reibung.
So löst OmniRoute das Problem:
- npm globale Installation â
npm install -g omniroute && omnirouteâ fertig - Docker Multi-Platform â AMD64 + ARM64 nativ (Apple Silicon, AWS Graviton, Raspberry Pi)
- Docker Compose-Profile â
base(keine CLI-Tools) undcli(mit Claude Code, Codex, OpenClaw) - Electron Desktop App â Native App fĂŒr Windows/macOS/Linux mit Taskleiste, Autostart, Offline-Modus
- Split-Port-Modus â API und Dashboard auf separaten Ports fĂŒr erweiterte Szenarien (Reverse-Proxy, Container-Netzwerk)
- Cloud Sync â Konfigurieren Sie die gerĂ€teĂŒbergreifende Synchronisierung ĂŒber Cloudflare Workers
- DB-Backups â Automatische Sicherung, Wiederherstellung, Export und Import aller Einstellungen
đ 12. âDie BenutzeroberflĂ€che ist nur auf Englisch verfĂŒgbar und mein Team spricht kein Englischâ
Teams in nicht englischsprachigen LÀndern, insbesondere in Lateinamerika, Asien und Europa, haben Probleme mit rein englischsprachigen BenutzeroberflÀchen. Sprachbarrieren verringern die Akzeptanz und erhöhen die Zahl von Konfigurationsfehlern.
So löst OmniRoute das Problem:
- Dashboard i18n â 30 Sprachen â Alle ĂŒber 500 Tasten ĂŒbersetzt, einschlieĂlich Arabisch, Bulgarisch, DĂ€nisch, Deutsch, Spanisch, Finnisch, Französisch, HebrĂ€isch, Hindi, Ungarisch, Indonesisch, Italienisch, Japanisch, Koreanisch, Malaiisch, NiederlĂ€ndisch, Norwegisch, Polnisch, Portugiesisch (PT/BR), RumĂ€nisch, Russisch, Slowakisch, Schwedisch, ThailĂ€ndisch, Ukrainisch, Vietnamesisch, Chinesisch, Philippinisch, Englisch
- RTL-UnterstĂŒtzung â Rechts-nach-links-UnterstĂŒtzung fĂŒr Arabisch und HebrĂ€isch
- Mehrsprachige READMEs â 30 vollstĂ€ndige DokumentationsĂŒbersetzungen
- Sprachauswahl â Globussymbol in der Kopfzeile zum Umschalten in Echtzeit
đ 13. âIch brauche mehr als nur Chat â ich brauche Einbettungen, Bilder, Audioâ
KI ist nicht nur der Abschluss eines Chats. Entwickler mĂŒssen Bilder generieren, Audio transkribieren, Einbettungen fĂŒr RAG erstellen, Dokumente neu einordnen und Inhalte moderieren. Jede API hat einen anderen Endpunkt und ein anderes Format.
So löst OmniRoute das Problem:
- Einbettungen â
/v1/embeddingsmit 6 Anbietern und 9+ Modellen - Bildgenerierung â
/v1/images/generationsmit 10 Anbietern und ĂŒber 20 Modellen (OpenAI, xAI, Together, Fireworks, Nebius, Hyperbolic, NanoBanana, Antigravity, SD WebUI, ComfyUI) - Text-zu-Video â
/v1/videos/generationsâ ComfyUI (AnimateDiff, SVD) und SD WebUI - Text-zu-Musik â
/v1/music/generationsâ ComfyUI (Stable Audio Open, MusicGen) - Audiotranskription â
/v1/audio/transcriptionsâ Whisper + Nvidia NIM, HuggingFace, Qwen3 - Text-to-Speech â
/v1/audio/speechâ ElevenLabs, Nvidia NIM, HuggingFace, Coqui, Tortoise, Qwen3, Inworld, Cartesia, PlayHT, + bestehende Anbieter - Moderationen â
/v1/moderationsâ ĂberprĂŒfung der Inhaltssicherheit - Neueinstufung â
/v1/rerankâ Neueinstufung der Dokumentenrelevanz - Antwort-API â VollstĂ€ndige
/v1/responses-UnterstĂŒtzung fĂŒr Codex
đ§Ș 14. âIch habe keine Möglichkeit, die QualitĂ€t verschiedener Modelle zu testen und zu vergleichenâ
Entwickler möchten wissen, welches Modell fĂŒr ihren Anwendungsfall am besten geeignet ist â Code, Ăbersetzung, Argumentation â, aber ein manueller Vergleich ist langsam. Es sind keine integrierten Evaluierungstools vorhanden.
So löst OmniRoute das Problem:
- LLM-Bewertungen â Golden-Set-Test mit 10 vorinstallierten FĂ€llen zu BegrĂŒĂungen, Mathematik, Geografie, Codegenerierung, JSON-KonformitĂ€t, Ăbersetzung, Markdown und Sicherheitsverweigerung
- 4 Match-Strategien â
exact,contains,regex,custom(JS-Funktion) - Translator Playground Test Bench â Batch-Tests mit mehreren Eingaben und erwarteten Ausgaben, anbieterĂŒbergreifender Vergleich
- Chat-Tester â VollstĂ€ndiger Roundtrip mit visueller Antwortwiedergabe
- Live-Monitor â Echtzeit-Stream aller Anfragen, die ĂŒber den Proxy flieĂen
đ 15. âIch muss skalieren, ohne an Leistung einzubĂŒĂenâ
Wenn das Anfragevolumen wĂ€chst, verursachen dieselben Fragen ohne Zwischenspeicherung doppelte Kosten. Ohne Idempotenz verschwenden doppelte Anfragen die Verarbeitung. Die Tarifbegrenzungen pro Anbieter mĂŒssen eingehalten werden.
So löst OmniRoute das Problem:
- Semantischer Cache â Zweistufiger Cache (Signatur + Semantik) reduziert Kosten und Latenz
- Request Idempotency â 5-Sekunden-Deduplizierungsfenster fĂŒr identische Anfragen
- Ratenbegrenzungserkennung â Provider-RPM, minimale LĂŒcke und maximale gleichzeitige Verfolgung
- Bearbeitbare Ratengrenzen â Konfigurierbare Standardeinstellungen unter Einstellungen â Ausfallsicherheit mit Persistenz
- API Key Validation Cache â 3-stufiger Cache fĂŒr Produktionsleistung
- Gesundheits-Dashboard mit Telemetrie â p50/p95/p99-Latenz, Cache-Statistiken, Betriebszeit
đ€ 16. âIch möchte das Modellverhalten global steuernâ
Entwickler, die alle Antworten in einer bestimmten Sprache oder mit einem bestimmten Ton wĂŒnschen oder die Argumentationstoken einschrĂ€nken möchten. Dies in jedem Tool/jeder Anfrage zu konfigurieren, ist unpraktisch.So löst OmniRoute das Problem:
- System Prompt Injection â Globale Eingabeaufforderung, die auf alle Anfragen angewendet wird
- Thinking Budget Validation â Reasoning-Token-Zuteilungskontrolle pro Anfrage (Passthrough, automatisch, benutzerdefiniert, adaptiv)
- 6 Routing-Strategien â Globale Strategien, die bestimmen, wie Anfragen verteilt werden
- Wildcard-Router â
provider/*-Muster leiten dynamisch an jeden Anbieter weiter - Combo-Aktivierung/Deaktivierung umschalten â Combos direkt ĂŒber das Dashboard umschalten
- Provider Toggle â Alle Verbindungen fĂŒr einen Anbieter mit einem Klick aktivieren/deaktivieren
- Blockierte Anbieter â Bestimmte Anbieter aus der
/v1/models-Liste ausschlieĂen
đ§° 17. âIch brauche MCP-Tools als erstklassige Produktfunktionenâ
Viele KI-Gateways stellen MCP nur als verstecktes Implementierungsdetail zur VerfĂŒgung. Teams benötigen eine sichtbare, ĂŒberschaubare Betriebsebene.
So löst OmniRoute das Problem:
â MCP wird in der Dashboard-Navigation und auf der Registerkarte âEndpunktprotokollâ angezeigt
- Dedizierte MCP-Verwaltungsseite mit Prozess, Tools, Bereichen und Audit
â Integrierter Schnellstart fĂŒr
omniroute --mcpund Kunden-Onboarding
đ§ 18. âIch benötige A2A-Orchestrierung mit Synchronisierungs- und Stream-Aufgabenpfadenâ
Agenten-Workflows erfordern sowohl direkte Antworten als auch eine lang andauernde gestreamte AusfĂŒhrung mit Lebenszykluskontrolle.
So löst OmniRoute das Problem:
â A2A JSON-RPC-Endpunkt (POST /a2a) mit message/send und message/stream
- SSE-Streaming mit Terminal-State-Propagation
â Task-Lebenszyklus-APIs fĂŒr
tasks/getundtasks/cancel
đ°ïž 19. âIch benötige den echten Zustand des MCP-Prozesses, keinen erratenen Statusâ
Betriebsteams mĂŒssen wissen, ob MCP tatsĂ€chlich aktiv ist, und nicht nur, ob eine API erreichbar ist.
So löst OmniRoute das Problem:
â Laufzeit-Heartbeat-Datei mit PID, Zeitstempeln, Transport, Werkzeuganzahl und Oszilloskopmodus
- MCP-Status-API, die Heartbeat + aktuelle AktivitÀt kombiniert
- UI-Statuskarten fĂŒr Prozess-/VerfĂŒgbarkeits-/Heartbeat-AktualitĂ€t
đ 20. âIch benötige eine ĂŒberprĂŒfbare MCP-Tool-AusfĂŒhrungâ
Wenn Tools die Konfiguration verĂ€ndern oder operative Aktionen auslösen, benötigen Teams forensische RĂŒckverfolgbarkeit.
So löst OmniRoute das Problem:
â SQLite-gestĂŒtzte Audit-Protokollierung fĂŒr MCP-Tool-Aufrufe
- Filtert nach Tool, Erfolg/Misserfolg, API-SchlĂŒssel und Paginierung
- Dashboard-Audit-Tabelle + Statistik-Endpunkte fĂŒr die Automatisierung
đ 21. âIch benötige bereichsweise MCP-Berechtigungen pro Integrationâ
Verschiedene Clients sollten Zugriff auf die Werkzeugkategorien mit den geringsten Rechten haben.
So löst OmniRoute das Problem:
- 9 granulare MCP-Bereiche fĂŒr kontrollierten Werkzeugzugriff
- Geltungsbereichsdurchsetzung und Sichtbarkeit in der MCP-Management-BenutzeroberflÀche
- Sichere Standardhaltung fĂŒr Betriebswerkzeuge
âïž 22. âIch benötige Betriebskontrollen ohne erneute Bereitstellungâ
Teams benötigen bei VorfÀllen oder Kostenereignissen schnelle LaufzeitÀnderungen.
So löst OmniRoute das Problem:
- Schalten Sie die Combo-Aktivierung direkt ĂŒber das MCP-Dashboard um
- Wenden Sie Ausfallsicherheitsprofile aus vordefinierten Richtlinienpaketen an
- Setzen Sie den Leistungsschalterstatus ĂŒber dasselbe Bedienfeld zurĂŒck
đ 23. âIch benötige Live-Sichtbarkeit und Abbruch des A2A-Aufgabenlebenszyklusâ
Ohne Sichtbarkeit des Lebenszyklus wird es schwierig, AufgabenvorfÀlle zu selektieren.
So löst OmniRoute das Problem:
- Aufgabenliste/Filterung nach Bundesland/FĂ€higkeit mit Paginierung
- Drilldown zu Aufgabenmetadaten, Ereignissen und Artefakten
- Endpunkt zum Abbrechen von Aufgaben und UI-Aktion mit BestÀtigung
đ 24. âIch benötige aktive Stream-Metriken fĂŒr die A2A-Lastâ
Streaming-Workflows erfordern betriebliche Einblicke in ParallelitÀt und Live-Verbindungen.
So löst OmniRoute das Problem:
- Aktive Stream-ZĂ€hler im A2A-Status integriert
- Zeitstempel der letzten Aufgabe und Anzahl pro Status
- A2A-Dashboard-Karten fĂŒr die Echtzeit-BetriebsĂŒberwachung
đȘȘ 25. âIch benötige Standard-Agent-Erkennung fĂŒr Clientsâ
Externe Kunden und Orchestratoren benötigen fĂŒr das Onboarding maschinenlesbare Metadaten.
So löst OmniRoute das Problem:
â Agentenkarte unter /.well-known/agent.json ausgestellt
- FĂ€higkeiten und Fertigkeiten werden in der Management-BenutzeroberflĂ€che angezeigt â Die A2A-Status-API enthĂ€lt Erkennungsmetadaten fĂŒr die Automatisierung
đ§ 26. âIch benötige Protokollauffindbarkeit in der Produkt-UXâ
Wenn Benutzer ProtokolloberflÀchen nicht entdecken können, sinken Akzeptanz und SupportqualitÀt.
So löst OmniRoute das Problem:
- SeitenleisteneintrĂ€ge fĂŒr MCP und A2A
- Registerkarte âProtokolleâ auf der Endpunktseite mit Schnellstart und Status
- Links von der Ăbersicht zu speziellen Management-Dashboards
đ§Ș 27. âIch benötige eine End-to-End-Protokollvalidierung mit echten Clientsâ
Probetests reichen nicht aus, um die ProtokollkompatibilitĂ€t vor der Veröffentlichung zu ĂŒberprĂŒfen.
So löst OmniRoute das Problem:
â E2E-Suite, die die App startet und echten MCP SDK-Client-Transport verwendet
- A2A-Clienttests fĂŒr Erkennungs-, Sende-, Stream-, Get- und AbbruchflĂŒsse
- Vergleichen Sie Behauptungen mit MCP-Audit- und A2A-Aufgaben-APIs
đĄ 28. âIch brauche eine einheitliche Beobachtbarkeit ĂŒber alle Schnittstellen hinwegâ
Die Aufteilung der Beobachtbarkeit nach Protokoll fĂŒhrt zu blinden Flecken und einer lĂ€ngeren MTTR.
So löst OmniRoute das Problem:
- Einheitliche Dashboards/Protokolle/Analysen in einem Produkt
- Gesundheits-, Audit- und Anforderungstelemetrie ĂŒber OpenAI-, MCP- und A2A-Ebenen hinweg
- Operative APIs fĂŒr Status und Automatisierung
đŒ 29. âIch benötige eine Laufzeit fĂŒr Proxy + Tools + Agent-Orchestrierungâ
Die AusfĂŒhrung vieler separater Dienste erhöht die Betriebskosten und erhöht die FehlerhĂ€ufigkeit.
So löst OmniRoute das Problem:- OpenAI-kompatibler Proxy, MCP-Server und A2A-Server in einem Stack â Gemeinsame Authentifizierung, Ausfallsicherheit, Datenspeicher und Beobachtbarkeit
- Konsistentes Richtlinienmodell ĂŒber alle InteraktionsoberflĂ€chen hinweg
đ 30. âIch muss Agenten-Workflows ohne Glue-Code-Ausbreitung versendenâ
Teams verlieren an Geschwindigkeit, wenn sie mehrere Ad-hoc-Dienste und -Skripte zusammenfĂŒgen.
So löst OmniRoute das Problem:
- Einheitliche Endpunktstrategie fĂŒr Kunden und Agenten
- Integrierte Protokollverwaltungs-BenutzeroberflÀchen und Rauchvalidierungspfade
- Produktionsreife Grundlagen (Sicherheit, Protokollierung, Ausfallsicherheit, Backup)
Beispiel-Playbooks (Integrierte AnwendungsfÀlle)
Playbook A: Bezahltes Abonnement maximieren + gĂŒnstiges Backup
Combo: "maximize-claude"
1. cc/claude-opus-4-6
2. glm/glm-4.7
3. if/kimi-k2-thinking
Monthly cost: $20 + small backup spend
Outcome: higher quality, near-zero interruption
Playbook B: Kostenfreier Codierungsstack
Combo: "free-forever"
1. gc/gemini-3-flash
2. if/kimi-k2-thinking
3. qw/qwen3-coder-plus
Monthly cost: $0
Outcome: stable free coding workflow
Playbook C: 24/7 Always-On-Fallback-Kette
Combo: "always-on"
1. cc/claude-opus-4-6
2. cx/gpt-5.2-codex
3. glm/glm-4.7
4. minimax/MiniMax-M2.1
5. if/kimi-k2-thinking
Outcome: deep fallback depth for deadline-critical workloads
Playbook D: Agentenoperationen mit MCP + A2A
1) Start MCP transport (`omniroute --mcp`) for tool-driven operations
2) Run A2A tasks via `message/send` and `message/stream`
3) Observe via /dashboard/mcp and /dashboard/a2a
4) Control incidents with resilience profile + task cancellation
⥠Schnellstart
1) Installieren und ausfĂŒhren
npm install -g omniroute
omniroute
Das Dashboard wird unter http://localhost:20128 geöffnet und die API-Basis-URL lautet http://localhost:20128/v1.
| Befehl | Beschreibung |
|---|---|
omniroute |
Server starten (PORT=20128, API und Dashboard auf demselben Port) |
omniroute --port 3000 |
Setzen Sie den kanonischen/API-Port auf 3000 |
omniroute --mcp |
Starten Sie den MCP-Server (STDIO-Transport) |
omniroute --no-open |
Browser nicht automatisch öffnen |
omniroute --help |
Hilfe anzeigen |
Optionaler Split-Port-Modus:
PORT=20128 DASHBOARD_PORT=20129 omniroute
# API: http://localhost:20128/v1
# Dashboard: http://localhost:20129
2) Verbinden Sie Anbieter und erstellen Sie Ihren API-SchlĂŒssel
- Ăffnen Sie Dashboard â
Providersund verbinden Sie mindestens einen Anbieter (OAuth oder API-SchlĂŒssel). - Ăffnen Sie Dashboard â
Endpointund erstellen Sie einen API-SchlĂŒssel. - (Optional) Ăffnen Sie Dashboard â
Combosund legen Sie Ihre Fallback-Kette fest.
3) Richten Sie Ihr Codierungstool auf OmniRoute
Base URL: http://localhost:20128/v1
API Key: [copy from Endpoint page]
Model: if/kimi-k2-thinking (or any provider/model prefix)
Funktioniert mit Claude Code, Codex CLI, Gemini CLI, Cursor, Cline, OpenClaw, OpenCode und OpenAI-kompatiblen SDKs.
4) Protokolle aktivieren und validieren (v2.0)
MCP (fĂŒr werkzeuggesteuerte VorgĂ€nge):
omniroute --mcp
Verbinden Sie dann Ihren MCP-Client ĂŒber stdio und testen Sie Tools wie:
omniroute_get_healthomniroute_list_combos
A2A (fĂŒr Agent-zu-Agent-Workflows):
curl http://localhost:20128/.well-known/agent.json
curl -X POST http://localhost:20128/a2a \
-H 'content-type: application/json' \
-d '{"jsonrpc":"2.0","id":"quickstart","method":"message/send","params":{"skill":"quota-management","messages":[{"role":"user","content":"Give me a short quota summary."}]}}'
5) Alles durchgÀngig validieren (empfohlen)
npm run test:protocols:e2e
Diese Suite validiert echte MCP- und A2A-Client-Flows anhand einer laufenden App.
Alternative: Von der Quelle ausfĂŒhren
cp .env.example .env
npm install
PORT=20128 DASHBOARD_PORT=20129 NEXT_PUBLIC_BASE_URL=http://localhost:20129 npm run dev
đł Docker
OmniRoute ist als öffentliches Docker-Image auf Docker Hub verfĂŒgbar.
Schneller Lauf:
docker run -d \
--name omniroute \
--restart unless-stopped \
-p 20128:20128 \
-v omniroute-data:/app/data \
diegosouzapw/omniroute:latest
Mit Umgebungsdatei:
# Copy and edit .env first
cp .env.example .env
docker run -d \
--name omniroute \
--restart unless-stopped \
--env-file .env \
-p 20128:20128 \
-v omniroute-data:/app/data \
diegosouzapw/omniroute:latest
Verwendung von Docker Compose:
# Base profile (no CLI tools)
docker compose --profile base up -d
# CLI profile (Claude Code, Codex, OpenClaw built-in)
docker compose --profile cli up -d
| Bild | Tag | GröĂe | Beschreibung |
|---|---|---|---|
diegosouzapw/omniroute |
latest |
~250 MB | Neueste stabile Version |
diegosouzapw/omniroute |
1.0.3 |
~250 MB | Aktuelle Version |
đ„ïž
FĂŒhren Sie OmniRoute als eigenstĂ€ndige Desktop-App aus â kein Terminal, kein Browser, keine Internetverbindung fĂŒr lokale Modelle erforderlich. Die Electron-basierte App umfasst:
- đ„ïž Natives Fenster â Spezielles App-Fenster mit Integration in die Taskleiste
- đ Auto-Start â OmniRoute bei der Systemanmeldung starten
- đ Native Benachrichtigungen â Erhalten Sie Benachrichtigungen bei Kontingentausschöpfung oder Anbieterproblemen
- ⥠One-Click-Installation â NSIS (Windows), DMG (macOS), AppImage (Linux)
- đ Offline-Modus â Funktioniert vollstĂ€ndig offline mit dem gebĂŒndelten Server
Schnellstart
# Development mode
npm run electron:dev
# Build for your platform
npm run electron:build # Current platform
npm run electron:build:win # Windows (.exe)
npm run electron:build:mac # macOS (.dmg) â x64 & arm64
npm run electron:build:linux # Linux (.AppImage)
Systemablage
Wenn OmniRoute minimiert ist, befindet es sich mit schnellen Aktionen in Ihrer Taskleiste:
- Dashboard öffnen
- Server-Port Àndern
- Anwendung beenden
đ VollstĂ€ndige Dokumentation: electron/README.md
đ° Preise im Ăberblick
| Stufe | Anbieter | Kosten | Kontingent zurĂŒcksetzen | Am besten fĂŒr |
|---|---|---|---|---|
| đł ABO | Claude Code (Pro) | 20 $/Monat | 5h + wöchentlich | Bereits abonniert |
| Codex (Plus/Pro) | 20â200 $/Monat | 5h + wöchentlich | OpenAI-Benutzer | |
| Gemini CLI | KOSTENLOS | 180.000/Monat + 1.000/Tag | Alle! | |
| GitHub-Copilot | 10â19 $/Monat | Monatlich | GitHub-Benutzer | |
| đ API-SCHLĂSSEL | NVIDIA NIM | KOSTENLOS (1000 Credits) | Einmalig | Kostenlose Tier-Tests |
| DeepSeek | Pay-per-Use | Keine | Bestes Preis/QualitÀt | |
| Groq | Kostenloses Kontingent + kostenpflichtig | Tarif begrenzt | Ultraschnelle Inferenz | |
| xAI (Grok) | Pay-per-Use | Keine | Grok-Modelle | |
| Mistral | Kostenloses Kontingent + kostenpflichtig | Tarif begrenzt | EuropÀische KI | |
| OpenRouter | Pay-per-Use | Keine | Ăber 100 Modelle | |
| đ° GĂNSTIG | GLM-4.7 | 0,6 $/1 Mio. | TĂ€glich 10 Uhr | Budgetsicherung |
| MiniMax M2.1 | 0,2 $/1 Mio. | 5-Stunden-Rollen | GĂŒnstigste Option | |
| Kimi K2 | $9/Monat pauschal | 10 Millionen Token/Monat | Vorhersehbare Kosten | |
| đ KOSTENLOS | iFlow | $0 | Unbegrenzt | 8 Modelle kostenlos |
| Qwen | $0 | Unbegrenzt | 3 Modelle kostenlos | |
| Kiro | $0 | Unbegrenzt | Claude frei |
đĄ Profi-Tipp: Beginnen Sie mit der Kombination Gemini CLI (180.000 kostenlos/Monat) + iFlow (unbegrenzt kostenlos) = 0 $ Kosten!
đĄ Hauptfunktionen
OmniRoute v2.0 ist als Betriebsplattform konzipiert und nicht nur als Relay-Proxy.
đ€ Agenten- und Protokolloperationen (v2.0)| Funktion | Was es tut |
| ------------------------------------ | -------------------------------------------------------------------------------- |
| đ§ MCP-Server (16 Tools) | IDE-/Agent-Tools steuern Routing, Zustand, Kombinationen, Grenzwerte und VorgĂ€nge | IDE/agent tools via 3 transports: stdio, SSE (/api/mcp/sse), Streamable HTTP (/api/mcp/stream)
| đ€ A2A-Server (JSON-RPC + SSE) | AusfĂŒhrung von Agent-zu-Agent-Aufgaben mit Synchronisierungs- und Streaming-Flows |
| đ§ Consolidated Endpoints Page | Dedizierte Verwaltungsseiten (/dashboard/mcp, /dashboard/a2a) |
| đïž Service Enable/Disable Toggles | ON/OFF switches for MCP and A2A with settings persistence (default: OFF) |
| đ°ïž MCP Runtime Heartbeat | Echter Prozessstatus (PID, Betriebszeit, Heartbeat-Alter, Transport, Scope-Modus) |
| đ MCP Audit Trail | Filterbare Audit-Protokolle mit Erfolg/Misserfolg und SchlĂŒsselzuordnung |
| đ Durchsetzung des MCP-Geltungsbereichs | 9 granulare Umfangsberechtigungen fĂŒr kontrollierten Werkzeugzugriff |
| đĄ A2A Task Lifecycle Management | Aufgaben auflisten/filtern, Ereignisse/Artefakte prĂŒfen, laufende Aufgaben abbrechen |
| đ Agentenkartenerkennung | /.well-known/agent.json fĂŒr die automatische Client-Erkennung |
| đ§Ș Protokoll-E2E-Testkabel | Echtes MCP SDK + A2A-Client flieĂt in test:protocols:e2e |
| âïž Betriebskontrollen | Schaltkombination, Anwenden von Resilienzprofilen, ZurĂŒcksetzen von Leistungsschaltern ĂŒber eine BedienoberflĂ€che |
đ§ Routing und Intelligenz
| Funktion | Was es tut |
|---|---|
| đŻ Intelligenter 4-Stufen-Fallback | Automatische Route: Abonnement â API-SchlĂŒssel â GĂŒnstig â Kostenlos |
| đ Kontingentverfolgung in Echtzeit | Live-Token-ZĂ€hlung + Reset-Countdown pro Anbieter |
| đ FormatĂŒbersetzung | OpenAI â Claude â Gemini â Antworten mit schemasicheren Konvertierungen |
| đ„ UnterstĂŒtzung mehrerer Konten | Mehrere Konten pro Anbieter mit intelligenter Auswahl |
| đ Automatische Token-Aktualisierung | OAuth-Token werden bei Wiederholung automatisch aktualisiert |
| đš Benutzerdefinierte Kombinationen | 6 Ausgleichsstrategien + Fallback-Kettenkontrolle |
| đ Wildcard-Router | provider/* dynamisches Routing |
| đ§ Budgetkontrollen denken | Passthrough-, automatische, benutzerdefinierte und adaptive Reasoning-Grenzwerte |
| đ Modell-Aliase | Integrierte + benutzerdefinierte Modell-Aliasing- und Migrationssicherheit |
| ⥠Hintergrundverschlechterung | Hintergrundaufgaben mit niedriger PrioritĂ€t an gĂŒnstigere Modelle weiterleiten |
| đŹ System-Prompt-Injektion | Globale Verhaltenskontrollen werden konsequent angewendet |
| đ Antwort-API-KompatibilitĂ€t | VollstĂ€ndige /v1/responses-UnterstĂŒtzung fĂŒr Codex und erweiterte Agenten-Workflows |
đ” Multimodale APIs
| Funktion | Was es tut || -------------------------- | ------------------------------------------------------------- |
| đŒïž Bilderzeugung | /v1/images/generations mit Cloud- und lokalen Backends |
| đ Einbettungen | /v1/embeddings fĂŒr Such- und RAG-Pipelines |
| đ€ Audio-Transkription | /v1/audio/transcriptions â 7 providers (Deepgram Nova 3, AssemblyAI, Groq Whisper, HuggingFace, ElevenLabs, OpenAI, Azure), auto-language detection, MP4/MP3/WAV support |
| đ Text-to-Speech | /v1/audio/speech â 10 providers (ElevenLabs, OpenAI, Deepgram, Cartesia, PlayHT, HuggingFace, Nvidia NIM, Inworld, Coqui, Tortoise) |
| đŹ Videogenerierung | /v1/videos/generations (ComfyUI + SD WebUI-Workflows) |
| đ” Musikgeneration | /v1/music/generations (ComfyUI-Workflows) |
| đĄïž Moderationen | /v1/moderations SicherheitsprĂŒfungen |
| đ Neueinstufung | /v1/rerank fĂŒr Relevanzbewertung |
đĄïž Resilienz, Sicherheit und Governance
| Funktion | Was es tut |
|---|---|
| đ Leistungsschalter | Auslösung/Wiederherstellung auf Anbieterebene mit Schwellenwertkontrollen |
| đĄïž Anti-Donnerende Herde | Mutex- und Semaphorschutz bei Wiederholungs-/Ratenereignissen |
| đ§ Semantik + Signatur-Cache | Kosten-/Latenzreduzierung mit zwei Cache-Schichten |
| ⥠Idempotenz anfordern | Doppeltes Schutzfenster |
| đ TLS-Fingerabdruck-Spoofing | Bessere KompatibilitĂ€t mit Anti-Bot-gefilterten Anbietern |
| đ IP-Filterung | Zulassungs-/Blocklistenkontrolle fĂŒr exponierte Bereitstellungen |
| đ Bearbeitbare Ratenlimits | Konfigurierbare globale/Provider-Level-Limits mit Persistenz |
| đ API-SchlĂŒsselverwaltung + Scoping | Sichere SchlĂŒsselausgabe/-rotation und Modell-/Anbieterkontrollen |
đĄïž GeschĂŒtzt /models |
Optionales Authentifizierungs-Gating und Provider-Ausblenden fĂŒr Modellkatalog |
đ Beobachtbarkeit und Analyse
| Funktion | Was es tut |
|---|---|
| đ Anfrage + Proxy-Protokollierung | VollstĂ€ndige Anfrage/Antwort- und Proxy-Protokollierung |
| đ Streamed Detailed Logs đ | Reconstructs SSE payload streams cleanly into the UI |
| đ Einheitliches Protokoll-Dashboard | Anforderungs-, Proxy-, Audit- und Konsolenansichten auf einer Seite |
| đ Telemetrie anfordern | p50/p95/p99-Latenz und Anforderungsverfolgung |
| đ„ Gesundheits-Dashboard | Betriebszeit, Breaker-ZustĂ€nde, Sperrungen, Cache-Statistiken |
| đ° Kostenverfolgung | Budgetkontrolle und Preistransparenz pro Modell |
| đ Analysevisualisierungen | Einblicke in die Modell-/Anbieternutzung und Trendansichten |
| đ§Ș Bewertungsrahmen | Golden-Set-Test mit konfigurierbaren Match-Strategien |
âïž Bereitstellung und Plattform
| Funktion | Was es tut | |||
|---|---|---|---|---|
| đ Ăberall bereitstellen | Localhost, VPS, Docker, Cloud-Umgebungen | đŸ Cloud-Synchronisierung | Konfigurationssynchronisierung ĂŒber Cloud Worker | |
| đ Sichern/Wiederherstellen | Export-/Import- und Disaster-Recovery-AblĂ€ufe | |||
| đ§ Onboarding-Assistent | Erstmaliges gefĂŒhrtes Setup | |||
| đ§ CLI-Tools-Dashboard | Ein-Klick-Setup fĂŒr beliebte Codierungstools | |||
| đ i18n (30 Sprachen) | VollstĂ€ndige SprachunterstĂŒtzung fĂŒr Dashboard und Dokumente mit RTL-Abdeckung | |||
| đ§č Clear All Models | One-click model list clearing in provider details | |||
| đïž Sidebar Controls đ | Hide components and integrations from Appearance Settings | |||
| đ Issue Templates | Standardized GitHub templates for bugs and features | |||
| đ Benutzerdefiniertes Datenverzeichnis | DATA_DIR-Ăberschreibung fĂŒr Speicherort |
Feature Deep Dive
Smarter Fallback mit praktischer Kostenkontrolle
Combo: "my-coding-stack"
1. cc/claude-opus-4-6
2. nvidia/llama-3.3-70b
3. glm/glm-4.7
4. if/kimi-k2-thinking
Wenn Kontingent, Rate oder IntegritÀt fehlschlagen, wechselt OmniRoute automatisch zum nÀchsten Kandidaten, ohne dass ein manueller Wechsel erforderlich ist.
Protokollverwaltung, die sichtbar und bedienbar ist
- MCP + A2A sind in der BenutzeroberflÀche und in den Dokumenten erkennbar (nicht ausgeblendet)
â Protokollstatus-APIs stellen Live-Betriebsdaten bereit (
/api/mcp/*,/api/a2a/*) - Dashboards umfassen Aktionen fĂŒr Tag-2-Operationen (Kombinationsumschaltung, ZurĂŒcksetzen von Leistungsschaltern, Aufgabenabbruch).
Ăbersetzer- und Validierungsworkflow
Der Ăbersetzerbereich umfasst:
- Spielplatz: TransformationsprĂŒfungen anfordern
- Chat-Tester: vollstÀndiger Anfrage-/Antwort-Roundtrip
- PrĂŒfstand: mehrere FĂ€lle in einem Durchgang
- Live Monitor: Echtzeit-Verkehrsansicht
Plus Protokollvalidierung mit echten Clients ĂŒber npm run test:protocols:e2e.
đ MCP Server README â Tool-Referenz, IDE-Konfigurationen und Client-Beispiele
đ A2A Server README â FĂ€higkeiten, JSON-RPC-Methoden, Streaming und Aufgabenlebenszyklus
đ§Ș Bewertungen (Evals)
OmniRoute umfasst ein integriertes Bewertungsframework zum Testen der LLM-AntwortqualitĂ€t anhand eines Golden Sets. Greifen Sie darauf ĂŒber Analytics â Evals im Dashboard zu.
Eingebautes goldenes Set
Das vorinstallierte âOmniRoute Golden Setâ enthĂ€lt TestfĂ€lle fĂŒr:
- GrĂŒĂe, Mathematik, Geographie, Codegenerierung
- Einhaltung des JSON-Formats, Ăbersetzung, Markdown-Generierung
- Sicherheitsverweigerung (schÀdlicher Inhalt), ZÀhlung, boolesche Logik
Bewertungsstrategien
| Strategie | Beschreibung | Beispiel |
|---|---|---|
exact |
Die Ausgabe muss genau mit | ĂŒbereinstimmen "4" |
contains |
Die Ausgabe muss eine Teilzeichenfolge enthalten (GroĂ-/Kleinschreibung wird nicht beachtet) | "Paris" |
regex |
Die Ausgabe muss mit dem Regex-Muster | ĂŒbereinstimmen "1.*2.*3" |
custom |
Benutzerdefinierte JS-Funktion gibt true/false | zurĂŒck (output) => output.length > 10 |
đ Einrichtungsanleitung
Protokoll-Setup (MCP + A2A)
đ§© MCP-Setup (Modellkontextprotokoll)
Starten Sie den MCP-Transport im Standardmodus:
omniroute --mcp
Empfohlener Validierungsablauf:
- Verbinden Sie Ihren MCP-Client ĂŒber stdio.
- FĂŒhren Sie
omniroute_get_healthaus. - FĂŒhren Sie
omniroute_list_combosaus. - Ăffnen Sie
/dashboard/mcp, um Heartbeat, AktivitÀt und Audit zu bestÀtigen.
NĂŒtzliche APIs fĂŒr die Automatisierung:
GET /api/mcp/statusGET /api/mcp/toolsGET /api/mcp/auditGET /api/mcp/audit/stats
đ€ A2A-Setup (Agent2Agent)
Entdecken Sie den Agenten:
curl http://localhost:20128/.well-known/agent.json
Senden Sie eine Aufgabe:
curl -X POST http://localhost:20128/a2a \
-H 'content-type: application/json' \
-d '{"jsonrpc":"2.0","id":"setup-a2a","method":"message/send","params":{"skill":"quota-management","messages":[{"role":"user","content":"Summarize quota status."}]}}'
Lebenszyklus verwalten:
GET /api/a2a/statusGET /api/a2a/tasksGET /api/a2a/tasks/:idPOST /api/a2a/tasks/:id/cancel
Operative BenutzeroberflÀche:
/dashboard/a2afĂŒr Task-/Status-/Stream-Beobachtbarkeit und Smoke-Aktionen
đ§Ș End-to-End-Protokollvalidierung
Validieren Sie beide Protokolle mit echten Clients:
npm run test:protocols:e2e
Dies bestÀtigt:
- MCP SDK-Client-Verbindung/Liste/Anruf
- A2A-Erkennung/Senden/Streamen/Get/Abbrechen
- Vergleichen Sie die Daten in MCP-Audit- und A2A-Aufgabenverwaltungs-APIs
đł Abonnementanbieter
Claude Code (Pro/Max)
Dashboard â Providers â Connect Claude Code
â OAuth login â Auto token refresh
â 5-hour + weekly quota tracking
Models:
cc/claude-opus-4-6
cc/claude-sonnet-4-5-20250929
cc/claude-haiku-4-5-20251001
Profi-Tipp: Verwenden Sie Opus fĂŒr komplexe Aufgaben, Sonnet fĂŒr Geschwindigkeit. OmniRoute verfolgt das Kontingent pro Modell!
OpenAI Codex (Plus/Pro)
Dashboard â Providers â Connect Codex
â OAuth login (port 1455)
â 5-hour + weekly reset
Models:
cx/gpt-5.2-codex
cx/gpt-5.1-codex-max
Gemini CLI (KOSTENLOS 180.000/Monat!)
Dashboard â Providers â Connect Gemini CLI
â Google OAuth
â 180K completions/month + 1K/day
Models:
gc/gemini-3-flash-preview
gc/gemini-2.5-pro
Bester Wert: Riesiges kostenloses Kontingent! Verwenden Sie dies vor kostenpflichtigen Stufen.
GitHub-Copilot
Dashboard â Providers â Connect GitHub
â OAuth via GitHub
â Monthly reset (1st of month)
Models:
gh/gpt-5
gh/claude-4.5-sonnet
gh/gemini-3-pro
đ API-SchlĂŒsselanbieter
NVIDIA NIM (KOSTENLOSE 1000 Credits!)
- Registrieren Sie sich: build.nvidia.com
- Holen Sie sich einen kostenlosen API-SchlĂŒssel (1000 Inferenz-Credits inbegriffen)
- Dashboard â Anbieter hinzufĂŒgen â NVIDIA NIM:
- API-SchlĂŒssel:
nvapi-your-key
- API-SchlĂŒssel:
Modelle: nvidia/llama-3.3-70b-instruct, nvidia/mistral-7b-instruct und ĂŒber 50 weitere
Profi-Tipp: OpenAI-kompatible API â funktioniert nahtlos mit der FormatĂŒbersetzung von OmniRoute!
DeepSeek
- Registrieren Sie sich: platform.deepseek.com
- Holen Sie sich den API-SchlĂŒssel
- Dashboard â Anbieter hinzufĂŒgen â DeepSeek
Modelle: deepseek/deepseek-chat, deepseek/deepseek-coder
Groq (Kostenloses Kontingent verfĂŒgbar!)
- Registrieren Sie sich: console.groq.com
- Holen Sie sich den API-SchlĂŒssel (kostenloses Kontingent inbegriffen)
- Dashboard â Anbieter hinzufĂŒgen â Groq
Modelle: groq/llama-3.3-70b, groq/mixtral-8x7b
Profi-Tipp: Ultraschnelle Inferenz â am besten fĂŒr Echtzeit-Codierung!
OpenRouter (ĂŒber 100 Modelle)
- Registrieren Sie sich: openrouter.ai
- Holen Sie sich den API-SchlĂŒssel
- Dashboard â Anbieter hinzufĂŒgen â OpenRouter
Modelle: Greifen Sie ĂŒber einen einzigen API-SchlĂŒssel auf ĂŒber 100 Modelle aller groĂen Anbieter zu.
đ° GĂŒnstige Anbieter (Backup)
GLM-4.7 (TĂ€glicher Reset, 0,6 $/1 Mio.)
- Registrieren: Zhipu AI
- Holen Sie sich den API-SchlĂŒssel vom Coding Plan
- Dashboard â API-SchlĂŒssel hinzufĂŒgen:
- Anbieter:
glm - API-SchlĂŒssel:
your-key
- Anbieter:
Verwendung: glm/glm-4.7
Profi-Tipp: Coding Plan bietet 3Ă Kontingent zu 1/7 Kosten! TĂ€glich um 10:00 Uhr zurĂŒckgesetzt.
MiniMax M2.1 (5 Stunden ZurĂŒcksetzen, 0,20 $/1 Mio.)
- Registrieren: MiniMax
- Holen Sie sich den API-SchlĂŒssel
- Dashboard â API-SchlĂŒssel hinzufĂŒgen
Verwendung: minimax/MiniMax-M2.1
Profi-Tipp: GĂŒnstigste Option fĂŒr langen Kontext (1 Mio. Token)!
Kimi K2 (9 $/Monat pauschal)
- Abonnieren: Moonshot AI
- Holen Sie sich den API-SchlĂŒssel
- Dashboard â API-SchlĂŒssel hinzufĂŒgen
Verwendung: kimi/kimi-latest
Profi-Tipp: Feste 9 $/Monat fĂŒr 10 Mio. Token = 0,90 $/1 Mio. effektive Kosten!
đ KOSTENLOSE Anbieter (Notfall-Backup)
iFlow (8 KOSTENLOSE Modelle)```bash
Dashboard â Connect iFlow â iFlow OAuth login â Unlimited usage
Models: if/kimi-k2-thinking if/qwen3-coder-plus if/glm-4.7 if/minimax-m2 if/deepseek-r1
### Qwen (3 KOSTENLOSE Modelle)
```bash
Dashboard â Connect Qwen
â Device code authorization
â Unlimited usage
Models:
qw/qwen3-coder-plus
qw/qwen3-coder-flash
Kiro (Claude KOSTENLOS)
Dashboard â Connect Kiro
â AWS Builder ID or Google/GitHub
â Unlimited usage
Models:
kr/claude-sonnet-4.5
kr/claude-haiku-4.5
đš Combos erstellen
Beispiel 1: Abonnement maximieren â GĂŒnstiges Backup
Dashboard â Combos â Create New
Name: premium-coding
Models:
1. cc/claude-opus-4-6 (Subscription primary)
2. glm/glm-4.7 (Cheap backup, $0.6/1M)
3. minimax/MiniMax-M2.1 (Cheapest fallback, $0.20/1M)
Use in CLI: premium-coding
Beispiel 2: Nur kostenlos (kostenlos)
Name: free-combo
Models:
1. gc/gemini-3-flash-preview (180K free/month)
2. if/kimi-k2-thinking (unlimited)
3. qw/qwen3-coder-plus (unlimited)
Cost: $0 forever!
đ§ CLI-Integration
Cursor-IDE
Settings â Models â Advanced:
OpenAI API Base URL: http://localhost:20128/v1
OpenAI API Key: [from OmniRoute dashboard]
Model: cc/claude-opus-4-6
Claude Code
Verwenden Sie die Seite CLI-Tools im Dashboard fĂŒr die Ein-Klick-Konfiguration oder bearbeiten Sie ~/.claude/settings.json manuell.
Codex-CLI
export OPENAI_BASE_URL="http://localhost:20128"
export OPENAI_API_KEY="your-omniroute-api-key"
codex "your prompt"
OpenClaw
Option 1 â Dashboard (empfohlen):
Dashboard â CLI Tools â OpenClaw â Select Model â Apply
Option 2 â Manuell: Bearbeiten ~/.openclaw/openclaw.json:
{
"models": {
"providers": {
"omniroute": {
"baseUrl": "http://127.0.0.1:20128/v1",
"apiKey": "sk_omniroute",
"api": "openai-completions"
}
}
}
}
Hinweis: OpenClaw funktioniert nur mit lokaler OmniRoute. Verwenden Sie
127.0.0.1anstelle vonlocalhost, um Probleme mit der IPv6-Auflösung zu vermeiden.
Cline / Weiter / RooCode
Settings â API Configuration:
Provider: OpenAI Compatible
Base URL: http://localhost:20128/v1
API Key: [from OmniRoute dashboard]
Model: if/kimi-k2-thinking
OpenCode
Schritt 1: OmniRoute als benutzerdefinierten Anbieter hinzufĂŒgen:
opencode
/connect
# Select "Other" â Enter ID: "omniroute" â Enter your OmniRoute API key
Schritt 2: Erstellen/bearbeiten Sie opencode.json in Ihrem Projektstamm:
{
"$schema": "https://opencode.ai/config.json",
"provider": {
"omniroute": {
"npm": "@ai-sdk/openai-compatible",
"name": "OmniRoute",
"options": {
"baseURL": "http://localhost:20128/v1"
},
"models": {
"cc/claude-sonnet-4-20250514": { "name": "Claude Sonnet 4" },
"gg/gemini-2.5-pro": { "name": "Gemini 2.5 Pro" },
"if/kimi-k2-thinking": { "name": "Kimi K2 (Free)" }
}
}
}
}
Schritt 3: WĂ€hlen Sie das Modell in OpenCode aus:
/models
# Select any OmniRoute model from the list
Tipp: FĂŒgen Sie alle in Ihrem OmniRoute
/v1/models-Endpunkt verfĂŒgbaren Modelle zum Abschnittmodelshinzu. Verwenden Sie das Formatprovider/model-idaus Ihrem OmniRoute-Dashboard.
đ Fehlerbehebung
Klicken Sie hier, um den Leitfaden zur Fehlerbehebung zu erweitern
âSprachmodell hat keine Nachrichten bereitgestelltâ
- Anbieterkontingent erschöpft â ĂberprĂŒfen Sie den Dashboard-Kontingent-Tracker
- Lösung: Combo-Fallback verwenden oder auf gĂŒnstigere Stufe wechseln
Ratenbegrenzung
- Abonnementkontingent aufgebraucht â Fallback auf GLM/MiniMax
- Kombination hinzufĂŒgen:
cc/claude-opus-4-6 â glm/glm-4.7 â if/kimi-k2-thinking
OAuth-Token abgelaufen
- Automatische Aktualisierung durch OmniRoute
- Wenn die Probleme weiterhin bestehen: Dashboard â Anbieter â Verbindung wiederherstellen
Hohe Kosten
- ĂberprĂŒfen Sie die Nutzungsstatistiken im Dashboard â Kosten
- PrimÀrmodell auf GLM/MiniMax umstellen
- Nutzen Sie das kostenlose Kontingent (Gemini CLI, iFlow) fĂŒr unkritische Aufgaben
Dashboard-/API-Ports sind falsch
PORTist der kanonische Basisport (und standardmĂ€Ăig API-Port) âAPI_PORTĂŒberschreibt nur OpenAI-kompatible API-Listener âDASHBOARD_PORTĂŒberschreibt nur Dashboard/Next.js-Listener- Setzen Sie
NEXT_PUBLIC_BASE_URLauf Ihr Dashboard/öffentliche URL (fĂŒr OAuth-RĂŒckrufe).
Cloud-Synchronisierungsfehler
â ĂberprĂŒfen Sie, ob BASE_URL auf Ihre laufende Instanz verweist
â ĂberprĂŒfen Sie, ob CLOUD_URL auf Ihren erwarteten Cloud-Endpunkt verweist
â Halten Sie die NEXT_PUBLIC_*-Werte an den serverseitigen Werten ausgerichtet
Erste Anmeldung funktioniert nicht
- ĂberprĂŒfen Sie
INITIAL_PASSWORDin.envâ Wenn nicht festgelegt, lautet das Fallback-Passwort123456
Keine Anfrageprotokolle
- Setzen Sie
ENABLE_REQUEST_LOGS=truein.env
Verbindungstest zeigt âUngĂŒltigâ fĂŒr OpenAI-kompatible Anbieter
â Viele Anbieter stellen keinen /models-Endpunkt bereit
â OmniRoute v1.0.6+ beinhaltet eine Fallback-Validierung ĂŒber Chat-AbschlĂŒsse
â Stellen Sie sicher, dass die Basis-URL das Suffix /v1 enthĂ€lt
đ OAuth auf Server Remoto
â ïž WICHTIG fĂŒr den Einsatz von OmniRoute auf VPS/Docker/Remote-Servern
OAuth
Als OAuth-Anmeldeinformationen wurde OmniRoute nicht in die Liste eingetragen. Zugelassen fĂŒr localhost. Wenn Sie OmniRoute auf einem Remote-Server (z. B.
Error 400: redirect_uri_mismatch
Lösung: Konfigurieren Sie Ihre eigenen OAuth-Anmeldeinformationen
Sie schreiben bitte eine OAuth 2.0-Client-ID in der Google Cloud Console mit einem URI fĂŒr Ihren Server.
Passo a Passo
1. Zugriff auf die Google Cloud Console
Abra: https://console.cloud.google.com/apis/credentials
2. Rufen Sie eine neue OAuth 2.0-Client-ID auf
- Klicken Sie auf "+ Anmeldeinformationen erstellen" â "OAuth-Client-ID"
- Anwendungstyp: âWebanwendungâ
- Name: Escolha qualquer nome (z. B.
OmniRoute Remote)
3. Adicione als autorisierte Weiterleitungs-URIs
Nein, "Autorisierte Weiterleitungs-URIs", Zusatz:
https://seu-servidor.com/callback
Ersetzen Sie
seu-servidor.comdurch die Domain oder die IP Ihres Servers (einschlieĂlich eines Ports, der unbedingt erforderlich ist, z. B.:http://45.33.32.156:20128/callback).
4. Als Anmeldedaten speichern und kopieren
AnschlieĂend hat Google die Client-ID und das Client-Geheimnis angezeigt.
5. Als Umgebungsvariationen konfigurieren
Kein .env (oder mehrere Docker-Umgebungsvarianten):
# Para Antigravity:
ANTIGRAVITY_OAUTH_CLIENT_ID=seu-client-id.apps.googleusercontent.com
ANTIGRAVITY_OAUTH_CLIENT_SECRET=GOCSPX-seu-secret
# Para Gemini CLI:
GEMINI_OAUTH_CLIENT_ID=seu-client-id.apps.googleusercontent.com
GEMINI_OAUTH_CLIENT_SECRET=GOCSPX-seu-secret
GEMINI_CLI_OAUTH_CLIENT_SECRET=GOCSPX-seu-secret
6. Neuzugang zu OmniRoute
# Se usando npm:
npm run dev
# Se usando Docker:
docker restart omniroute
7. Tente conectar novamente
Dashboard â Anbieter â Antigravity (oder Gemini CLI) â OAuth
Jetzt hat Google die Nachricht an https://seu-servidor.com/callback weitergeleitet und eine Authentifizierungsfunktion durchgefĂŒhrt.
Workaround vorĂŒbergehend (nicht vorab konfiguriert)
Wenn Sie vorab keine Berechtigung erhalten möchten, besteht die Möglichkeit, das URL-Handbuch zu verwenden:
- OmniRoute ruft eine von Google autorisierte URL auf
- Nachdem Sie den Autor autorisiert haben, sendet Google eine Weiterleitung an
localhost(diese wird jedoch nicht vom Server weitergeleitet). - Kopieren Sie eine vollstÀndige URL, um sie in Ihren Browser zu laden (bitte beachten Sie, dass die Seite noch nicht abgeschlossen ist).
- Geben Sie die URL ein, die nicht zur Verbindung mit OmniRoute verwendet werden soll
- Klicken Sie auf âVerbindenâ
Diese Problemumgehung funktioniert aufgrund des Autorisierungscodes auf der URL und ist unabhĂ€ngig von der Weiterleitung oder Nicht-Weiterleitung gĂŒltig.
đ ïž
Klicken Sie hier, um die Tech-Stack-Details zu erweitern
- Laufzeit: Node.js 18â22 LTS (â ïž Node.js 24+ wird nicht unterstĂŒtzt â native BinĂ€rdateien von
better-sqlite3sind inkompatibel) - Sprache: TypeScript 5.9 â 100 % TypeScript fĂŒr
src/undopen-sse/(nullanyin Kernmodulen seit Version 2.0) - Framework: Next.js 16 + React 19 + Tailwind CSS 4
- Datenbank: LowDB (JSON) + SQLite (DomĂ€nenstatus + Proxy-Protokolle + MCP-PrĂŒfung + Routing-Entscheidungen)
- Schemas: Zod (MCP-Tool-I/O-Validierung, API-VertrÀge)
- Protokolle: MCP (stdio/HTTP) + A2A v0.3 (JSON-RPC 2.0 + SSE)
- Streaming: Vom Server gesendete Ereignisse (SSE)
- Auth: OAuth 2.0 (PKCE) + JWT + API-SchlĂŒssel + MCP-bezogene Autorisierung
- Testen: Node.js-TestlĂ€ufer + Vitest (ĂŒber 900 Tests einschlieĂlich Einheit, Integration, E2E)- CI/CD: GitHub-Aktionen (automatische NPM-Veröffentlichung + Docker Hub bei Veröffentlichung)
- Website: omniroute.online
- Paket: npmjs.com/package/omniroute
- Docker: hub.docker.com/r/diegosouzapw/omniroute
- Resilienz: Leistungsschalter, exponentielles Backoff, Anti-Donner-Herde, TLS-Spoofing, automatische Kombinations-Selbstheilung
đ Dokumentation
| Dokument | Beschreibung |
|---|---|
| Benutzerhandbuch | Anbieter, Kombinationen, CLI-Integration, Bereitstellung |
| API-Referenz | Alle Endpunkte mit Beispielen |
| MCP-Server | 16 MCP-Tools, IDE-Konfigurationen, Python/TS/Go-Clients |
| A2A-Server | JSON-RPC 2.0-Protokoll, FĂ€higkeiten, Streaming, Aufgabenverwaltung |
| Auto-Combo-Engine | 6-Faktor-Bewertung, Moduspakete, Selbstheilung |
| Fehlerbehebung | HÀufige Probleme und Lösungen |
| Architektur | Systemarchitektur und Interna |
| Beitrag | Entwicklungsaufbau und Richtlinien |
| OpenAPI-Spezifikation | OpenAPI 3.0-Spezifikation |
| Sicherheitsrichtlinie | Schwachstellenmeldung und Sicherheitspraktiken |
| VM-Bereitstellung | VollstÀndige Anleitung: VM + Nginx + Cloudflare-Setup |
| Features-Galerie | Visuelle Dashboard-Tour mit Screenshots |
| Release-Checkliste | Validierungsschritte vor der Veröffentlichung |
đșïž
FĂŒr OmniRoute sind 210+ Funktionen in mehreren Entwicklungsphasen geplant. Hier sind die SchlĂŒsselbereiche:
| Kategorie | Geplante Funktionen | Höhepunkte |
|---|---|---|
| đ§ Routing & Intelligenz | 25+ | Routing mit der niedrigsten Latenz, Tag-basiertes Routing, Quoten-Preflight, P2C-Kontoauswahl |
| đ Sicherheit & Compliance | 20+ | SSRF-HĂ€rtung, Credential-Cloaking, Ratenbegrenzung pro Endpunkt, VerwaltungsschlĂŒssel-Scoping |
| đ Beobachtbarkeit | 15+ | OpenTelemetry-Integration, Echtzeit-KontingentĂŒberwachung, Kostenverfolgung pro Modell |
| đ Anbieterintegrationen | 20+ | Dynamische Modellregistrierung, Anbieter-Abklingzeiten, Multi-Account-Codex, Copilot-Kontingentanalyse |
| ⥠Leistung | 15+ | Duale Cache-Schicht, Prompt-Cache, Antwort-Cache, Streaming-Keepalive, Batch-API |
| đ Ăkosystem | 10+ | WebSocket-API, Hot-Reload der Konfiguration, verteilter Konfigurationsspeicher, kommerzieller Modus |
đ Bald erhĂ€ltlich- đ OpenCode-Integration â Native AnbieterunterstĂŒtzung fĂŒr die OpenCode AI-Codierungs-IDE
- đ TRAE-Integration â Volle UnterstĂŒtzung fĂŒr das TRAE AI-Entwicklungsframework
- đŠ Batch-API â Asynchrone Stapelverarbeitung fĂŒr Massenanfragen
- đŻ Tag-basiertes Routing â Leiten Sie Anfragen basierend auf benutzerdefinierten Tags und Metadaten weiter
- đ° Niedrigste Kostenstrategie â WĂ€hlen Sie automatisch den gĂŒnstigsten verfĂŒgbaren Anbieter aus
đ VollstĂ€ndige Funktionsspezifikationen verfĂŒgbar in
docs/new-features/(217 detaillierte Spezifikationen)
đ„ Mitwirkende
So leisten Sie einen Beitrag
- Forken Sie das Repository
- Erstellen Sie Ihren Feature-Zweig (
git checkout -b feature/amazing-feature) - Ăbernehmen Sie Ihre Ănderungen (
git commit -m 'Add amazing feature') - Push zum Zweig (
git push origin feature/amazing-feature) - Ăffnen Sie eine Pull-Anfrage
Detaillierte Richtlinien finden Sie unter CONTRIBUTING.md.
Veröffentlichung einer neuen Version
# Create a release â npm publish happens automatically
gh release create v2.0.0 --title "v2.0.0" --generate-notes
đ Sterngeschichte
Stargazers over time
đ Danksagungen
Besonderer Dank geht an 9router von decolua â das ursprĂŒngliche Projekt, das diesen Fork inspiriert hat. OmniRoute baut auf dieser unglaublichen Grundlage mit zusĂ€tzlichen Funktionen, multimodalen APIs und einer vollstĂ€ndigen Neufassung von TypeScript auf.
Besonderer Dank geht an CLIProxyAPI â die ursprĂŒngliche Go-Implementierung, die diese JavaScript-Portierung inspiriert hat.
đ Lizenz
MIT-Lizenz â Einzelheiten finden Sie unter LIZENZ.