35 KiB
đ OmniRoute â Das kostenlose AI-Gateway
Höre nie auf zu programmieren. Intelligentes Routing zu KOSTENLOSEN und gĂŒnstigen KI-Modellen mit automatischem Fallback.
Dein universeller API-Proxy â ein Endpoint, 36+ Anbieter, null Ausfallzeit.
Chat Completions âą Embeddings âą Bildgenerierung âą Audio âą Reranking âą 100% TypeScript
đ€ Kostenloser KI-Anbieter fĂŒr deine Lieblings-Coding-Agenten
Verbinde jedes KI-gesteuerte IDE- oder CLI-Tool ĂŒber OmniRoute â kostenloses API-Gateway fĂŒr unbegrenztes Programmieren.
|
OpenClaw â 205K |
NanoBot â 20.9K |
PicoClaw â 14.6K |
ZeroClaw â 9.9K |
IronClaw â 2.1K |
|
OpenCode â 106K |
Codex CLI â 60.8K |
Claude Code â 67.3K |
Gemini CLI â 94.7K |
Kilo Code â 15.5K |
đĄ Alle Agenten verbinden sich ĂŒber http://localhost:20128/v1 oder http://cloud.omniroute.online/v1 â eine Konfiguration, unbegrenzte Modelle und Kontingent
đ Website âą đ Schnellstart âą đĄ Funktionen âą đ Doku âą đ° Preise
đ VerfĂŒgbar in: English | PortuguĂȘs | Español | Đ ŃŃŃĐșĐžĐč | äžæ | Deutsch | Français | Italiano
đ€ Warum OmniRoute?
Hör auf, Geld zu verschwenden und an Limits zu stoĂen:
Abo-Kontingent verfÀllt jeden Monat ungenutzt
Rate-Limits stoppen dich mitten beim Programmieren
Teure APIs ($20-50/Monat pro Anbieter)
Manuelles Wechseln zwischen Anbietern
OmniRoute löst das:
- â Abos maximieren â Kontingente tracken, alles vor dem Reset nutzen
- â Automatischer Fallback â Abo â API Key â GĂŒnstig â Kostenlos, null Ausfallzeit
- â Multi-Account â Round-Robin zwischen Konten pro Anbieter
- â Universal â Funktioniert mit Claude Code, Codex, Gemini CLI, Cursor, Cline, OpenClaw, jedem CLI-Tool
đ So funktioniert's
âââââââââââââââ
â Dein CLI â (Claude Code, Codex, Gemini CLI, OpenClaw, Cursor, Cline...)
â Tool â
ââââââââŹâââââââ
â http://localhost:20128/v1
â
âââââââââââââââââââââââââââââââââââââââââââ
â OmniRoute (Smart Router) â
â âą Format-Ăbersetzung (OpenAI â Claude) â
â âą Kontingent-Tracking + Embeddings + Bilder â
â âą Automatische Token-Erneuerung â
ââââââââŹâââââââââââââââââââââââââââââââââââ
â
âââ [Tier 1: ABO] Claude Code, Codex, Gemini CLI
â â Kontingent erschöpft
âââ [Tier 2: API KEY] DeepSeek, Groq, xAI, Mistral, NVIDIA NIM usw.
â â Budget-Limit
âââ [Tier 3: GĂNSTIG] GLM ($0.6/1M), MiniMax ($0.2/1M)
â â Budget-Limit
âââ [Tier 4: KOSTENLOS] iFlow, Qwen, Kiro (unbegrenzt)
Ergebnis: Nie aufhören zu programmieren, minimale Kosten
⥠Schnellstart
1. Global installieren:
npm install -g omniroute
omniroute
đ Das Dashboard öffnet sich unter http://localhost:20128
| Befehl | Beschreibung |
|---|---|
omniroute |
Server starten (Standardport 20128) |
omniroute --port 3000 |
Benutzerdefinierten Port verwenden |
omniroute --no-open |
Browser nicht automatisch öffnen |
omniroute --help |
Hilfe anzeigen |
2. KOSTENLOSEN Anbieter verbinden:
Dashboard â Anbieter â Claude Code oder Antigravity verbinden â OAuth Login â Fertig!
3. In deinem CLI-Tool verwenden:
Claude Code/Codex/Gemini CLI/OpenClaw/Cursor/Cline Einstellungen:
Endpoint: http://localhost:20128/v1
API Key: [vom Dashboard kopieren]
Model: if/kimi-k2-thinking
Das war's! Beginne mit KOSTENLOSEN KI-Modellen zu programmieren.
Alternative â aus Quellcode ausfĂŒhren:
cp .env.example .env
npm install
PORT=20128 NEXT_PUBLIC_BASE_URL=http://localhost:20128 npm run dev
đł Docker
OmniRoute ist als öffentliches Docker-Image auf Docker Hub verfĂŒgbar.
Schnellstart:
docker run -d \
--name omniroute \
--restart unless-stopped \
-p 20128:20128 \
-v omniroute-data:/app/data \
diegosouzapw/omniroute:latest
Mit Umgebungsdatei:
# .env kopieren und bearbeiten
cp .env.example .env
docker run -d \
--name omniroute \
--restart unless-stopped \
--env-file .env \
-p 20128:20128 \
-v omniroute-data:/app/data \
diegosouzapw/omniroute:latest
Mit Docker Compose:
# Basisprofil (ohne CLI-Tools)
docker compose --profile base up -d
# CLI-Profil (Claude Code, Codex, OpenClaw integriert)
docker compose --profile cli up -d
| Image | Tag | GröĂe | Beschreibung |
|---|---|---|---|
diegosouzapw/omniroute |
latest |
~250MB | Letztes stabiles Release |
diegosouzapw/omniroute |
1.0.5 |
~250MB | Aktuelle Version |
đ° PreisĂŒbersicht
| Tier | Anbieter | Kosten | Kontingent-Reset | Am besten fĂŒr |
|---|---|---|---|---|
| đł ABO | Claude Code (Pro) | $20/Monat | 5h + wöchentlich | Bereits abonniert |
| Codex (Plus/Pro) | $20-200/Monat | 5h + wöchentlich | OpenAI-Nutzer | |
| Gemini CLI | KOSTENLOS | 180K/Monat + 1K/Tag | Alle! | |
| GitHub Copilot | $10-19/Monat | Monatlich | GitHub-Nutzer | |
| đ API KEY | NVIDIA NIM | KOSTENLOS (1000 Credits) | Einmalig | Kostenloses Testen |
| DeepSeek | Nach Verbrauch | Keiner | Bestes Preis-Leistung | |
| Groq | Gratis-Stufe + bezahlt | Begrenzt | Ultra-schnelle Inferenz | |
| xAI (Grok) | Nach Verbrauch | Keiner | Grok-Modelle | |
| Mistral | Gratis-Stufe + bezahlt | Begrenzt | EuropÀische KI | |
| OpenRouter | Nach Verbrauch | Keiner | 100+ Modelle | |
| đ° GĂNSTIG | GLM-4.7 | $0.6/1M | TĂ€glich 10h | Budget-Backup |
| MiniMax M2.1 | $0.2/1M | 5h rotierend | GĂŒnstigste Option | |
| Kimi K2 | $9/Monat fest | 10M Token/Monat | Vorhersagbare Kosten | |
| đ KOSTENLOS | iFlow | $0 | Unbegrenzt | 8 kostenlose Modelle |
| Qwen | $0 | Unbegrenzt | 3 kostenlose Modelle | |
| Kiro | $0 | Unbegrenzt | Kostenloses Claude |
đĄ Profi-Tipp: Starte mit Gemini CLI (180K gratis/Monat) + iFlow (unbegrenzt gratis) = $0 Kosten!
đŻ AnwendungsfĂ€lle
Fall 1: âIch habe ein Claude Pro Abo"
Problem: Kontingent verfÀllt ungenutzt, Rate-Limits wÀhrend intensivem Programmieren
Combo: "maximize-claude"
1. cc/claude-opus-4-6 (Abo voll ausnutzen)
2. glm/glm-4.7 (gĂŒnstiges Backup bei erschöpftem Kontingent)
3. if/kimi-k2-thinking (kostenloser Notfall-Fallback)
Monatliche Kosten: $20 (Abo) + ~$5 (Backup) = $25 gesamt
vs. $20 + an Limits stoĂen = Frustration
Fall 2: âIch will null Kosten"
Problem: Kann sich Abos nicht leisten, braucht zuverlÀssige KI zum Programmieren
Combo: "free-forever"
1. gc/gemini-3-flash (180K gratis/Monat)
2. if/kimi-k2-thinking (unbegrenzt gratis)
3. qw/qwen3-coder-plus (unbegrenzt gratis)
Monatliche Kosten: $0
QualitÀt: Produktionsreife Modelle
Fall 3: âIch muss 24/7 programmieren, ohne Unterbrechungen"
Problem: Enge Deadlines, kann sich keine Ausfallzeit leisten
Combo: "always-on"
1. cc/claude-opus-4-6 (beste QualitÀt)
2. cx/gpt-5.2-codex (zweites Abo)
3. glm/glm-4.7 (gĂŒnstig, tĂ€glicher Reset)
4. minimax/MiniMax-M2.1 (gĂŒnstigste, 5h Reset)
5. if/kimi-k2-thinking (unbegrenzt kostenlos)
Ergebnis: 5 Fallback-Ebenen = null Ausfallzeit
Fall 4: âIch will KOSTENLOSE KI in OpenClaw"
Problem: Braucht KI-Assistenz in Messaging-Apps, komplett kostenlos
Combo: "openclaw-free"
1. if/glm-4.7 (unbegrenzt kostenlos)
2. if/minimax-m2.1 (unbegrenzt kostenlos)
3. if/kimi-k2-thinking (unbegrenzt kostenlos)
Monatliche Kosten: $0
Zugang ĂŒber: WhatsApp, Telegram, Slack, Discord, iMessage, Signal...
đĄ Hauptfunktionen
đ§ Routing & Intelligenz
| Funktion | Was es macht |
|---|---|
| đŻ Intelligenter 4-Tier-Fallback | Auto-Routing: Abo â API Key â GĂŒnstig â Kostenlos |
| đ Echtzeit-Kontingent-Tracking | Live Token-ZĂ€hlung + Reset-Countdown pro Anbieter |
| đ Format-Ăbersetzung | OpenAI â Claude â Gemini â Cursor â Kiro nahtlos |
| đ„ Multi-Account-UnterstĂŒtzung | Mehrere Konten pro Anbieter mit intelligenter Auswahl |
| đ Auto-Token-Erneuerung | OAuth-Token werden automatisch mit Wiederholungen erneuert |
| đš Benutzerdefinierte Combos | 6 Strategien: fill-first, round-robin, p2c, random, least-used, cost-optimized |
| đ§© Benutzerdefinierte Modelle | Jede Modell-ID zu jedem Anbieter hinzufĂŒgen |
| đ Wildcard-Router | provider/* Muster dynamisch an jeden Anbieter routen |
| đ§ Reasoning-Budget | Passthrough, auto, custom und adaptive Modi fĂŒr Reasoning-Modelle |
| đŹ System Prompt Injection | Globaler System Prompt fĂŒr alle Anfragen |
| đ API Responses | Volle UnterstĂŒtzung der OpenAI Responses API (/v1/responses) fĂŒr Codex |
đ” Multi-Modale APIs
| Funktion | Was es macht |
|---|---|
| đŒïž Bildgenerierung | /v1/images/generations â 4 Anbieter, 9+ Modelle |
| đ Embeddings | /v1/embeddings â 6 Anbieter, 9+ Modelle |
| đ€ Audio-Transkription | /v1/audio/transcriptions â Whisper-kompatibel |
| đ Text-zu-Sprache | /v1/audio/speech â Multi-Anbieter Audiosynthese |
| đĄïž Moderationen | /v1/moderations â SicherheitsĂŒberprĂŒfungen |
| đ Reranking | /v1/rerank â Dokumenten-Relevanz-Neuordnung |
đĄïž Resilienz & Sicherheit
| Funktion | Was es macht |
|---|---|
| đ Circuit Breaker | Auto-Ăffnung/-SchlieĂung pro Anbieter mit konfigurierbaren Schwellen |
| đĄïž Anti-Thundering Herd | Mutex + Semaphor Rate-Limit fĂŒr API-Key-Anbieter |
| đ§ Semantischer Cache | Zwei-Ebenen-Cache (Signatur + Semantik) senkt Kosten und Latenz |
| ⥠Anfrage-Idempotenz | 5s Dedup-Fenster fĂŒr doppelte Anfragen |
| đ TLS-Fingerprint-Spoofing | Bot-Erkennung umgehen via wreq-js |
| đ IP-Filterung | Allowlist/Blocklist fĂŒr API-Zugriffskontrolle |
| đ Editierbare Rate-Limits | Konfigurierbare RPM, minimaler Abstand, max. Konkurrenz |
đ Observability & Analytics
| Funktion | Was es macht |
|---|---|
| đ Anfrage-Logs | Debug-Modus mit vollstĂ€ndigen Request/Response-Logs |
| đŸ SQLite-Logs | Persistente Proxy-Logs ĂŒberleben Neustarts |
| đ Analytics-Dashboard | Recharts: Statistik-Karten, Nutzungsdiagramm, Anbieter-Tabelle |
| đ Fortschritts-Tracking | Opt-in SSE-Fortschrittsereignisse fĂŒr Streaming |
| đ§Ș LLM-Evaluierungen | Testen mit Golden Set und 4 Match-Strategien |
| đ Anfrage-Telemetrie | p50/p95/p99 Latenz-Aggregation + X-Request-Id Tracking |
| đ Logs + Kontingente | Dedizierte Seiten fĂŒr Log-Browsing und Kontingent-Tracking |
| đ„ Health Dashboard | Uptime, Circuit-Breaker-Status, Lockouts, Cache-Statistiken |
| đ° Kosten-Tracking | Budget-Management + Preiseinstellung pro Modell |
âïž Deployment & Sync
| Funktion | Was es macht |
|---|---|
| đŸ Cloud Sync | Einstellungen zwischen GerĂ€ten via Cloudflare Workers synchronisieren |
| đ Ăberall deployen | Localhost, VPS, Docker, Cloudflare Workers |
| đ API-Key-Verwaltung | API-Keys pro Anbieter generieren, rotieren und einschrĂ€nken |
| đ§ Setup-Assistent | 4-Schritte gefĂŒhrtes Setup fĂŒr neue Nutzer |
| đ§ CLI Tools Dashboard | Ein-Klick-Konfiguration fĂŒr Claude, Codex, Cline, OpenClaw, Kilo, Antigravity |
| đ DB-Backups | Automatisches Backup und Wiederherstellung aller Einstellungen |
đ Funktionsdetails
đŻ Intelligenter 4-Tier-Fallback
Erstelle Combos mit automatischem Fallback:
Combo: "my-coding-stack"
1. cc/claude-opus-4-6 (dein Abo)
2. nvidia/llama-3.3-70b (kostenlose NVIDIA API)
3. glm/glm-4.7 (gĂŒnstiges Backup, $0.6/1M)
4. if/kimi-k2-thinking (kostenloser Fallback)
â Wechselt automatisch bei erschöpftem Kontingent oder Fehlern
đ Echtzeit-Kontingent-Tracking
- Token-Verbrauch pro Anbieter
- Reset-Countdown (5 Stunden, tÀglich, wöchentlich)
- KostenabschĂ€tzung fĂŒr bezahlte Stufen
- Monatliche Ausgabenberichte
đ Format-Ăbersetzung
Nahtlose Ăbersetzung zwischen Formaten:
- OpenAI â Claude â Gemini â OpenAI Responses
- Dein CLI sendet OpenAI-Format â OmniRoute ĂŒbersetzt â Anbieter empfĂ€ngt natives Format
- Funktioniert mit jedem Tool, das benutzerdefinierte OpenAI-Endpoints unterstĂŒtzt
đ„ Multi-Account-UnterstĂŒtzung
- Mehrere Konten pro Anbieter hinzufĂŒgen
- Automatisches Round-Robin oder prioritÀtsbasiertes Routing
- Fallback zum nÀchsten Konto bei Kontingent-Erschöpfung
đ Auto-Token-Erneuerung
- OAuth-Token werden automatisch vor Ablauf erneuert
- Keine manuelle Neuauthentifizierung nötig
- Nahtlose Erfahrung ĂŒber alle Anbieter
đš Benutzerdefinierte Combos
- Unbegrenzte Modell-Kombinationen erstellen
- 6 Strategien: fill-first, round-robin, power-of-two-choices, random, least-used, cost-optimized
- Combos zwischen GerÀten mit Cloud Sync teilen
đ„ Health Dashboard
- Systemstatus (Uptime, Version, Speichernutzung)
- Circuit-Breaker-Status pro Anbieter (Closed/Open/Half-Open)
- Rate-Limit-Status und aktive Lockouts
- Signatur-Cache-Statistiken
- Latenz-Telemetrie (p50/p95/p99) + Prompt-Cache
- Gesundheitsstatus mit einem Klick zurĂŒcksetzen
đ§ Ăbersetzer-Playground
- Debug, Test und Visualisierung von API-Format-Ăbersetzungen
- Anfragen senden und sehen, wie OmniRoute zwischen Anbieter-Formaten ĂŒbersetzt
- UnschĂ€tzbar fĂŒr Integrationsprobleme
đŸ Cloud Sync
- Anbieter, Combos und Einstellungen zwischen GerÀten synchronisieren
- Automatische Hintergrundsynchronisierung
- Sichere verschlĂŒsselte Speicherung
đ Einrichtungsanleitung
đł Abo-Anbieter
Claude Code (Pro/Max)
Dashboard â Anbieter â Claude Code verbinden
â OAuth Login â Automatische Token-Erneuerung
â 5h + wöchentliches Kontingent-Tracking
Modelle:
cc/claude-opus-4-6
cc/claude-sonnet-4-5-20250929
cc/claude-haiku-4-5-20251001
Profi-Tipp: Opus fĂŒr komplexe Aufgaben, Sonnet fĂŒr Geschwindigkeit. OmniRoute trackt Kontingent pro Modell!
OpenAI Codex (Plus/Pro)
Dashboard â Anbieter â Codex verbinden
â OAuth Login (Port 1455)
â 5h + wöchentlicher Reset
Modelle:
cx/gpt-5.2-codex
cx/gpt-5.1-codex-max
Gemini CLI (KOSTENLOS 180K/Monat!)
Dashboard â Anbieter â Gemini CLI verbinden
â Google OAuth
â 180K Completions/Monat + 1K/Tag
Modelle:
gc/gemini-3-flash-preview
gc/gemini-2.5-pro
Bester Wert: Riesiger Gratis-Tarif! Vor bezahlten Stufen nutzen.
GitHub Copilot
Dashboard â Anbieter â GitHub verbinden
â OAuth via GitHub
â Monatlicher Reset (1. des Monats)
Modelle:
gh/gpt-5
gh/claude-4.5-sonnet
gh/gemini-3-pro
đ API-Key-Anbieter
NVIDIA NIM (KOSTENLOS 1000 Credits!)
- Registrieren: build.nvidia.com
- Kostenlosen API-Key holen (1000 Inferenz-Credits inklusive)
- Dashboard â Anbieter hinzufĂŒgen â NVIDIA NIM:
- API Key:
nvapi-your-key
- API Key:
Modelle: nvidia/llama-3.3-70b-instruct, nvidia/mistral-7b-instruct und 50+ weitere
Profi-Tipp: OpenAI-kompatible API â funktioniert perfekt mit OmniRoutes Format-Ăbersetzung!
DeepSeek
- Registrieren: platform.deepseek.com
- API-Key holen
- Dashboard â Anbieter hinzufĂŒgen â DeepSeek
Modelle: deepseek/deepseek-chat, deepseek/deepseek-coder
Groq (Gratis-Stufe verfĂŒgbar!)
- Registrieren: console.groq.com
- API-Key holen (Gratis-Stufe inklusive)
- Dashboard â Anbieter hinzufĂŒgen â Groq
Modelle: groq/llama-3.3-70b, groq/mixtral-8x7b
Profi-Tipp: Ultra-schnelle Inferenz â am besten fĂŒr Echtzeit-Programmierung!
OpenRouter (100+ Modelle)
- Registrieren: openrouter.ai
- API-Key holen
- Dashboard â Anbieter hinzufĂŒgen â OpenRouter
Modelle: Zugang zu 100+ Modellen aller groĂen Anbieter ĂŒber einen einzigen API-Key.
đ° GĂŒnstige Anbieter (Backup)
GLM-4.7 (TĂ€glicher Reset, $0.6/1M)
- Registrieren: Zhipu AI
- API-Key aus dem Coding Plan holen
- Dashboard â API Key hinzufĂŒgen:
- Anbieter:
glm - API Key:
your-key
- Anbieter:
Nutze: glm/glm-4.7
Profi-Tipp: Der Coding Plan bietet 3Ă Kontingent zu 1/7 der Kosten! TĂ€glicher Reset um 10:00.
MiniMax M2.1 (5h Reset, $0.20/1M)
- Registrieren: MiniMax
- API-Key holen
- Dashboard â API Key hinzufĂŒgen
Nutze: minimax/MiniMax-M2.1
Profi-Tipp: GĂŒnstigste Option fĂŒr langen Kontext (1M Token)!
Kimi K2 ($9/Monat fest)
- Abonnieren: Moonshot AI
- API-Key holen
- Dashboard â API Key hinzufĂŒgen
Nutze: kimi/kimi-latest
Profi-Tipp: Feste $9/Monat fĂŒr 10M Token = $0.90/1M effektive Kosten!
đ KOSTENLOSE Anbieter (Notfall-Backup)
iFlow (8 KOSTENLOSE Modelle)
Dashboard â iFlow verbinden
â iFlow OAuth Login
â Unbegrenzte Nutzung
Modelle:
if/kimi-k2-thinking
if/qwen3-coder-plus
if/glm-4.7
if/minimax-m2
if/deepseek-r1
Qwen (3 KOSTENLOSE Modelle)
Dashboard â Qwen verbinden
â GerĂ€te-Code-Autorisierung
â Unbegrenzte Nutzung
Modelle:
qw/qwen3-coder-plus
qw/qwen3-coder-flash
Kiro (Kostenloses Claude)
Dashboard â Kiro verbinden
â AWS Builder ID oder Google/GitHub
â Unbegrenzte Nutzung
Modelle:
kr/claude-sonnet-4.5
kr/claude-haiku-4.5
đš Combos erstellen
Beispiel 1: Abo maximieren â GĂŒnstiges Backup
Dashboard â Combos â Neues erstellen
Name: premium-coding
Modelle:
1. cc/claude-opus-4-6 (PrimÀres Abo)
2. glm/glm-4.7 (GĂŒnstiges Backup, $0.6/1M)
3. minimax/MiniMax-M2.1 (GĂŒnstigster Fallback, $0.20/1M)
Im CLI nutzen: premium-coding
Beispiel 2: Nur Kostenlos (Null Kosten)
Name: free-combo
Modelle:
1. gc/gemini-3-flash-preview (180K gratis/Monat)
2. if/kimi-k2-thinking (unbegrenzt)
3. qw/qwen3-coder-plus (unbegrenzt)
Kosten: FĂŒr immer $0!
đ§ CLI-Integration
Cursor IDE
Einstellungen â Modelle â Erweitert:
OpenAI API Base URL: http://localhost:20128/v1
OpenAI API Key: [aus OmniRoute Dashboard]
Model: cc/claude-opus-4-6
Claude Code
Nutze die CLI Tools Seite im Dashboard fĂŒr Ein-Klick-Konfiguration, oder bearbeite ~/.claude/settings.json manuell.
Codex CLI
export OPENAI_BASE_URL="http://localhost:20128"
export OPENAI_API_KEY="your-omniroute-api-key"
codex "your prompt"
OpenClaw
Option 1 â Dashboard (empfohlen):
Dashboard â CLI Tools â OpenClaw â Modell wĂ€hlen â Anwenden
Option 2 â Manuell: ~/.openclaw/openclaw.json bearbeiten:
{
"models": {
"providers": {
"omniroute": {
"baseUrl": "http://127.0.0.1:20128/v1",
"apiKey": "sk_omniroute",
"api": "openai-completions"
}
}
}
}
Hinweis: OpenClaw funktioniert nur mit lokalem OmniRoute. Verwende
127.0.0.1stattlocalhostum IPv6-Auflösungsprobleme zu vermeiden.
Cline / Continue / RooCode
Einstellungen â API-Konfiguration:
Anbieter: OpenAI Compatible
Base URL: http://localhost:20128/v1
API Key: [aus OmniRoute Dashboard]
Model: if/kimi-k2-thinking
đ VerfĂŒgbare Modelle
Alle verfĂŒgbaren Modelle anzeigen
Claude Code (cc/) - Pro/Max:
cc/claude-opus-4-6cc/claude-sonnet-4-5-20250929cc/claude-haiku-4-5-20251001
Codex (cx/) - Plus/Pro:
cx/gpt-5.2-codexcx/gpt-5.1-codex-max
Gemini CLI (gc/) - KOSTENLOS:
gc/gemini-3-flash-previewgc/gemini-2.5-pro
GitHub Copilot (gh/):
gh/gpt-5gh/claude-4.5-sonnet
NVIDIA NIM (nvidia/) - KOSTENLOSE Credits:
nvidia/llama-3.3-70b-instructnvidia/mistral-7b-instruct- 50+ weitere Modelle auf build.nvidia.com
GLM (glm/) - $0.6/1M:
glm/glm-4.7
MiniMax (minimax/) - $0.2/1M:
minimax/MiniMax-M2.1
iFlow (if/) - KOSTENLOS:
if/kimi-k2-thinkingif/qwen3-coder-plusif/deepseek-r1if/glm-4.7if/minimax-m2
Qwen (qw/) - KOSTENLOS:
qw/qwen3-coder-plusqw/qwen3-coder-flash
Kiro (kr/) - KOSTENLOS:
kr/claude-sonnet-4.5kr/claude-haiku-4.5
OpenRouter (or/) - 100+ Modelle:
or/anthropic/claude-4-sonnetor/google/gemini-2.5-pro- Jedes Modell von openrouter.ai/models
đ§Ș Evaluierungen (Evals)
OmniRoute enthĂ€lt ein integriertes Evaluierungs-Framework zum Testen der LLM-AntwortqualitĂ€t gegen ein Golden Set. Zugang ĂŒber Analytics â Evals im Dashboard.
Integriertes Golden Set
Das vorgeladene âOmniRoute Golden Set" enthĂ€lt 10 TestfĂ€lle:
- BegrĂŒĂungen, Mathematik, Geographie, Code-Generierung
- JSON-FormatkonformitĂ€t, Ăbersetzung, Markdown
- Sicherheitsablehnung (schÀdlicher Inhalt), ZÀhlung, Boolesche Logik
Evaluierungsstrategien
| Strategie | Beschreibung | Beispiel |
|---|---|---|
exact |
Ausgabe muss exakt ĂŒbereinstimmen | "4" |
contains |
Ausgabe muss Teilzeichenfolge enthalten (case-insensitive) | "Paris" |
regex |
Ausgabe muss Regex-Muster entsprechen | "1.*2.*3" |
custom |
Benutzerdefinierte JS-Funktion gibt true/false zurĂŒck | (output) => output.length > 10 |
đ Fehlerbehebung
Klicke zum Erweitern der Fehlerbehebungsanleitung
âLanguage model did not provide messages"
- Anbieter-Kontingent erschöpft â Kontingent-Tracker im Dashboard prĂŒfen
- Lösung: Combo mit Fallback nutzen oder zu gĂŒnstigerer Stufe wechseln
Rate Limiting
- Abo-Kontingent erschöpft â Fallback zu GLM/MiniMax
- Combo hinzufĂŒgen:
cc/claude-opus-4-6 â glm/glm-4.7 â if/kimi-k2-thinking
OAuth-Token abgelaufen
- Wird automatisch von OmniRoute erneuert
- Falls Problem bestehen bleibt: Dashboard â Anbieter â Neu verbinden
Hohe Kosten
- Nutzungsstatistiken unter Dashboard â Kosten prĂŒfen
- PrimÀrmodell auf GLM/MiniMax umstellen
- Gratis-Stufe (Gemini CLI, iFlow) fĂŒr unkritische Aufgaben nutzen
Dashboard öffnet sich auf falschem Port
PORT=20128undNEXT_PUBLIC_BASE_URL=http://localhost:20128setzen
Cloud-Sync-Fehler
- PrĂŒfe dass
BASE_URLauf deine laufende Instanz zeigt - PrĂŒfe dass
CLOUD_URLauf den erwarteten Cloud-Endpoint zeigt NEXT_PUBLIC_*Werte mit Serverwerten synchron halten
Erster Login funktioniert nicht
INITIAL_PASSWORDin.envprĂŒfen- Falls nicht gesetzt, Standard-Passwort ist
123456
Keine Anfrage-Logs
ENABLE_REQUEST_LOGS=truein.envsetzen
Verbindungstest zeigt âInvalid" fĂŒr OpenAI-kompatible Anbieter
- Viele Anbieter stellen den
/modelsEndpoint nicht bereit - OmniRoute v1.0.5+ enthÀlt Fallback-Validierung via Chat Completions
- Stelle sicher, dass die Base URL den
/v1Suffix enthÀlt
đ ïž Technologie-Stack
- Runtime: Node.js 20+
- Sprache: TypeScript 5.9 â 100% TypeScript in
src/undopen-sse/(v1.0.5) - Framework: Next.js 16 + React 19 + Tailwind CSS 4
- Datenbank: LowDB (JSON) + SQLite (Domain-Status + Proxy-Logs)
- Streaming: Server-Sent Events (SSE)
- Auth: OAuth 2.0 (PKCE) + JWT + API Keys
- Testing: Node.js Test Runner (368+ Unit-Tests)
- CI/CD: GitHub Actions (automatische npm + Docker Hub Veröffentlichung bei Release)
- Website: omniroute.online
- Paket: npmjs.com/package/omniroute
- Docker: hub.docker.com/r/diegosouzapw/omniroute
- Resilienz: Circuit Breaker, exponentieller Backoff, Anti-Thundering Herd, TLS-Spoofing
đ Dokumentation
| Dokument | Beschreibung |
|---|---|
| Benutzerhandbuch | Anbieter, Combos, CLI-Integration, Deploy |
| API-Referenz | Alle Endpoints mit Beispielen |
| Fehlerbehebung | HÀufige Probleme und Lösungen |
| Architektur | Systemarchitektur und Interna |
| Mitwirken | Entwicklungs-Setup und Richtlinien |
| OpenAPI-Spezifikation | OpenAPI 3.0 Spezifikation |
| Sicherheitsrichtlinie | Schwachstellen melden und Sicherheitspraktiken |
đ§ Support
đŹ Treten Sie unserer Community bei! WhatsApp-Gruppe â Hilfe bekommen, Tipps teilen und auf dem Laufenden bleiben.
- Website: omniroute.online
- GitHub: github.com/diegosouzapw/OmniRoute
- Issues: github.com/diegosouzapw/OmniRoute/issues
- WhatsApp: Community-Gruppe
- WhatsApp: Community-Gruppe
- Originalprojekt: 9router von decolua
đ„ Mitwirkende
Wie du mitwirken kannst
- Repository forken
- Feature-Branch erstellen (
git checkout -b feature/amazing-feature) - Ănderungen committen (
git commit -m 'Add amazing feature') - Branch pushen (
git push origin feature/amazing-feature) - Pull Request öffnen
Siehe CONTRIBUTING.md fĂŒr detaillierte Richtlinien.
Neue Version veröffentlichen
# Release erstellen â npm-Veröffentlichung erfolgt automatisch
gh release create v1.0.5 --title "v1.0.5" --generate-notes
đ Star-Verlauf
đ Danksagungen
Besonderer Dank an 9router von decolua â das Originalprojekt, das diesen Fork inspiriert hat. OmniRoute baut auf diesem unglaublichen Fundament auf mit zusĂ€tzlichen Funktionen, Multi-Modalen APIs und einem vollstĂ€ndigen TypeScript-Rewrite.
Besonderer Dank an CLIProxyAPI â die ursprĂŒngliche Go-Implementierung, die diese JavaScript-Portierung inspiriert hat.
đ Lizenz
MIT-Lizenz â siehe LICENSE fĂŒr Details.