mirror of
https://github.com/diegosouzapw/OmniRoute.git
synced 2026-08-02 05:12:11 +03:00
* chore(release): open v3.8.39 development cycle * docs(changelog): backfill 5 v3.8.38 bullets merged after release finalize These PRs squash-merged into release/v3.8.38 between the CHANGELOG finalize (ff57be32f) and the merge-to-main (ae6e2342d), so they shipped in the v3.8.38 tag but had no bullet: - feat(compression): Ionizer engine (lossy JSON-array sampling + CCR) (#5148) - fix(sse): preserve non-stream reasoning fields (#5155, @rdself) - fix(i18n): add missing English UI labels (#5153, @rdself) - test(combo): gated live smoke (#5151) + release-expectations refresh (#5150, @KooshaPari) (#5129 exact-host Anthropic baseUrl is already covered by the #5130 bullet — same CodeQL #674.) Synced 41 i18n CHANGELOG mirrors. * feat(compression): TOON best-of-N candidate encoder + encoder A/B table (#5163) Integrated into release/v3.8.39. TOON best-of-N candidate encoder (GCF default, fail-open). 17/17 unit tests pass on merge result; CI reds were base-stale + Quality Ratchet DRIFT. * fix(zenmux): normalize vendor-prefixed GLM system roles (#5158) Integrated into release/v3.8.39. ZenMux vendor-prefixed GLM system-role normalization; 12/12 role-normalizer tests pass on merge result. CI reds base-stale. * [codex] fix xAI OAuth test and reasoning effort (#5157) Integrated into release/v3.8.39. xAI reasoning-effort normalization (max/xhigh→high) + OAuth test config; 46/46 xai-translator tests pass on merge result. CI reds base-stale. * docs(i18n): add Traditional Chinese (zh-TW) README and update zh-CN to latest (#5162) Integrated into release/v3.8.39. Traditional Chinese (zh-TW) README + zh-CN refresh; docs-only. * test(security): guard PII redaction stays opt-in (default off) + Hard Rule #20 (#5159) Integrated into release/v3.8.39. PII opt-in regression guard + Hard Rule #20; rebased to strip base-drift (+81/-1). 5/5 guard tests pass; flip-proof verified. * test(combo): deterministic context-relay universal-handoff coverage (closes phase-2 TODO) (#5168) Integrated into release/v3.8.39. Deterministic context-relay universal-handoff coverage (3 tests); 3/3 pass on merge result. * docs(i18n): full sync zh-TW and zh-CN README with canonical English v3.8.39 (#5171) Integrated into release/v3.8.39. Full zh-TW docs tree + zh-CN sync with canonical English v3.8.39; docs-only. * fix(serve): honour HOSTNAME from .env instead of hardcoding 0.0.0.0 (#5134) (#5170) Integrated into release/v3.8.39. HOSTNAME env override in serve (#5134) + regression test (4/4, TDD flip-proof verified). * fix(sse): resolve nameless deepseek-web tool blocks via parameter-schema match (#5154) (#5173) Integrated into release/v3.8.39. Schema-based nameless deepseek-web tool-block resolution (#5154); 6/6 tests pass on merge result (incl. ambiguous/no-match negatives + named-tag no-regression). * fix(sse): normalize array user content for Command Code to avoid upstream 400 (#5166) (#5174) Integrated into release/v3.8.39. Normalize array user content for Command Code (#5166, user-array/400 symptom); 4/4 tests pass on merge result. * fix(sse): defer </think> close so it never leaks before tool_calls (#5123) (#5175) Integrated into release/v3.8.39. Defer </think> close so it never leaks before tool_calls (#5123); 4/4 tests pass (incl. #4633 no-regression). CHANGELOG synced to keep all 3 v3.8.39 fixes. * fix(dashboard): use amber for home update-step warning icon (#5176) Integrated into release/v3.8.39. Amber for home update-step warning icon; 1/1 UI test. * fix(api): LAN/Tailscale dashboard — host-aware CSP + GET-exempt version route + combo field errors (#5083) (#5177) Integrated into release/v3.8.39. Host-aware CSP (ReDoS/injection-safe host validation) + GET-exempt /api/system/version (POST/spawn stays LOCAL_ONLY, exact-match safe-methods-only) + COMBO_002 firstField. 44/44 tests + route-guard membership gate green. CHANGELOG synced to keep all 4 v3.8.39 fixes. * fix(api): replace #5083 global middleware CSP with declarative ws: scheme (#5083) Follow-up to PR #5177 (merged): that version implemented the LAN-CSP fix (Bug 1) with a new global `src/middleware.ts` + `src/server/csp.ts`, which contradicts the project's documented architecture — 'No global Next.js middleware — interception is route-specific' (CLAUDE.md / AGENTS.md) — and was merged unverified (middleware vs next.config header precedence was never confirmed in a real build). This replaces that approach with the minimal, declarative equivalent: • next.config.mjs: connect-src now permits the bare `ws:` scheme (symmetric with the bare `wss:` already allowed) so the dashboard can reach its own Live WS server from a LAN/Tailscale host. No middleware. • Removes src/middleware.ts, src/server/csp.ts, and tests/unit/csp-host-aware.test.ts. • Adds tests/unit/csp-lan-ws-5083.test.ts (incl. a guard asserting src/middleware.ts does NOT exist, so the global-middleware approach cannot silently return). Bugs 2 (GET-exempt /api/system/version) and 3 (COMBO_002 field surfacing) from #5177 are unaffected and remain in place. Co-authored-by: KooshaPari <KooshaPari@users.noreply.github.com> * test(combo): end-to-end quota-share DRR routing-decision coverage (matrix parity) (#5179) Integrated into release/v3.8.39. Quota-share DRR routing-decision coverage (matrix parity); 2/2 pass on merge result. * feat(agent-bridge): graceful cert-install fallback with manual guide for containers (#4546) (#5178) Integrated into release/v3.8.39. Agent-bridge graceful cert-install fallback + manual guide (#4546); 6/6 tests pass on merge result. * fix(antigravity): family-scoped quota lockout (gemini/claude buckets) (#5180) Integrated into release/v3.8.39 — family-scoped antigravity quota lockout. Rebased from v3.8.37 + validated (vitest 5/5, typecheck clean, full combo-matrix green, model-lockout 99/0). Same-model cross-account retry (chat.ts) deferred pending live antigravity VPS validation. * fix(cli): force NODE_ENV to match dev/start run mode in custom Next server (#5189) Integrated into release/v3.8.39. Force NODE_ENV to match dev/start run mode in custom Next server; 2/2 source-scan+ordering tests pass on merge result. * feat(compression): CCR ranged/grep/stats retrieval (ReDoS-safe, backward-compat) (#5187) Integrated into release/v3.8.39. CCR ranged/grep/stats retrieval (safe-regex ReDoS guard + length/match caps); 17/17 tests pass on merge result. * docs(combo): sync all combo/routing-strategy docs to current state + document test coverage (#5185) Integrated into release/v3.8.39. Combo/routing-strategy docs sync; docs-only. * fix(mcp): return 404 (not 400) for unknown Streamable HTTP session id (#5169) (#5191) * fix(api): respect blocked Auto (Zero-Config) provider in /v1/models catalog (#5192) (#5194) * test(combo): deterministic context-relay codex quota-handoff coverage (closes last gap) (#5195) * test(ci): wire antigravity-quota-family under test:vitest (fix test-discovery orphan) (#5196) * fix(oauth): antigravity login no longer hangs — fire-and-forget onboarding + bounded post-exchange (#5193) Antigravity OAuth hang fix (no-PKCE/no-openid + bounded post-exchange + exchange-500 fix). Includes #5200 (Koosha) revert + owner rebaseline to keep documented comments. Integrated into release/v3.8.39. * feat(oauth): remote Antigravity login via local helper + paste-credentials (#5203) Remote Antigravity login: local helper (omniroute login antigravity) + paste-credentials. Integrated into release/v3.8.39. * fix(translator): accept Claude Messages shape in non-stream malformed-200 guard (#5156) Integrated into release/v3.8.39 * fix(cli): default dev bundler to Turbopack (16.2.x panic no longer reproduces) (#5206) Integrated into release/v3.8.39 * fix(cli): auto-calibrate server V8 heap from physical RAM (#5172) (#5213) The server was spawned with a fixed --max-old-space-size=512 (omniroute serve) or no heap flag at all (Electron), so RAM-rich boxes still OOM-crashed under load (Ineffective mark-compacts near heap limit ~500MB) with many providers/ accounts and large model catalogs. New calibrateHeapFallbackMb(os.totalmem()) defaults the heap to ~35% of RAM clamped [512,4096], wired into serve.mjs and electron/main.js. Explicit OMNIROUTE_MEMORY_MB still wins (#2939 unchanged). Also addresses #5160 (same OOM root); #5152 (docker) benefits via the same knob. Closes #5172 * fix(proxy): coalesce fast-fail health probes (#5208) Integrated into release/v3.8.39 * fix(proxy): close dispatchers when clearing cache (#5202) Integrated into release/v3.8.39 * fix(cli): raise dev server Node heap limit to 8GB to prevent OOM (#5198) Integrated into release/v3.8.39 * fix(auth): allow synthetic no-auth fallback for mimocode (#5205) Integrated into release/v3.8.39 * fix(oauth): preserve Antigravity refresh_token on empty/omitted upstream response (#3850) (#5214) Google's OAuth refresh tokens are non-rotating: the refresh response usually omits refresh_token and occasionally returns it as an empty string. The Antigravity executor used `typeof tokens.refresh_token === "string" ? ... ` which accepts "" (typeof "" === "string") and overwrote the stored token with empty, nulling it on first refresh. Now treats non-string OR empty as absent and preserves credentials.refreshToken, matching refreshGoogleToken semantics. Closes #3850 * fix(responses): normalize non-array input (#5204) Integrated into release/v3.8.39 * fix(stream): normalize safety finish reasons via shared helper (#5197) Integrated into release/v3.8.39 * fix(request-logger): never render negative '(-100%)' compression badge (#5201) Integrated into release/v3.8.39 * fix(combo): reject empty responses api output (#5207) Integrated into release/v3.8.39 — combo failover now rejects empty Responses API output (validateQuality). Baseline rebaseline dropped (main-measured drift; maintainer rebaselines at release). * fix(pwa): prefer cached navigation before offline page (#5209) Integrated into release/v3.8.39 — PWA service worker prefers cached navigation before offline page (#5165). * chore(release): v3.8.39 — 2026-06-28 * chore(release): rebaseline openapi+i18n coverage ratchet drift for v3.8.39 --------- Co-authored-by: Arthur Bodera <abodera@gmail.com> Co-authored-by: Nguyen Minh <lop123thcs@gmail.com> Co-authored-by: lunkerchen <labanchen@gmail.com> Co-authored-by: Ankit <177378174+anki1kr@users.noreply.github.com> Co-authored-by: KooshaPari <KooshaPari@users.noreply.github.com> Co-authored-by: Ardem2025 <ardemb22@gmail.com> Co-authored-by: backryun <bakryun0718@proton.me> Co-authored-by: Anton <39598727+NomenAK@users.noreply.github.com> Co-authored-by: KooshaPari <42529354+KooshaPari@users.noreply.github.com> Co-authored-by: Wilson <pedbookmed@gmail.com> Co-authored-by: Randi <55005611+rdself@users.noreply.github.com>
266 lines
9.9 KiB
TypeScript
266 lines
9.9 KiB
TypeScript
/**
|
|
* Role Normalizer — Converts message roles for provider compatibility.
|
|
*
|
|
* Fixes Issues:
|
|
* 1. GLM/ZhipuAI rejects `system` role → merged into first `user` message
|
|
* 2. OpenAI `developer` role not understood by non-OpenAI providers → normalized to `system`
|
|
* 3. Some providers don't support `system` role at all → prepended to user message
|
|
*
|
|
* Provider capability matrix is defined here rather than in the registry to
|
|
* avoid breaking changes to the existing RegistryEntry interface.
|
|
*/
|
|
|
|
// ── Provider capabilities ──────────────────────────────────────────────────
|
|
|
|
/**
|
|
* Providers that do NOT support the `system` role in messages.
|
|
* For these, system messages are merged into the first user message.
|
|
*
|
|
* Note: This applies only to OpenAI-format passthrough providers.
|
|
* Claude and Gemini have their own system message handling in dedicated translators.
|
|
*/
|
|
const PROVIDERS_WITHOUT_SYSTEM_ROLE = new Set([
|
|
// Known to reject system role (from troubleshooting report)
|
|
// GLM uses Claude format, so this is handled through claude translator
|
|
// But if accessed through OpenAI-format providers like nvidia, it needs this:
|
|
]);
|
|
|
|
/**
|
|
* Providers known to natively accept the OpenAI `developer` role.
|
|
* Issue #2281: When the upstream provider is OpenAI-compatible but NOT in
|
|
* this allowlist (DeepSeek, MiniMax, Mimo, GLM, etc.), the default behavior
|
|
* maps `developer` → `system`. Without this, requests from Codex/Responses
|
|
* API clients fail with "unknown variant `developer`" 400 errors.
|
|
*
|
|
* Operators can still force preservation per-model via the dashboard
|
|
* "Compatibility → preserveOpenAIDeveloperRole = true" toggle.
|
|
*/
|
|
const PROVIDERS_PRESERVING_DEVELOPER_ROLE = new Set(["openai", "azure-openai", "azure", "github"]);
|
|
|
|
function defaultPreserveDeveloperForProvider(provider: string): boolean {
|
|
const id = provider.trim().toLowerCase();
|
|
if (!id) return false;
|
|
if (PROVIDERS_PRESERVING_DEVELOPER_ROLE.has(id)) return true;
|
|
// Treat any provider id containing "openai" as OpenAI-compatible enough
|
|
// to preserve developer role by default (e.g. "azure-openai-gov").
|
|
if (id.includes("openai")) return true;
|
|
return false;
|
|
}
|
|
|
|
/**
|
|
* Models that are known to reject the `system` role regardless of provider.
|
|
* Uses prefix matching (e.g., "glm-" matches "glm-4.7", "glm-4.5", etc.)
|
|
*/
|
|
const MODELS_WITHOUT_SYSTEM_ROLE = [
|
|
"glm-", // ZhipuAI GLM models (prefix: glm-5.1, glm-4.7, etc.)
|
|
"glm", // Exact match for model id "glm" (e.g., Pollinations)
|
|
"ernie-", // Baidu ERNIE models
|
|
];
|
|
|
|
const PROVIDER_SCOPED_MODELS_WITHOUT_SYSTEM_ROLE: Record<string, RegExp[]> = {
|
|
// ZenMux exposes Z.AI GLM through OpenAI-compatible model ids such as
|
|
// "z-ai/glm-5.2". Z.AI rejects compressed histories that start with a
|
|
// system summary followed by an assistant/tool bundle, while OpenRouter
|
|
// tolerates the same shape. Treat these vendor-prefixed GLM ids like native
|
|
// GLM so normalizeSystemRole moves system/developer content into a user turn.
|
|
zenmux: [/(?:^|\/)glm(?:-|$)/i],
|
|
};
|
|
|
|
interface MessageContentPart {
|
|
type?: string;
|
|
text?: string;
|
|
[key: string]: unknown;
|
|
}
|
|
|
|
interface NormalizedMessage {
|
|
role?: string;
|
|
content?: unknown;
|
|
[key: string]: unknown;
|
|
}
|
|
|
|
function extractTextFromContent(content: unknown): string {
|
|
if (typeof content === "string") return content;
|
|
if (!Array.isArray(content)) return "";
|
|
return content
|
|
.filter(
|
|
(part): part is MessageContentPart =>
|
|
!!part &&
|
|
typeof part === "object" &&
|
|
"type" in part &&
|
|
(part as MessageContentPart).type === "text"
|
|
)
|
|
.map((part) => (typeof part.text === "string" ? part.text : ""))
|
|
.join("\n");
|
|
}
|
|
|
|
/**
|
|
* Check if a provider+model combo supports the system role.
|
|
*/
|
|
function supportsSystemRole(provider: string, model: string): boolean {
|
|
const providerLower = (provider || "").trim().toLowerCase();
|
|
if (PROVIDERS_WITHOUT_SYSTEM_ROLE.has(providerLower)) return false;
|
|
|
|
const modelLower = (model || "").toLowerCase();
|
|
|
|
for (const pattern of PROVIDER_SCOPED_MODELS_WITHOUT_SYSTEM_ROLE[providerLower] ?? []) {
|
|
if (pattern.test(modelLower)) return false;
|
|
}
|
|
|
|
for (const prefix of MODELS_WITHOUT_SYSTEM_ROLE) {
|
|
if (modelLower.startsWith(prefix)) return false;
|
|
}
|
|
|
|
return true;
|
|
}
|
|
|
|
/**
|
|
* Normalize the `developer` role to `system` when the upstream does not support it.
|
|
* OpenAI Responses API sends `developer`; MiniMax and most OpenAI-compatible gateways
|
|
* only accept system/user/assistant/tool and return "role param error" otherwise.
|
|
*
|
|
* Logic:
|
|
* - When targetFormat !== "openai": always convert developer → system (Claude, Gemini, etc.).
|
|
* - When targetFormat === "openai" && preserveDeveloperRole === false: map to system.
|
|
* - When targetFormat === "openai" && preserveDeveloperRole === true: keep developer.
|
|
* - When targetFormat === "openai" && preserveDeveloperRole === undefined (default):
|
|
* resolve from {@link defaultPreserveDeveloperForProvider} — preserve only for
|
|
* the OpenAI-compatible allowlist; map to system for everyone else (#2281).
|
|
*
|
|
* @param messages - Array of messages
|
|
* @param targetFormat - The target format (e.g., "openai", "claude", "gemini")
|
|
* @param preserveDeveloperRole - undefined = provider-driven default; true = always keep; false = always map to system
|
|
* @param provider - Provider id (used when preserveDeveloperRole is undefined)
|
|
*/
|
|
export function normalizeDeveloperRole(
|
|
messages: NormalizedMessage[] | unknown,
|
|
targetFormat: string,
|
|
preserveDeveloperRole?: boolean,
|
|
provider?: string
|
|
): NormalizedMessage[] | unknown {
|
|
if (!Array.isArray(messages)) return messages;
|
|
|
|
if (targetFormat === "openai") {
|
|
const effectivePreserve =
|
|
preserveDeveloperRole !== undefined
|
|
? preserveDeveloperRole
|
|
: defaultPreserveDeveloperForProvider(provider ?? "");
|
|
if (effectivePreserve) return messages;
|
|
}
|
|
|
|
return messages.map((msg: NormalizedMessage) => {
|
|
if (!msg || typeof msg !== "object") return msg;
|
|
const role = typeof msg.role === "string" ? msg.role : "";
|
|
if (role.toLowerCase() === "developer") {
|
|
return { ...msg, role: "system" };
|
|
}
|
|
return msg;
|
|
});
|
|
}
|
|
|
|
export function normalizeModelRole(
|
|
messages: NormalizedMessage[] | unknown
|
|
): NormalizedMessage[] | unknown {
|
|
if (!Array.isArray(messages)) return messages;
|
|
|
|
return messages.map((msg: NormalizedMessage) => {
|
|
if (!msg || typeof msg !== "object") return msg;
|
|
const role = typeof msg.role === "string" ? msg.role : "";
|
|
if (role.toLowerCase() === "model") {
|
|
return { ...msg, role: "assistant" };
|
|
}
|
|
return msg;
|
|
});
|
|
}
|
|
|
|
/**
|
|
* Convert `system` messages to user messages for providers that don't support
|
|
* the system role. The system content is prepended to the first user message
|
|
* with a clear delimiter.
|
|
*
|
|
* @param messages - Array of messages
|
|
* @param provider - Provider name
|
|
* @param model - Model name
|
|
* @returns Modified messages array
|
|
*/
|
|
export function normalizeSystemRole(
|
|
messages: NormalizedMessage[] | unknown,
|
|
provider: string,
|
|
model: string
|
|
): NormalizedMessage[] | unknown {
|
|
if (!Array.isArray(messages) || messages.length === 0) return messages;
|
|
if (supportsSystemRole(provider, model)) return messages;
|
|
|
|
// Extract system messages
|
|
const systemMessages = messages.filter(
|
|
(message: NormalizedMessage) => message.role === "system" || message.role === "developer"
|
|
);
|
|
if (systemMessages.length === 0) return messages;
|
|
|
|
// Build system content string
|
|
const systemContent = systemMessages
|
|
.map((message: NormalizedMessage) => extractTextFromContent(message.content))
|
|
.filter(Boolean)
|
|
.join("\n\n");
|
|
|
|
if (!systemContent) {
|
|
return messages.filter(
|
|
(message: NormalizedMessage) => message.role !== "system" && message.role !== "developer"
|
|
);
|
|
}
|
|
|
|
// Remove system messages and merge into first user message
|
|
const nonSystemMessages = messages.filter(
|
|
(message: NormalizedMessage) => message.role !== "system" && message.role !== "developer"
|
|
);
|
|
|
|
// Find first user message and prepend system content
|
|
const firstUserIdx = nonSystemMessages.findIndex(
|
|
(message: NormalizedMessage) => message.role === "user"
|
|
);
|
|
if (firstUserIdx >= 0) {
|
|
const userMsg = nonSystemMessages[firstUserIdx];
|
|
const userContent = extractTextFromContent(userMsg.content);
|
|
|
|
nonSystemMessages[firstUserIdx] = {
|
|
...userMsg,
|
|
content: `[System Instructions]\n${systemContent}\n\n[User Message]\n${userContent}`,
|
|
};
|
|
} else {
|
|
// No user message found — insert as a user message at the beginning
|
|
nonSystemMessages.unshift({
|
|
role: "user",
|
|
content: `[System Instructions]\n${systemContent}`,
|
|
});
|
|
}
|
|
|
|
return nonSystemMessages;
|
|
}
|
|
|
|
/**
|
|
* Full role normalization pipeline.
|
|
* Call this before sending the request to the provider.
|
|
* Applies developer→system (when needed) then system→user for providers/models that do not support system role.
|
|
*
|
|
* @param messages - Array of messages to normalize (or non-array, returned as-is)
|
|
* @param provider - Provider id for capability lookup (e.g. system role support)
|
|
* @param model - Model id for capability lookup
|
|
* @param targetFormat - Target request format (e.g. "openai", "claude", "gemini"); see {@link normalizeDeveloperRole}
|
|
* @param preserveDeveloperRole - Optional; see {@link normalizeDeveloperRole}. When false, developer role is mapped to system.
|
|
* @returns Normalized messages array, or the original value if messages is not an array
|
|
*/
|
|
export function normalizeRoles(
|
|
messages: NormalizedMessage[] | unknown,
|
|
provider: string,
|
|
model: string,
|
|
targetFormat: string,
|
|
preserveDeveloperRole?: boolean
|
|
): NormalizedMessage[] | unknown {
|
|
if (!Array.isArray(messages)) return messages;
|
|
|
|
let result = normalizeModelRole(messages);
|
|
result = normalizeDeveloperRole(result, targetFormat, preserveDeveloperRole, provider);
|
|
result = normalizeSystemRole(result, provider, model);
|
|
|
|
return result;
|
|
}
|