OmniRoute — Dashboard Features Gallery (Deutsch)
✨ Highlights von v3.8.0
Abschnitt betitelt „✨ Highlights von v3.8.0“Der Zyklus v3.7.x → v3.8.0 bringt konfigurationsfreies automatisches Routing, neue Anbieter, OAuth-Abläufe, höhere Ausfallsicherheit und ein wesentlich umfangreicheres CLI-Erlebnis. Die wichtigsten Funktionen finden Sie unten — vollständige Details weiter hinten im Dokument und in den verlinkten Spezifikationen.
- 🤖 Auto Combo / konfigurationsfreies automatisches Routing — verwenden Sie die Präfixe
auto/coding,auto/fast,auto/cheap,auto/offline,auto/smart,auto/lkgp,auto/chaos. Unterstützt durch eine Bewertungs-Engine mit 16 Faktoren und 6 kuratierte Moduspakete (ship-fast, cost-saver, quality-first, offline-friendly, reliability-first, chaos-mode) - 🆕 Command Code-Anbieter (#2199) — vollständig integrierte Registrierung mit Modellkatalog und Kontingentverfolgung
- 🆕 Z.AI-Anbieter — neuer Anbieter mit kostenlosem Tarif und Kontingentkennzeichnungen
- 🎬 KIE-Medienerweiterung — erweiterter Katalog einschließlich Modellen zur Videogenerierung
- 🔐 Devin-Authentifizierung — Desktop importiert einen vorhandenen Devin-API-Schlüssel; die CLI verwendet lokale Anmeldedaten von
devin auth login - 🆓 8 neue kostenlose Anbieter — LLM7, Lepton, UncloseAI, BazaarLink, Completions, Enally, FreeTheAi, Command Code
- 🎯 Manifestbasiertes Stufen-Routing W1–W4 — Anbieter-Manifeste steuern die gewichtete Stufenauswahl
- 🎨 Vollständige OpenAI-Parität für Cursor — Tool-Aufrufe, Streaming und Sitzungsverwaltung durchgängig unterstützt
- 📊 Nutzung des Cursor-Pro-Tarifs — Kontingent- und Zyklusdaten werden im Dashboard für Anbieterlimits angezeigt
- ⚡ Aufschlüsselung nach Service-Stufe / Analysen für die schnelle Codex-Stufe — Einblick in den Verbrauch pro Stufe
- 📌 Sitzungsgebundenes Sticky-Routing — Codex-Sitzungen bleiben zwischen Anfragen demselben Konto zugeordnet
- 🔊 Verbesserungen für Inworld TTS — Sprachkataloge, Streaming und Latenzverbesserungen
- 🔑 Headless-Authentifizierung für Kiro — Anmeldung über den lokalen SQLite-Speicher von
kiro-cli, kein Browser erforderlich - 📉 Überwachung von DeepSeek-Kontingenten und -Limits — tägliche und monatliche Nutzung wird im Dashboard angezeigt
- 🔄 Reset-bewusste Routing-Strategie — Kombinationen bevorzugen nun Konten, deren Kontingentfenster am frühesten zurückgesetzt wird
- ⏱️
fallbackDelayMsund dynamische Erkennung von Tool-Limits — präzisere Fallback-Zeitsteuerung und anbieterspezifische Limits für die Tool-Anzahl - 🔧 Herabstufung des Hintergrundmodus (Responses API) — wechselt mit einer strukturierten Warnung in den synchronen Modus, wenn ein vorgelagerter Dienst keine Hintergrundabfragen unterstützt
- 🚦 Anbieterspezifische 429-Klassifizierung + Umschalter
useUpstream429BreakerHints— präziseres Breaker-Verhalten durch Nutzung vorgelagerter Hinweise zu Ratenlimits - 🩺 Dashboard für Modellabklingzeiten — modellspezifische Sperren überwachen und Modelle über die Benutzeroberfläche manuell wieder aktivieren
- 🔒 Dynamische Erkennung von Linux-Zertifikaten für MITM — funktioniert unter Debian/Ubuntu, Fedora/RHEL, Arch und anderen Distributionen
- 💻 CLI-Erweiterungspaket — mehr als 20 Befehle, darunter
omniroute providers,omniroute combos,omniroute doctor,omniroute setup - 🔍 Erkennung von Qdrant-Einbettungsmodellen — automatische Ermittlung des Vektorspeichermodells
- 🔑 API-Schlüssel / Bearer-Schlüssel mit
manage-Berechtigungsumfang — administrative Vorgänge programmgesteuert über die API ausführen - 🏥 Integritätsanalysen für Kombinationsziele + strukturierter Kombinationsersteller — Integrität pro Ziel und ein UI-Editor zum Zusammenstellen von Schritten des Typs
(provider, model, connection) - 🤝 GitLab Duo-OAuth-Anbieter — Anmeldung mit GitLab-Anmeldedaten
- 🧠 Reasoning Replay Cache — hybride Persistenz von Reasoning-Traces im Arbeitsspeicher und in SQLite
📚 Zugehörige Dokumentation: Skills-Framework · Speichersystem · Cloud-Agenten · Webhooks · Reasoning Replay Cache
🔌 Anbieter
Abschnitt betitelt „🔌 Anbieter“Verwalte Verbindungen zu KI-Anbietern: OAuth-Anbieter (Claude Code, Codex), API-Schlüssel-Anbieter (Groq, DeepSeek, OpenRouter) und kostenlose Anbieter (Qoder, Kiro). Kiro-Konten umfassen eine Nachverfolgung des Guthabens — verbleibende Credits, Gesamtguthaben und Verlängerungsdatum sind unter Dashboard → Nutzung sichtbar.
OpenRouter-Verbindungen können in den erweiterten Einstellungen pro Verbindung ein preset speichern. Wenn es festgelegt ist, sendet OmniRoute dieses als OpenRouter-Anforderungsfeld auf oberster Ebene, zum Beispiel "preset": "email-copywriter", sofern die Client-Anfrage nicht bereits ein eigenes preset enthält.

🎨 Kombinationen
Abschnitt betitelt „🎨 Kombinationen“Erstelle Modell-Routing-Kombinationen mit 19 öffentlichen Strategien: priority, weighted, round-robin, context-relay, fill-first, p2c (Auswahl aus zwei Optionen), random, least-used, cost-optimized, reset-aware, reset-window, headroom, strict-random, auto, lkgp (zuletzt funktionierender Anbieter), context-optimized, cache-optimized, fusion (Anfragen werden parallel an eine Gruppe von Modellen verteilt und anschließend wird über ein Bewertungsmodell eine einzelne Antwort synthetisiert) und pipeline. Jede Kombination verkettet mehrere Modelle mit automatischem Fallback und umfasst Schnellvorlagen sowie Bereitschaftsprüfungen.
Aktuelle Verbesserungen bei Kombinationen:
- Strukturierter Kombinations-Builder — erstelle jeden Schritt durch Auswahl von Anbieter, Modell und genauem Konto bzw. genauer Verbindung
- Unterstützung wiederholter Anbieter — verwende denselben Anbieter mehrfach innerhalb einer Kombination, solange das Tupel
(provider, model, connection)eindeutig ist - Zustand von Kombinationszielen — Analyse- und Zustandsansichten unterscheiden jetzt einzelne Kombinationsziele bzw. -schritte, anstatt alles zu Modellzeichenfolgen zusammenzufassen
- Zusammengesetzte Ebenenreihenfolge —
defaultTier -> fallbackTierbeeinflusst jetzt die Ausführungs- und Fallback-Reihenfolge zur Laufzeit für Kombinationsschritte der obersten Ebene - System-Prompt-Vorlagen —
system_messageeiner Kombination unterstützt serverseitige Platzhalter vom Typ{{MODEL_ID}},{{PROVIDER_ID}},{{ACCOUNT}}und{{FINGERPRINT}}, die unmittelbar vor dem Versand anhand des tatsächlich ausgewählten Ziels ersetzt werden. Sie sind auf einer Zulassungsliste definiert und nicht rekursiv; unbekannte Platzhalter bleiben unverändert; leere Werte werden durch leere Inhalte ersetzt; System-Prompts des Clients werden niemals umgeschrieben.{{FINGERPRINT}}wird nur bei Fingerprint-basierten kostenlosen Anbietern mit einem angehefteten oder automatisch rotierenden Fingerprint aufgelöst — andernfalls wird es durch einen leeren Inhalt ersetzt (z. B. bei Verbindungen mit einem einzelnen Fingerprint oder Anbietern ohne Fingerprint-Unterstützung). Die Ersetzung wird in der standardmäßigen Versand-Schleife, bei round-robin und in angehefteten Kontext-Cache-Sitzungen durchgeführt; die Strategien fusion, chaos, pipeline und nested-execute ersetzen Platzhalter derzeit noch nicht.

📊 Analysen
Abschnitt betitelt „📊 Analysen“Umfassende Nutzungsanalysen mit Token-Verbrauch, Kostenschätzungen, Aktivitäts-Heatmaps, Diagrammen zur wöchentlichen Verteilung und Aufschlüsselungen nach Anbieter.

🏥 Systemzustand
Abschnitt betitelt „🏥 Systemzustand“Echtzeitüberwachung: Betriebszeit, Arbeitsspeicher, Version, Latenzperzentile (p50/p95/p99), Cache-Statistiken, Zustände der Provider-Circuit-Breaker, aktive Sitzungen mit Kontingentüberwachung und Zustand der Kombinationsziele.

🔧 Übersetzungs-Playground
Abschnitt betitelt „🔧 Übersetzungs-Playground“Vier Modi zum Debuggen von API-Übersetzungen: Playground (Formatkonverter), Chat-Tester (Live-Anfragen), Testumgebung (Batch-Tests) und Live-Monitor (Echtzeit-Stream).

🎮 Modell-Playground (v2.0.9+)
Abschnitt betitelt „🎮 Modell-Playground (v2.0.9+)“Testen Sie jedes Modell direkt über das Dashboard. Wählen Sie Anbieter, Modell und Endpunkt aus, verfassen Sie Prompts mit dem Monaco Editor, streamen Sie Antworten in Echtzeit, brechen Sie sie während des Streams ab und sehen Sie sich Zeitmesswerte an.
🎨 Designs (v2.0.5+)
Abschnitt betitelt „🎨 Designs (v2.0.5+)“Anpassbare Farbschemata für das gesamte Dashboard. Wählen Sie aus 7 voreingestellten Farben (Koralle, Blau, Rot, Grün, Violett, Orange, Cyan) oder erstellen Sie ein benutzerdefiniertes Design, indem Sie eine beliebige Hex-Farbe auswählen. Unterstützt den hellen, dunklen und Systemmodus.
⚙️ Einstellungen
Abschnitt betitelt „⚙️ Einstellungen“Umfassender Einstellungsbereich mit 7 Registerkarten:
- Allgemein — Systemspeicher, Sicherungsverwaltung (Datenbank exportieren/importieren)
- Erscheinungsbild — Designauswahl (dunkel/hell/System), Farbschemavoreinstellungen und benutzerdefinierte Farben, Sichtbarkeit des Zustandsprotokolls, Steuerelemente für die Sichtbarkeit von Seitenleistenelementen und Gruppentrennzeichen, Steuerelemente für die Sichtbarkeit von Endpunkt-Tunneln
- KI — Funktionen des KI-Assistenten, standardmäßige Routing-Voreinstellungen (Auto Combo
auto/coding,auto/fast,auto/cheap,auto/smart), Cache für die Wiedergabe von Schlussfolgerungen sowie Schalter für Fähigkeiten und Speicher - Sicherheit — Schutz von API-Endpunkten, Blockieren benutzerdefinierter Anbieter, IP-Filterung, Sitzungsinformationen
- Routing — Modellaliase, Herabstufung von Hintergrundaufgaben, manifestbezogenes Stufen-Routing (W1–W4),
fallbackDelayMs, sitzungsbezogenes Sticky-Routing - Ausfallsicherheit — Persistenz von Ratenbegrenzungen, Feinabstimmung des Leistungsschalters, automatisches Deaktivieren gesperrter Konten, Überwachung des Ablaufdatums von Anbietern, Übergabeschwellenwert für Context Relay und Konfiguration des Zusammenfassungsmodells, anbieterspezifische 429-Klassifizierung und Schalter
useUpstream429BreakerHints, Modell-Abklingzeiten - Erweitert — Konfigurationsüberschreibungen, Konfigurationsprüfpfad, Fallback-Herabstufungsmodus, Herabstufung des Hintergrundmodus für die Responses API

🔧 CLI-Werkzeuge
Abschnitt betitelt „🔧 CLI-Werkzeuge“Ein-Klick-Konfiguration für KI-Programmierwerkzeuge: Claude Code, Codex CLI, OpenClaw, Kilo Code, Antigravity, Cline, Continue, Cursor und Factory Droid. Bietet automatisiertes Anwenden und Zurücksetzen der Konfiguration, Verbindungsprofile und Modellzuordnungen.

🤖 CLI-Agenten (v2.0.11+)
Abschnitt betitelt „🤖 CLI-Agenten (v2.0.11+)“Dashboard zum Erkennen und Verwalten von CLI-Agenten. Zeigt ein Raster mit 16 integrierten Agenten (Codex, Claude, Goose, OpenClaw, Aider, OpenCode, Cline, ForgeCode, Amazon Q, Open Interpreter, Cursor CLI, Warp, Windsurf, Devin CLI, Kimi Coding, Command Code) mit:
- Installationsstatus — Installiert / Nicht gefunden mit Versionserkennung
- Protokollkennzeichnungen — stdio, HTTP usw.
- Benutzerdefinierte Agenten — Registrieren Sie jedes beliebige CLI-Werkzeug über ein Formular (Name, Binärdatei, Versionsbefehl, Startargumente)
- CLI-Fingerabdruckabgleich — Anbieterspezifischer Schalter zum Abgleichen nativer CLI-Anfragesignaturen, wodurch das Sperrrisiko reduziert und gleichzeitig die Proxy-IP beibehalten wird
- Lokale Devin-Authentifizierung — Devin CLI verwendet
devin auth login; es ist kein browserbasierter OAuth-Ablauf erforderlich
🔗 Kontextweitergabe (v3.5.5+)
Abschnitt betitelt „🔗 Kontextweitergabe (v3.5.5+)“Eine Kombinationsstrategie, die die Sitzungskontinuität bewahrt, wenn während einer Unterhaltung ein Kontowechsel stattfindet. Bevor das aktive Konto ausgeschöpft ist, erstellt OmniRoute im Hintergrund eine strukturierte Übergabezusammenfassung. Nachdem die nächste Anfrage einem anderen Konto zugeordnet wurde, wird die Zusammenfassung als Systemnachricht eingefügt, sodass das neue Konto mit vollständigem Kontext fortfährt.
Konfigurierbar über Einstellungen auf Kombinations- oder globaler Ebene:
- Übergabeschwellenwert — Prozentsatz der Kontingentnutzung, der die Erstellung der Zusammenfassung auslöst (Standard: 85 %)
- Maximale Nachrichtenanzahl für die Zusammenfassung — Umfang des zu komprimierenden jüngsten Verlaufs
- Zusammenfassungsmodell — Optionales alternatives Modell zur Erstellung der Übergabezusammenfassung
Unterstützt derzeit die Rotation von Codex-Konten. Siehe Dokumentation zur Kontextweitergabe.
🗜️ Prompt-Komprimierung (v3.7.9+)
Abschnitt betitelt „🗜️ Prompt-Komprimierung (v3.7.9+)“Kontext & Cache bietet jetzt eigene Seiten für Caveman, RTK und Komprimierungskombinationen:
- Caveman — sprachspezifische Regelpakete, Vorschau, Steuerelemente für den Ausgabemodus und Analysen
- RTK — befehlsbezogene Komprimierung für Shell-, git-, Test-, Build-, Paket-, Docker-, Infrastruktur-, JSON- und Stacktrace-Ausgaben
- Komprimierungskombinationen — benannte Pipelines wie
rtk -> caveman, die Routing-Kombinationen zugewiesen werden; die standardmäßige gestapelte Berechnung erreicht durchschnittlich~89%und Einsparungen von78-95%beim geeigneten Kontext, wenn beide Engines angewendet werden - Wiederherstellung der Rohausgabe — optionale, bereinigte RTK-Verweise auf Rohausgaben zur Fehlerbehebung bei komprimierten Fehlschlägen
Siehe Komprimierungsleitfaden, RTK-Komprimierung und Komprimierungs-Engines.
🛡️ Proxy-Härtung (v3.5.5+)
Abschnitt betitelt „🛡️ Proxy-Härtung (v3.5.5+)“Umfassende Durchsetzung der Proxy-Konfiguration in der gesamten Anfragepipeline:
- Token-Zustandsprüfung — Die OAuth-Aktualisierung im Hintergrund ermittelt nun die Proxy-Konfiguration pro Verbindung und verhindert so Fehler in Umgebungen, die einen Proxy erfordern
- API-Schlüsselvalidierung — Die Validierung von Anbieterschlüsseln (
POST /api/providers/validate) wird überrunWithProxyContextgeleitet und berücksichtigt Proxy-Einstellungen auf Anbieter- und globaler Ebene - Korrektur des undici-Dispatchers — Proxy-Dispatcher verwenden die undici-eigene Fetch-Implementierung anstelle der integrierten Fetch-Implementierung von Node und beheben dadurch
invalid onRequestStart method-Fehler unter Node.js 22 - Erkennung der Node.js-Version — Die Anmeldeseite erkennt inkompatible Node.js-Versionen (24+) proaktiv und zeigt ein Warnbanner mit Anweisungen zur Verwendung von Node 22 LTS an
📧 Maskierung von E-Mail-Adressen (v3.5.6+)
Abschnitt betitelt „📧 Maskierung von E-Mail-Adressen (v3.5.6+)“E-Mail-Adressen von OAuth-Konten werden standardmäßig maskiert (z. B. di*****@g****.com), um eine versehentliche Offenlegung beim Teilen von Screenshots oder Aufzeichnen von Demos zu verhindern. Verwenden Sie Einstellungen → Darstellung → Sichtbarkeit der Konto-E-Mail-Adresse, um vollständige Konto-E-Mail-Adressen global für Anbieter-, Kombinations-, Protokoll-, Kontingent- und Playground-Ansichten ein- oder auszublenden.
👁️ Umschalter für die Modellsichtbarkeit (v3.5.6+)
Abschnitt betitelt „👁️ Umschalter für die Modellsichtbarkeit (v3.5.6+)“Die Modellliste auf der Anbieterseite enthält jetzt:
- Such-/Filterleiste in Echtzeit — Bestimmte Modelle schnell finden
- Sichtbarkeitsumschalter pro Modell (👁-Symbol) — Ausgeblendete Modelle werden ausgegraut und aus dem
/v1/models-Katalog ausgeschlossen - Badge für die Anzahl aktiver Modelle (
N/M aktiv) — Zeigt auf einen Blick, wie viele Modelle im Verhältnis zur Gesamtzahl aktiviert sind
🔧 OAuth-Umgebungsreparatur (v3.6.1+)
Abschnitt betitelt „🔧 OAuth-Umgebungsreparatur (v3.6.1+)“Ein-Klick-Aktion „Umgebung reparieren“ für OAuth-Anbieter, die fehlende Umgebungsvariablen wiederherstellt und einen fehlerhaften Authentifizierungsstatus behebt. Erreichbar über Dashboard → Anbieter → [OAuth-Anbieter] → Umgebung reparieren. Erkennt und repariert automatisch:
- Fehlende OAuth-Client-Anmeldedaten
- Beschädigte Einträge in der Umgebungsdatei
- Bereinigung des Sicherungspfads
🗑️ Deinstallation / vollständige Deinstallation (v3.6.2+)
Abschnitt betitelt „🗑️ Deinstallation / vollständige Deinstallation (v3.6.2+)“Skripte zur sauberen Entfernung für alle Installationsmethoden:
| Befehl | Aktion |
|---|---|
npm run uninstall |
Entfernt die System-App, behält jedoch Ihre Datenbank und Konfigurationen in ~/.omniroute. |
npm run uninstall:full |
Entfernt die App UND löscht dauerhaft alle Konfigurationen, Schlüssel und Datenbanken. |
🖼️ Medien (v2.0.3+)
Abschnitt betitelt „🖼️ Medien (v2.0.3+)“Erzeugen Sie Bilder, Videos und Musik über das Dashboard. Unterstützt OpenAI, xAI, Together, Hyperbolic, SD WebUI, ComfyUI, AnimateDiff, Stable Audio Open und MusicGen.
📝 Anforderungsprotokolle
Abschnitt betitelt „📝 Anforderungsprotokolle“Echtzeitprotokollierung von Anforderungen mit Filterung nach Anbieter, Modell, Konto und API-Schlüssel. Zeigt Statuscodes, Token-Nutzung, Latenz und Antwortdetails an.

🌐 API-Endpunkt
Abschnitt betitelt „🌐 API-Endpunkt“Ihr einheitlicher API-Endpunkt mit einer Aufschlüsselung der Funktionen: Chat Completions, Responses API, Embeddings, Bilderzeugung, Reranking, Audiotranskription, Text-to-Speech, Moderationen und registrierte API-Schlüssel. Für den Remotezugriff werden Cloudflare Quick Tunnel, Tailscale Funnel, ngrok Tunnel und Cloud-Proxy-Unterstützung angeboten.

🔑 API-Schlüsselverwaltung
Abschnitt betitelt „🔑 API-Schlüsselverwaltung“Erstellen, beschränken und widerrufen Sie API-Schlüssel. Jeder Schlüssel kann mit Vollzugriff oder schreibgeschützten Berechtigungen auf bestimmte Modelle/Anbieter beschränkt werden. Visuelle Schlüsselverwaltung mit Nutzungsverfolgung.
📋 Audit-Protokoll
Abschnitt betitelt „📋 Audit-Protokoll“Verfolgung administrativer Aktionen mit Filterung nach Aktionstyp, Akteur, Ziel, IP-Adresse und Zeitstempel. Vollständiger Verlauf der Sicherheitsereignisse.
🖥️ Desktop-Anwendung
Abschnitt betitelt „🖥️ Desktop-Anwendung“Native Electron-Desktop-App für Windows, macOS und Linux. Führen Sie OmniRoute als eigenständige Anwendung mit Systemleistenintegration, Offline-Unterstützung, automatischen Updates und Ein-Klick-Installation aus.
Hauptfunktionen:
- Abfrage der Serverbereitschaft (kein leerer Bildschirm bei einem Kaltstart)
- Systemleiste mit Portverwaltung
- Content Security Policy
- Sperre für eine einzelne Instanz
- Automatisches Update beim Neustart
- Plattformspezifische Benutzeroberfläche (macOS-Ampelknöpfe, standardmäßige Titelleiste unter Windows/Linux)
- Gehärtete Electron-Build-Paketierung — symbolisch verknüpfte
node_modulesim eigenständigen Bundle werden vor der Paketierung erkannt und abgelehnt, wodurch eine Laufzeitabhängigkeit von der Build-Maschine verhindert wird (v2.5.5+) - Kontrolliertes Herunterfahren — Electron
before-quitfährt Next.js ordnungsgemäß herunter und verhindert dadurch SQLite-WAL-Datenbanksperren (v3.6.2+)
📖 Die vollständige Dokumentation finden Sie unter electron/README.md.
🌐 V1-WebSocket-Bridge (v3.6.6+)
Abschnitt betitelt „🌐 V1-WebSocket-Bridge (v3.6.6+)“OmniRoute unterstützt jetzt OpenAI-kompatible WebSocket-Clients über den Upgrade-Endpunkt /v1/ws. Der benutzerdefinierte Server scripts/dev/v1-ws-bridge.mjs umschließt Next.js und aktualisiert WS-Verbindungen zu vollständig bidirektionalen Streaming-Sitzungen. Die Authentifizierung verwendet denselben API-Schlüssel oder dasselbe Sitzungscookie wie HTTP-Anforderungen.
Wichtige Verhaltensweisen:
- Das WS-Upgrade wird von
src/lib/ws/handshake.tsvalidiert, bevor die Verbindung hergestellt wird - Streams werden beim Schließen der Sitzung oder bei einem Upstream-Fehler ordnungsgemäß beendet
- Funktioniert gleichzeitig neben dem bestehenden HTTP+SSE-Streaming-Pfad
🔑 Sync-Tokens & Konfigurationspaket (v3.6.6+)
Abschnitt betitelt „🔑 Sync-Tokens & Konfigurationspaket (v3.6.6+)“Der Zugriff über mehrere Geräte und durch externe Betreiber ist jetzt über bereichsgebundene Sync-Tokens möglich:
POST /api/sync/tokens— Stellt ein neues Sync-Token aus (bereichsgebunden, mit optionalem Ablaufdatum)DELETE /api/sync/tokens/:id— Widerruft ein TokenGET /api/sync/bundle— Lädt einen versionierten, über ETag identifizierten JSON-Snapshot aller nicht vertraulichen Einstellungen herunter (Passwörter werden unkenntlich gemacht)
Das Konfigurationspaket wird von src/lib/sync/bundle.ts erstellt. Clients vergleichen den ETag-Antwortheader, um Änderungen zu erkennen, ohne die vollständigen Nutzdaten erneut herunterzuladen.
🧠 GLM-Thinking-Voreinstellung (v3.6.6+)
Abschnitt betitelt „🧠 GLM-Thinking-Voreinstellung (v3.6.6+)“GLM Thinking (glmt) ist jetzt als vollwertiger Provider registriert: maximal 65 536 Ausgabe-Tokens, ein Thinking-Budget von 24 576, ein Standard-Timeout von 900 s, ein Claude-kompatibles API-Format und eine gemeinsame Nutzungssynchronisierung mit der GLM-Familie.
Mit v3.6.6 wird außerdem die hybride Token-Zählung eingeführt: Wenn ein Claude-kompatibler Provider /messages/count_tokens bereitstellt, ruft OmniRoute diesen Endpunkt vor großen Anfragen auf und greift bei Bedarf zuverlässig auf eine Schätzung zurück.
🛡️ Sicherer ausgehender Abruf & SSRF-Schutz (v3.6.6+)
Abschnitt betitelt „🛡️ Sicherer ausgehender Abruf & SSRF-Schutz (v3.6.6+)“Alle Aufrufe zur Provider-Validierung und Modellerkennung durchlaufen jetzt einen zweistufigen Schutz für ausgehende Verbindungen:
- URL-Schutz (
src/shared/network/outboundUrlGuard.ts) — Blockiert private, Loopback- und linklokale IP-Bereiche, bevor der Socket geöffnet wird. - Wrapper für sichere Abrufe (
src/shared/network/safeOutboundFetch.ts) — Wendet den URL-Schutz an, vereinheitlicht Timeouts und wiederholt Anfragen bei vorübergehenden Fehlern mit exponentiellem Backoff.
Schutzverletzungen werden als HTTP 422 (URL_GUARD_BLOCKED) ausgegeben und über providerAudit.ts in das Compliance-Auditprotokoll geschrieben.
🔄 Cooldown-bewusste Wiederholungsversuche (v3.6.6+)
Abschnitt betitelt „🔄 Cooldown-bewusste Wiederholungsversuche (v3.6.6+)“Chat-Anfragen werden jetzt automatisch wiederholt, wenn ein vorgelagerter Provider einen modellspezifischen Cooldown zurückgibt. Dies ist über REQUEST_RETRY (Standard: 2) und MAX_RETRY_INTERVAL_SEC (Standard: 30 s) konfigurierbar. Die Auswertung von Rate-Limit-Headern wurde für x-ratelimit-reset-requests, x-ratelimit-reset-tokens und Retry-After verbessert — der modellspezifische Cooldown-Status ist im Resilience-Dashboard sichtbar.
📋 Compliance-Audit v2 (v3.6.6+)
Abschnitt betitelt „📋 Compliance-Audit v2 (v3.6.6+)“Das Auditprotokoll wurde um Cursor-basierte Paginierung, eine Anreicherung des Anfragekontexts (Anfrage-ID, User-Agent, IP), strukturierte Authentifizierungsereignisse, Provider-CRUD-Ereignisse mit Änderungskontext sowie die Protokollierung von durch den SSRF-Schutz blockierten Validierungen erweitert. Neue Ereignisse werden von src/lib/compliance/providerAudit.ts ausgegeben.
HagiCode
HagiCode ist ein agentischer Coding-Arbeitsplatz mit strukturierten Workflows, Multi-Agent-Ausführung und Hero-Dungeon-Ansichten.
Mit einem intelligenteren, schnelleren und unterhaltsameren agentischen Workflow wird aus Ideen nutzbare Software.

- SmartStrukturierte Workflows machen aus Absichten einen umsetzbaren Weg von der Idee bis zur Auslieferung.
- EfficientMulti-Agent-Workflows führen Recherche, Umsetzung und Prüfung parallel aus.
- FunHero Dungeon macht lange Coding-Sitzungen anschaulich und gemeinschaftlich.