Zum Inhalt springen
OmniRoute source

Providers Guide: Connect AI Models to OmniRoute (Deutsch)

Stellen Sie sich einen Anbieter wie einen Mobilfunkanbieter vor. So wie Sie zum Telefonieren einen Mobilfunkanbieter benötigen, brauchen Sie einen KI-Anbieter, um KI-Modelle zu verwenden. OmniRoute ist wie ein Telefon, das mit allen Anbietern funktioniert — Sie können automatisch zwischen ihnen wechseln.

Typ Beschreibung Beispiele Kosten
Kostenlos Keine Zahlung erforderlich Kiro, OpenCode Free, Pollinations $0
API-Schlüssel Sie benötigen einen API-Schlüssel OpenAI, Anthropic, Google Nutzungsabhängige Abrechnung
OAuth Anmeldung mit Ihrem Konto Claude Code, GitHub Copilot Abonnement
Web-Cookie Verwendet Ihre Browsersitzung ChatGPT Web (Codex), Gemini Web $0 (verwendet Ihr Konto)
Abschnitt betitelt „Allgemeine Einrichtungsanweisungen, Einschränkungen, Informationen zur Fehlerbehebung und anbieterspezifische Authentifizierungshinweise finden Sie unter WEB-COOKIE-GUIDE.md.“

Optionale Einrichtung kostenloser Anbieter beim ersten Start

Abschnitt betitelt „Optionale Einrichtung kostenloser Anbieter beim ersten Start“

Der Assistent für den ersten Start bietet eine eigene Karte Kostenlose Anbieter einrichten. Er ermittelt die aktuelle Liste geeigneter Anbieter aus der Registrierung von OmniRoute für Anbieter ohne Authentifizierung und ermöglicht Ihnen anschließend, jeden Anbieter vor der Bestätigung zu prüfen und abzuwählen. OmniRoute zeigt den Warnhinweis des Anbieters sowie einen Link zu dessen Website an, damit Sie zunächst die Bedingungen, Datenschutzbestimmungen, Verfügbarkeit und Ratenbegrenzungen des Drittanbieters prüfen können.

Diese Aktion ist optional: Beim Abschließen des Assistenten werden niemals unbemerkt Verbindungen zu kostenlosen Anbietern erstellt. Es werden nur noch fehlende Anbieter erstellt, bereits vorhandene angepasste Verbindungen bleiben unverändert, und erstellte, bereits konfigurierte sowie fehlgeschlagene Anbieter werden einzeln aufgeführt. Nach einem Teilergebnis können Sie bedenkenlos nur die fehlgeschlagenen Vorgänge erneut versuchen.

Option A: Kostenloser Anbieter (keine Kreditkarte)

Abschnitt betitelt „Option A: Kostenloser Anbieter (keine Kreditkarte)“
  1. Öffnen Sie das Dashboard unter http://localhost:20128
  2. Gehen Sie zu Anbieter → Anbieter hinzufügen
  3. Wählen Sie einen dieser kostenlosen Anbieter aus:
    • Kiro AI — Kostenlose Claude-Modelle (keine Authentifizierung erforderlich)
    • OpenCode Free — Kostenlose GPT-Modelle (keine Authentifizierung erforderlich)
    • Pollinations — Kostenloses GPT-5, Claude und Gemini (kein Schlüssel erforderlich)
    • LongCat — 10 Mio. kostenlose Token (einmalige Gutschrift, Konto und KYC erforderlich)
    • Cloudflare AI — Mehr als 50 Modelle, 10.000 Neuronen/Tag
    • MLX Gemma 26B — Lokales Apple-Silicon-Modell (~38,5 Token/s, ~15,9 GB RAM)
    • MLX Qwen 3.8 27B — Lokales Apple-Silicon-Modell (~9,1 Token/s, ~13,1 GB RAM)
  4. Klicken Sie auf Verbinden
  5. Fertig! Sie haben jetzt kostenlosen KI-Zugriff.

Option B: Anbieter mit API-Schlüssel (kostenpflichtig)

Abschnitt betitelt „Option B: Anbieter mit API-Schlüssel (kostenpflichtig)“
  1. Beziehen Sie einen API-Schlüssel von der Website des Anbieters:
  2. Öffnen Sie das Dashboard unter http://localhost:20128
  3. Gehen Sie zu Anbieter → Anbieter hinzufügen
  4. Wählen Sie Ihren Anbieter aus
  5. Fügen Sie Ihren API-Schlüssel ein
  6. Klicken Sie auf Verbinden
  7. Fertig! Sie haben jetzt Zugriff auf die Modelle dieses Anbieters.
  1. Öffnen Sie das Dashboard unter http://localhost:20128
  2. Gehen Sie zu Anbieter → Anbieter hinzufügen
  3. Wählen Sie Ihren Anbieter aus (z. B. Claude Code oder GitHub Copilot)
  4. Klicken Sie auf Mit OAuth verbinden
  5. Melden Sie sich mit Ihrem Konto an
  6. Fertig! Sie haben jetzt Zugriff auf die in Ihrem Abonnement enthaltenen Modelle.

Für Apple-Silicon-Macs mit gemeinsamem Arbeitsspeicher unterstützt OmniRoute die Verbindung zu lokalen MLX-Modellen, die über mlx-lm.server ausgeführt werden, als reguläre OpenAI-kompatible lokale Anbieter.

  • Apple-Silicon-Mac (M1/M2/M3/M4) mit mindestens 24 GB gemeinsamem Arbeitsspeicher empfohlen
  • uv-Paketmanager: curl -LsSf https://astral.sh/uv/install.sh | sh
  • mlx-lm: uv pip install mlx-lm
  1. Abhängigkeiten installieren:

    Terminal-Fenster
    # uv installieren, falls noch nicht installiert
    curl -LsSf https://astral.sh/uv/install.sh | sh
    # mlx-lm installieren
    uv pip install mlx-lm
  2. MLX-Server manuell starten (in separaten Terminals):

    Terminal-Fenster
    # Terminal 1: Gemma 4 26B A4B IT-QAT (Port 11435)
    uv run mlx_lm.server --model mlx-community/gemma-4-26B-A4B-it-qat-q4_0-mlx-aligned --port 11435 --host 127.0.0.1
    # Terminal 2: Qwen 3.8 27B MLX Mixed (Port 11436)
    uv run mlx_lm.server --model maglun/Qwen3.8-27B-MLX-Mixed-3.80bpw --port 11436 --host 127.0.0.1
  3. Im OmniRoute-Dashboard verbinden:

    • Gehen Sie zu Anbieter → Anbieter hinzufügen
    • Wählen Sie MLX Gemma 26B oder MLX Qwen 3.8 27B
    • Klicken Sie auf Verbinden (kein API-Schlüssel erforderlich)
  4. Mit OpenCode verwenden:

    Terminal-Fenster
    # OpenCode für die Verwendung von OmniRoute konfigurieren
    opencode config set api.base_url http://localhost:20128/v1
    opencode config set api.key <your-omniroute-api-key>
    # MLX-Modelle verwenden
    opencode run --model mlx-gemma/gemma-4-26b
    opencode run --model mlx-qwen/qwen3.8-27b

Wichtig: Bei 24 GB gemeinsamem Arbeitsspeicher kann jeweils nur ein großes MLX-Modell gleichzeitig ausgeführt werden.

  • Gemma 26B: ~15,9 GB maximaler Speicherbedarf
  • Qwen 3.8 27B: ~13,1 GB maximaler Speicherbedarf

Sie müssen dies manuell verwalten:

  • Führen Sie jeweils nur einen MLX-Server aus oder
  • führen Sie beide auf separaten Rechnern aus oder
  • stoppen Sie einen, bevor Sie den anderen starten

OmniRoute verwaltet MLX-Serverprozesse nicht automatisch — es leitet lediglich Anfragen an die von Ihnen konfigurierten OpenAI-kompatiblen Endpunkte weiter.

Beide Modelle unterstützen OpenAI-kompatible Tool-Aufrufe. Testen Sie dies mit:

Terminal-Fenster
curl -X POST http://localhost:20128/v1/chat/completions \
-H "Authorization: Bearer <key>" \
-H "Content-Type: application/json" \
-d '{
"model": "mlx-gemma/gemma-4-26b",
"messages": [{"role": "user", "content": "Was ist 2+2? Verwende das Taschenrechner-Tool."}],
"tools": [{"type": "function", "function": {"name": "calculator", "description": "Berechnen", "parameters": {"type": "object", "properties": {"expression": {"type": "string"}}, "required": ["expression"]}}}]
}'
Problem Lösung
Server startet nicht uv run mlx_lm.server --help prüfen und Modell-IDs überprüfen
Nicht genügend Speicher Sicherstellen, dass nur ein Modell ausgeführt wird; andere Apps schließen; Aktivitätsanzeige prüfen
Verbindung abgelehnt Überprüfen, ob der Server am richtigen Port (11435/11436) ausgeführt wird
Langsame Antworten Bei der ersten Anfrage wird das Modell in den Speicher geladen (~30–60 s); nachfolgende Anfragen sind schnell
Tool-Aufruf schlägt fehl Sicherstellen, dass das Modell Tools unterstützt; OmniRoute-Protokolle auf Übersetzungsfehler prüfen

Diese Anbieter bieten kostenlosen Zugang ohne Kreditkarte:

Anbieter Kostenloses Kontingent Modelle Verbindungsherstellung
Kiro AI 50 Credits/Monat Claude Sonnet 4.5, Haiku 4.5, Opus 4.6 Keine Authentifizierung erforderlich
OpenCode Free Unbegrenzt GPT-4o, Claude, Gemini Keine Authentifizierung erforderlich
Pollinations Kein Schlüssel erforderlich GPT-5, Claude, Gemini, DeepSeek, Llama 4 Keine Authentifizierung erforderlich
LongCat Einmalig 10 Mio. LongCat-2.0 API-Schlüssel + KYC
Cloudflare AI 10.000 Neuronen/Tag Über 50 Modelle Keine Authentifizierung erforderlich
NVIDIA NIM ~40 RPM 129 Modelle API-Schlüssel erforderlich
Cerebras $5 Startguthaben GLM 4.7, GPT-OSS 120B API-Schlüssel + Karte
Qoder Unbegrenzt Kimi-K2, DeepSeek-R1, Qwen3-coder Keine Authentifizierung erforderlich

Tipp: Verbinden Sie mehrere kostenlose Anbieter, um unbegrenzt kostenlose KI mit automatischem Fallback zu nutzen!


Diese Anbieter bieten hochwertige Modelle mit API-Schlüsseln:

Anbieter Beste Modelle Kosten Kostenloses Kontingent
OpenAI GPT-5, GPT-4o $2.50-$10/1 Mio. Tokens $5 kostenloses Guthaben
Anthropic Claude Opus 4.6, Sonnet 4.6 $3-$15/1 Mio. Tokens $5 kostenloses Guthaben
Google Gemini 2.5 Pro, Flash $0.075-$1.25/1 Mio. Tokens 1.500 Anfragen/Tag kostenlos
DeepSeek DeepSeek V4 $0.14-$0.28/1 Mio. Tokens 5 Mio. kostenlose Tokens
Groq Llama 4, Mixtral $0.05-$0.27/1 Mio. Tokens 30 RPM kostenlos
xAI Grok 3 $0.30-$0.60/1 Mio. Tokens —

Rufen Sie in Ihrem Browser http://localhost:20128 auf.

Klicken Sie in der Seitenleiste auf Anbieter.

Klicken Sie auf die Schaltfläche + Anbieter hinzufügen.

Durchsuchen Sie die Liste oder suchen Sie nach Ihrem Anbieter. Klicken Sie darauf.

  • Kostenlose Anbieter: Keine Zugangsdaten erforderlich — klicken Sie einfach auf Verbinden
  • Anbieter mit API-Schlüssel: Fügen Sie Ihren API-Schlüssel ein
  • OAuth-Anbieter: Klicken Sie auf Mit OAuth verbinden und melden Sie sich an

Klicken Sie auf Verbindung testen, um zu überprüfen, ob sie funktioniert.

Ihr Anbieter ist jetzt verbunden. Sie können ihn mit model: "auto" verwenden oder den Anbieter direkt angeben.


OmniRoute funktioniert am besten mit mehreren Anbietern. Dies bietet Ihnen:

  • Automatisches Fallback — Wenn ein Anbieter ausfällt, versucht OmniRoute den nächsten
  • Kostenoptimierung — OmniRoute wählt für jede Anfrage den günstigsten Anbieter
  • Geschwindigkeitsoptimierung — OmniRoute wählt für jede Anfrage den schnellsten Anbieter
  • Qualitätsoptimierung — OmniRoute wählt für jede Aufgabe den besten Anbieter

Verbinden Sie mindestens 3 Anbieter, um die bestmögliche Erfahrung zu erzielen:

  1. Einen kostenlosen Anbieter (Kiro, OpenCode Free oder Pollinations) — Immer verfügbar
  2. Einen schnellen Anbieter (Groq, Cerebras) — Für schnelle Antworten
  3. Einen Qualitätsanbieter (OpenAI, Anthropic, Google) — Für komplexe Aufgaben

Verwenden Sie anschließend model: "auto", und OmniRoute wählt automatisch für jede Anfrage den besten Anbieter aus.


  1. API-Schlüssel abrufen: https://platform.openai.com/api-keys
  2. In OmniRoute: Anbieter → Anbieter hinzufügen → OpenAI
  3. API-Schlüssel einfügen → Verbinden
  1. API-Schlüssel abrufen: https://console.anthropic.com/
  2. In OmniRoute: Anbieter → Anbieter hinzufügen → Anthropic
  3. API-Schlüssel einfügen → Verbinden
  1. API-Schlüssel abrufen: https://aistudio.google.com/apikey
  2. In OmniRoute: Anbieter → Anbieter hinzufügen → Gemini
  3. API-Schlüssel einfügen → Verbinden
  1. API-Schlüssel abrufen: https://platform.deepseek.com/
  2. In OmniRoute: Anbieter → Anbieter hinzufügen → DeepSeek
  3. API-Schlüssel einfügen → Verbinden
  1. API-Schlüssel abrufen: https://console.groq.com/
  2. In OmniRoute: Anbieter → Anbieter hinzufügen → Groq
  3. API-Schlüssel einfügen → Verbinden

„Muss ich für die Nutzung von OmniRoute bezahlen?“

Abschnitt betitelt „„Muss ich für die Nutzung von OmniRoute bezahlen?““

Nein! OmniRoute ist kostenlos und quelloffen. Sie können kostenlose Anbieter (Kiro, OpenCode Free, Pollinations) nutzen, ohne etwas zu bezahlen. Kosten entstehen nur, wenn Sie kostenpflichtige Anbieter verwenden.

Beginnen Sie mit Kiro AI — der Anbieter ist kostenlos, erfordert keinen API-Schlüssel und ermöglicht Ihnen den Zugriff auf Claude-Modelle. Fügen Sie anschließend bei Bedarf weitere Anbieter hinzu.

„Kann ich mehrere Anbieter gleichzeitig nutzen?“

Abschnitt betitelt „„Kann ich mehrere Anbieter gleichzeitig nutzen?““

Ja! Genau das ist der Zweck von OmniRoute. Verbinden Sie mehrere Anbieter und verwenden Sie model: "auto", damit OmniRoute für jede Anfrage den besten auswählt.

OmniRoute überspringt fehlgeschlagene Anbieter automatisch und versucht es mit dem nächsten. Sie müssen nichts tun.

„Wie trenne ich die Verbindung zu einem Anbieter?“

Abschnitt betitelt „„Wie trenne ich die Verbindung zu einem Anbieter?““

Gehen Sie zu Anbieter → klicken Sie auf den Anbieter → klicken Sie auf Verbindung trennen.

„Kann ich meine vorhandenen API-Schlüssel verwenden?“

Abschnitt betitelt „„Kann ich meine vorhandenen API-Schlüssel verwenden?““

Ja! Wenn Sie bereits API-Schlüssel für OpenAI, Anthropic, Google usw. haben, können Sie diese in OmniRoute verwenden. Fügen Sie sie einfach beim Verbinden des Anbieters ein.


Bilder des Cursor-Tarifs verwenden IMAGE_PROVIDERS.cursor (cursor-agent-image). Siehe CURSOR_IMAGE.md.


OmniRoute-Quellcode (a58000c7685f)

HagiCode

HagiCode ist ein agentischer Coding-Arbeitsplatz mit strukturierten Workflows, Multi-Agent-Ausführung und Hero-Dungeon-Ansichten.

Mit einem intelligenteren, schnelleren und unterhaltsameren agentischen Workflow wird aus Ideen nutzbare Software.

HagiCode-Hauptoberfläche im hellen Design
  • SmartStrukturierte Workflows machen aus Absichten einen umsetzbaren Weg von der Idee bis zur Auslieferung.
  • EfficientMulti-Agent-Workflows führen Recherche, Umsetzung und Prüfung parallel aus.
  • FunHero Dungeon macht lange Coding-Sitzungen anschaulich und gemeinschaftlich.
HagiCode besuchen