跳到內容
OmniRoute source

Providers Guide: Connect AI Models to OmniRoute (中文 (繁體))

可以將提供者想像成電信業者。就像你需要電信業者才能撥打電話一樣,你需要 AI 提供者才能使用 AI 模型。OmniRoute 就像一支支援所有電信業者的手機——你可以在提供者之間自動切換。

類型 說明 範例 費用
免費 無須付款 Kiro、OpenCode Free、Pollinations $0
API 金鑰 需要 API 金鑰 OpenAI、Anthropic、Google 按使用量付費
OAuth 使用你的帳戶登入 Claude Code、GitHub Copilot 訂閱制
網頁 Cookie 使用你的瀏覽器工作階段 ChatGPT Web (Codex)、Gemini Web $0(使用你的帳戶)

快速開始:連線你的第一個提供者

Section titled “快速開始:連線你的第一個提供者”

可選的首次執行免費提供者設定

Section titled “可選的首次執行免費提供者設定”

首次執行精靈會提供明確的設定免費提供者卡片。它會根據 OmniRoute 的免驗證提供者登錄資料取得目前 符合條件的清單,接著讓你在確認前檢視並取消選取個別 提供者。OmniRoute 會顯示提供者的注意事項與其網站連結, 讓你能先檢視第三方條款、隱私權、可用性及速率限制。

此操作為選用:完成精靈時,絕不會在未告知的情況下建立免費提供者連線。 它只會建立仍缺少的提供者,不會變更現有的自訂連線, 並會個別回報已建立、已設定及失敗的提供者。若只完成部分設定,你可以 放心地僅重試失敗的項目。

選項 A:免費提供者(不需要信用卡)

Section titled “選項 A:免費提供者(不需要信用卡)”
  1. 在 http://localhost:20128 開啟儀表板
  2. 前往提供者 → 新增提供者
  3. 選取下列其中一個免費提供者:
    • Kiro AI — 免費 Claude 模型(無須驗證)
    • OpenCode Free — 免費 GPT 模型(無須驗證)
    • Pollinations — 免費 GPT-5、Claude、Gemini(無須金鑰)
    • LongCat — 免費 10M 個權杖(一次性額度,需要帳戶及 KYC)
    • Cloudflare AI — 50+ 個模型,每日 10K 個神經元
    • MLX Gemma 26B — 本機 Apple Silicon 模型(約 38.5 tok/s,約 15.9GB RAM)
    • MLX Qwen 3.8 27B — 本機 Apple Silicon 模型(約 9.1 tok/s,約 13.1GB RAM)
  4. 按一下連線
  5. 完成!你現在可以免費使用 AI。

選項 B:API 金鑰提供者(付費)

Section titled “選項 B:API 金鑰提供者(付費)”
  1. 從提供者的網站取得 API 金鑰:
  2. 在 http://localhost:20128 開啟儀表板
  3. 前往提供者 → 新增提供者
  4. 選取你的提供者
  5. 貼上你的 API 金鑰
  6. 按一下連線
  7. 完成!你現在可以使用該提供者的模型。
  1. 在 http://localhost:20128 開啟儀表板
  2. 前往提供者 → 新增提供者
  3. 選取你的提供者(例如 Claude Code、GitHub Copilot)
  4. 按一下使用 OAuth 連線
  5. 使用你的帳戶登入
  6. 完成!你現在可以使用訂閱方案中的模型。

選項 D:本機 MLX 模型(Apple Silicon)

Section titled “選項 D:本機 MLX 模型(Apple Silicon)”

對於配備統一記憶體的 Apple Silicon Mac,OmniRoute 支援將透過 mlx-lm.server 執行的本機 MLX 模型連線為一般的 OpenAI 相容本機提供者。

  • Apple Silicon Mac(M1/M2/M3/M4),建議配備 24GB+ 統一記憶體
  • uv 套件管理器:curl -LsSf https://astral.sh/uv/install.sh | sh
  • mlx-lm:uv pip install mlx-lm
  1. 安裝相依套件:

    Terminal window
    # 若尚未安裝 uv,請先安裝
    curl -LsSf https://astral.sh/uv/install.sh | sh
    # 安裝 mlx-lm
    uv pip install mlx-lm
  2. 手動啟動 MLX 伺服器(在不同的終端機中):

    Terminal window
    # 終端機 1:Gemma 4 26B A4B IT-QAT(連接埠 11435)
    uv run mlx_lm.server --model mlx-community/gemma-4-26B-A4B-it-qat-q4_0-mlx-aligned --port 11435 --host 127.0.0.1
    # 終端機 2:Qwen 3.8 27B MLX Mixed(連接埠 11436)
    uv run mlx_lm.server --model maglun/Qwen3.8-27B-MLX-Mixed-3.80bpw --port 11436 --host 127.0.0.1
  3. 在 OmniRoute 儀表板中連線:

    • 前往提供者 → 新增提供者
    • 選取 MLX Gemma 26B 或 MLX Qwen 3.8 27B
    • 按一下連線(無須 API 金鑰)
  4. 搭配 OpenCode 使用:

    Terminal window
    # 設定 OpenCode 使用 OmniRoute
    opencode config set api.base_url http://localhost:20128/v1
    opencode config set api.key <your-omniroute-api-key>
    # 使用 MLX 模型
    opencode run --model mlx-gemma/gemma-4-26b
    opencode run --model mlx-qwen/qwen3.8-27b

重要:使用 24GB 統一記憶體時,一次只能執行一個大型 MLX 模型。

  • Gemma 26B:約 15.9GB 峰值記憶體
  • Qwen 3.8 27B:約 13.1GB 峰值記憶體

你必須手動管理:

  • 一次僅執行一個 MLX 伺服器,或
  • 在不同的機器上分別執行兩者,或
  • 啟動其中一個之前,先停止另一個

OmniRoute 不會自動管理 MLX 伺服器處理程序——它只會將請求路由至你設定的 OpenAI 相容端點。

這兩個模型皆支援 OpenAI 相容的工具呼叫。可使用以下方式測試:

Terminal window
curl -X POST http://localhost:20128/v1/chat/completions \
-H "Authorization: Bearer <key>" \
-H "Content-Type: application/json" \
-d '{
"model": "mlx-gemma/gemma-4-26b",
"messages": [{"role": "user", "content": "2+2 是多少?請使用計算機工具。"}],
"tools": [{"type": "function", "function": {"name": "calculator", "description": "計算", "parameters": {"type": "object", "properties": {"expression": {"type": "string"}}, "required": ["expression"]}}}]
}'
問題 解決方案
伺服器無法啟動 檢查 uv run mlx_lm.server --help 並確認模型 ID
記憶體不足 確保僅執行一個模型;關閉其他應用程式;檢查「活動監視器」
連線遭拒 確認伺服器正在正確的連接埠(11435/11436)上執行
回應緩慢 第一次請求會將模型載入記憶體(約 30–60 秒);後續請求會很快
工具呼叫失敗 確認模型支援工具;檢查 OmniRoute 日誌中是否有轉譯錯誤

這些提供者提供免費存取,無須信用卡:

提供者 免費額度 模型 連線方式
Kiro AI 每月 50 點額度 Claude Sonnet 4.5, Haiku 4.5, Opus 4.6 無須驗證
OpenCode Free 無限 GPT-4o, Claude, Gemini 無須驗證
Pollinations 無須金鑰 GPT-5, Claude, Gemini, DeepSeek, Llama 4 無須驗證
LongCat 一次性 10M LongCat-2.0 API 金鑰 + KYC
Cloudflare AI 每日 10K 個神經元 50+ 個模型 無須驗證
NVIDIA NIM 約 40 RPM 129 個模型 需要 API 金鑰
Cerebras 註冊贈送 $5 額度 GLM 4.7, GPT-OSS 120B API 金鑰 + 信用卡
Qoder 無限 Kimi-K2, DeepSeek-R1, Qwen3-coder 無須驗證

提示:連接多個免費提供者,即可透過自動容錯移轉享有無限免費 AI!


這些提供者透過 API 金鑰提供高品質模型:

提供者 最佳模型 費用 免費方案
OpenAI GPT-5, GPT-4o 每 1M tokens $2.50-$10 $5 免費額度
Anthropic Claude Opus 4.6, Sonnet 4.6 每 1M tokens $3-$15 $5 免費額度
Google Gemini 2.5 Pro, Flash 每 1M tokens $0.075-$1.25 每日免費 1,500 次請求
DeepSeek DeepSeek V4 每 1M tokens $0.14-$0.28 5M 免費 tokens
Groq Llama 4, Mixtral 每 1M tokens $0.05-$0.27 免費 30 RPM
xAI Grok 3 每 1M tokens $0.30-$0.60 —

在瀏覽器中前往 http://localhost:20128。

按一下側邊欄中的 Providers。

按一下 + Add Provider 按鈕。

瀏覽清單或搜尋您的提供者,然後按一下該提供者。

  • 免費提供者:無須認證資訊,只要按一下 Connect
  • API 金鑰提供者:貼上您的 API 金鑰
  • OAuth 提供者:按一下 Connect with OAuth 並登入

按一下 Test Connection 以確認連線正常。

您的提供者現在已連接。您可以搭配 model: "auto" 使用,或直接指定提供者。


搭配多個提供者時,OmniRoute 的運作效果最佳。這能為您提供:

  • 自動容錯移轉 — 如果某個提供者失敗,OmniRoute 會嘗試下一個
  • 成本最佳化 — OmniRoute 會為每個請求選擇最便宜的提供者
  • 速度最佳化 — OmniRoute 會為每個請求選擇最快的提供者
  • 品質最佳化 — OmniRoute 會為每項工作選擇最佳提供者

請至少連接 3 個提供者,以獲得最佳體驗:

  1. 一個免費提供者(Kiro、OpenCode Free 或 Pollinations)— 隨時可用
  2. 一個快速提供者(Groq、Cerebras)— 用於快速回應
  3. 一個高品質提供者(OpenAI、Anthropic、Google)— 用於複雜工作

接著使用 model: "auto",OmniRoute 就會自動為每個請求選擇最佳提供者。


  1. 取得 API 金鑰:https://platform.openai.com/api-keys
  2. 在 OmniRoute 中:提供者 → 新增提供者 → OpenAI
  3. 貼上 API 金鑰 → 連線
  1. 取得 API 金鑰:https://console.anthropic.com/
  2. 在 OmniRoute 中:提供者 → 新增提供者 → Anthropic
  3. 貼上 API 金鑰 → 連線
  1. 取得 API 金鑰:https://aistudio.google.com/apikey
  2. 在 OmniRoute 中:提供者 → 新增提供者 → Gemini
  3. 貼上 API 金鑰 → 連線
  1. 取得 API 金鑰:https://platform.deepseek.com/
  2. 在 OmniRoute 中:提供者 → 新增提供者 → DeepSeek
  3. 貼上 API 金鑰 → 連線
  1. 取得 API 金鑰:https://console.groq.com/
  2. 在 OmniRoute 中:提供者 → 新增提供者 → Groq
  3. 貼上 API 金鑰 → 連線

「我需要付費才能使用 OmniRoute 嗎?」

Section titled “「我需要付費才能使用 OmniRoute 嗎?」”

不需要! OmniRoute 是免費且開放原始碼的。你可以使用免費提供者(Kiro、OpenCode Free、Pollinations),完全無須付費。只有在你選擇使用付費提供者時才需要付費。

「我應該從哪個提供者開始?」

Section titled “「我應該從哪個提供者開始?」”

從 Kiro AI 開始——它免費、不需要 API 金鑰,並且讓你可以使用 Claude 模型。之後再視需要新增更多提供者。

「我可以同時使用多個提供者嗎?」

Section titled “「我可以同時使用多個提供者嗎?」”

可以! 這正是 OmniRoute 的核心用途。連接多個提供者,並使用 model: "auto",讓 OmniRoute 為每個請求選擇最佳提供者。

「如果提供者發生故障怎麼辦?」

Section titled “「如果提供者發生故障怎麼辦?」”

OmniRoute 會自動略過失敗的提供者,並嘗試下一個。你不需要執行任何操作。

前往提供者 → 點擊該提供者 → 點擊 中斷連線。

「我可以使用現有的 API 金鑰嗎?」

Section titled “「我可以使用現有的 API 金鑰嗎?」”

可以! 如果你已經擁有 OpenAI、Anthropic、Google 等服務的 API 金鑰,即可在 OmniRoute 中使用。連接提供者時,只需貼上金鑰即可。


Cursor 方案圖片使用 IMAGE_PROVIDERS.cursor(cursor-agent-image)。請參閱 CURSOR_IMAGE.md。


OmniRoute 原始碼 (a58000c7685f)

HagiCode

HagiCode 是智慧代理程式開發工作台,結合結構化工作流程、多代理程式執行與 Hero Dungeon 介面,將想法化為交付成果。

以更聰明、更快速且更有趣的智慧代理程式工作流程,打造實用的軟體。

HagiCode 淺色主題介面畫面
  • Smart結構化流程將意圖轉化為從構想到交付的可執行步驟。
  • Efficient多代理程式工作流程讓研究、實作與審查並行進行。
  • FunHero Dungeon 讓長時間的程式協作更直覺、更有參與感。
造訪 HagiCode