Pular para o conteúdo
OmniRoute source

Providers Guide: Connect AI Models to OmniRoute (Português (Brasil))

Pense em um provedor como uma operadora de telefonia. Assim como você precisa de uma operadora para fazer chamadas, você precisa de um provedor de IA para usar modelos de IA. O OmniRoute é como um telefone que funciona com todas as operadoras — você pode alternar entre elas automaticamente.

Tipo O que é Exemplos Custo
Gratuito Nenhum pagamento necessário Kiro, OpenCode Free, Pollinations $0
Chave de API Você precisa de uma chave de API OpenAI, Anthropic, Google Pagamento por uso
OAuth Login com sua conta Claude Code, GitHub Copilot Assinatura
Cookie da Web Usa a sessão do seu navegador ChatGPT Web (Codex), Gemini Web $0 (usa sua conta)
Seção intitulada “Consulte WEB-COOKIE-GUIDE.md para obter instruções gerais de configuração, limitações, solução de problemas e orientações de autenticação específicas de cada provedor.”

Configuração opcional de provedores gratuitos na primeira execução

Seção intitulada “Configuração opcional de provedores gratuitos na primeira execução”

O assistente de primeira execução oferece um cartão explícito chamado Configurar provedores gratuitos. Ele obtém a lista atual de provedores elegíveis do registro de provedores sem autenticação do OmniRoute e permite que você analise e desmarque cada provedor antes de confirmar. O OmniRoute exibe o aviso de precaução do provedor e um link para o site dele, para que você possa analisar primeiro os termos, a privacidade, a disponibilidade e os limites de taxa de terceiros.

Essa ação é opcional: concluir o assistente nunca cria silenciosamente conexões com provedores gratuitos. Ela cria apenas os provedores que ainda estão ausentes, mantém inalteradas as conexões personalizadas existentes e informa individualmente os provedores criados, já configurados e com falha. Após um resultado parcial, você pode tentar novamente com segurança apenas os que falharam.

Opção A: provedor gratuito (sem cartão de crédito)

Seção intitulada “Opção A: provedor gratuito (sem cartão de crédito)”
  1. Abra o painel em http://localhost:20128
  2. Acesse Provedores → Adicionar provedor
  3. Selecione um destes provedores gratuitos:
    • Kiro AI — Modelos Claude gratuitos (nenhuma autenticação necessária)
    • OpenCode Free — Modelos GPT gratuitos (nenhuma autenticação necessária)
    • Pollinations — GPT-5, Claude e Gemini gratuitos (nenhuma chave necessária)
    • LongCat — 10 milhões de tokens gratuitos (concessão única, exige conta + KYC)
    • Cloudflare AI — Mais de 50 modelos, 10 mil neurônios/dia
    • MLX Gemma 26B — Modelo local para Apple Silicon (~38,5 tokens/s, ~15,9 GB de RAM)
    • MLX Qwen 3.8 27B — Modelo local para Apple Silicon (~9,1 tokens/s, ~13,1 GB de RAM)
  4. Clique em Conectar
  5. Pronto! Agora você tem acesso gratuito à IA.
  1. Obtenha uma chave de API no site do provedor:
  2. Abra o painel em http://localhost:20128
  3. Acesse Provedores → Adicionar provedor
  4. Selecione seu provedor
  5. Cole sua chave de API
  6. Clique em Conectar
  7. Pronto! Agora você tem acesso aos modelos desse provedor.
  1. Abra o painel em http://localhost:20128
  2. Acesse Provedores → Adicionar provedor
  3. Selecione seu provedor (por exemplo, Claude Code, GitHub Copilot)
  4. Clique em Conectar com OAuth
  5. Faça login com sua conta
  6. Pronto! Agora você tem acesso aos modelos da sua assinatura.

Para Macs com Apple Silicon e memória unificada, o OmniRoute permite conectar modelos MLX locais executados por meio do mlx-lm.server como provedores locais comuns compatíveis com a OpenAI.

  • Mac com Apple Silicon (M1/M2/M3/M4), com 24 GB ou mais de memória unificada recomendados
  • Gerenciador de pacotes uv: curl -LsSf https://astral.sh/uv/install.sh | sh
  • mlx-lm: uv pip install mlx-lm
  1. Instale as dependências:

    Janela do terminal
    # Instale o uv caso ainda não esteja instalado
    curl -LsSf https://astral.sh/uv/install.sh | sh
    # Instale o mlx-lm
    uv pip install mlx-lm
  2. Inicie os servidores MLX manualmente (em terminais separados):

    Janela do terminal
    # Terminal 1: Gemma 4 26B A4B IT-QAT (porta 11435)
    uv run mlx_lm.server --model mlx-community/gemma-4-26B-A4B-it-qat-q4_0-mlx-aligned --port 11435 --host 127.0.0.1
    # Terminal 2: Qwen 3.8 27B MLX Mixed (porta 11436)
    uv run mlx_lm.server --model maglun/Qwen3.8-27B-MLX-Mixed-3.80bpw --port 11436 --host 127.0.0.1
  3. Conecte no painel do OmniRoute:

    • Acesse Provedores → Adicionar provedor
    • Selecione MLX Gemma 26B ou MLX Qwen 3.8 27B
    • Clique em Conectar (nenhuma chave de API necessária)
  4. Use com o OpenCode:

    Janela do terminal
    # Configure o OpenCode para usar o OmniRoute
    opencode config set api.base_url http://localhost:20128/v1
    opencode config set api.key <your-omniroute-api-key>
    # Use modelos MLX
    opencode run --model mlx-gemma/gemma-4-26b
    opencode run --model mlx-qwen/qwen3.8-27b

Importante: Com 24 GB de memória unificada, apenas um modelo MLX grande pode ser executado por vez.

  • Gemma 26B: ~15,9 GB de memória máxima
  • Qwen 3.8 27B: ~13,1 GB de memória máxima

Você deve gerenciar isso manualmente:

  • Execute apenas um servidor MLX por vez, ou
  • Execute ambos em máquinas separadas, ou
  • Interrompa um antes de iniciar o outro

O OmniRoute não gerencia automaticamente os processos dos servidores MLX — ele apenas encaminha as solicitações aos endpoints compatíveis com a OpenAI que você configurar.

Ambos os modelos oferecem suporte à chamada de ferramentas compatível com a OpenAI. Teste com:

Janela do terminal
curl -X POST http://localhost:20128/v1/chat/completions \
-H "Authorization: Bearer <key>" \
-H "Content-Type: application/json" \
-d '{
"model": "mlx-gemma/gemma-4-26b",
"messages": [{"role": "user", "content": "What is 2+2? Use the calculator tool."}],
"tools": [{"type": "function", "function": {"name": "calculator", "description": "Calculate", "parameters": {"type": "object", "properties": {"expression": {"type": "string"}}, "required": ["expression"]}}}]
}'
Problema Solução
O servidor não inicia Consulte uv run mlx_lm.server --help e verifique os IDs dos modelos
Memória insuficiente Certifique-se de que apenas um modelo esteja em execução; feche outros aplicativos; verifique o Monitor de Atividade
Conexão recusada Verifique se o servidor está em execução na porta correta (11435/11436)
Respostas lentas A primeira solicitação carrega o modelo na memória (~30-60s); as solicitações seguintes são rápidas
Falha na chamada de ferramentas Certifique-se de que o modelo seja compatível com ferramentas; verifique os logs do OmniRoute para detectar erros de tradução

Estes provedores oferecem acesso gratuito sem exigir cartão de crédito:

Provedor Cota gratuita Modelos Como conectar
Kiro AI 50 créditos/mês Claude Sonnet 4.5, Haiku 4.5, Opus 4.6 Não requer autenticação
OpenCode Free Ilimitada GPT-4o, Claude, Gemini Não requer autenticação
Pollinations Não requer chave GPT-5, Claude, Gemini, DeepSeek, Llama 4 Não requer autenticação
LongCat 10M uma única vez LongCat-2.0 Chave de API + KYC
Cloudflare AI 10K neurônios/dia Mais de 50 modelos Não requer autenticação
NVIDIA NIM ~40 RPM 129 modelos Requer chave de API
Cerebras US$ 5 em créditos ao se cadastrar GLM 4.7, GPT-OSS 120B Chave de API + cartão
Qoder Ilimitada Kimi-K2, DeepSeek-R1, Qwen3-coder Não requer autenticação

Dica: conecte vários provedores gratuitos para obter IA gratuita ilimitada com fallback automático!


Estes provedores oferecem modelos de alta qualidade com chaves de API:

Provedor Melhores modelos Custo Plano gratuito
OpenAI GPT-5, GPT-4o US$ 2,50-US$ 10/1M tokens US$ 5 em créditos gratuitos
Anthropic Claude Opus 4.6, Sonnet 4.6 US$ 3-US$ 15/1M tokens US$ 5 em créditos gratuitos
Google Gemini 2.5 Pro, Flash US$ 0,075-US$ 1,25/1M tokens 1.500 solicitações/dia grátis
DeepSeek DeepSeek V4 US$ 0,14-US$ 0,28/1M tokens 5M tokens gratuitos
Groq Llama 4, Mixtral US$ 0,05-US$ 0,27/1M tokens 30 RPM grátis
xAI Grok 3 US$ 0,30-US$ 0,60/1M tokens —

Acesse http://localhost:20128 no seu navegador.

Clique em Provedores na barra lateral.

Clique no botão + Adicionar provedor.

Navegue pela lista ou pesquise seu provedor. Clique nele.

  • Provedores gratuitos: nenhuma credencial é necessária — basta clicar em Conectar
  • Provedores com chave de API: cole sua chave de API
  • Provedores OAuth: clique em Conectar com OAuth e faça login

Clique em Testar conexão para verificar se ela funciona.

Seu provedor agora está conectado. Você pode usá-lo com model: "auto" ou especificar o provedor diretamente.


O OmniRoute funciona melhor com vários provedores. Isso oferece:

  • Fallback automático — se um provedor falhar, o OmniRoute tentará o próximo
  • Otimização de custos — o OmniRoute escolhe o provedor mais barato para cada solicitação
  • Otimização de velocidade — o OmniRoute escolhe o provedor mais rápido para cada solicitação
  • Otimização de qualidade — o OmniRoute escolhe o melhor provedor para cada tarefa

Conecte pelo menos 3 provedores para obter a melhor experiência:

  1. Um provedor gratuito (Kiro, OpenCode Free ou Pollinations) — sempre disponível
  2. Um provedor rápido (Groq, Cerebras) — para respostas rápidas
  3. Um provedor de alta qualidade (OpenAI, Anthropic, Google) — para tarefas complexas

Depois, use model: "auto", e o OmniRoute escolherá automaticamente o melhor provedor para cada solicitação.


  1. Obtenha uma chave de API: https://platform.openai.com/api-keys
  2. No OmniRoute: Provedores → Adicionar provedor → OpenAI
  3. Cole a chave de API → Conectar
  1. Obtenha uma chave de API: https://console.anthropic.com/
  2. No OmniRoute: Provedores → Adicionar provedor → Anthropic
  3. Cole a chave de API → Conectar
  1. Obtenha uma chave de API: https://aistudio.google.com/apikey
  2. No OmniRoute: Provedores → Adicionar provedor → Gemini
  3. Cole a chave de API → Conectar
  1. Obtenha uma chave de API: https://platform.deepseek.com/
  2. No OmniRoute: Provedores → Adicionar provedor → DeepSeek
  3. Cole a chave de API → Conectar
  1. Obtenha uma chave de API: https://console.groq.com/
  2. No OmniRoute: Provedores → Adicionar provedor → Groq
  3. Cole a chave de API → Conectar

Não! O OmniRoute é gratuito e de código aberto. Você pode usar provedores gratuitos (Kiro, OpenCode Free, Pollinations) sem pagar nada. Você só paga se optar por usar provedores pagos.

Comece com o Kiro AI — ele é gratuito, não requer chave de API e oferece acesso aos modelos Claude. Depois, adicione mais provedores conforme necessário.

“Posso usar vários provedores ao mesmo tempo?”

Seção intitulada ““Posso usar vários provedores ao mesmo tempo?””

Sim! Esse é o principal objetivo do OmniRoute. Conecte vários provedores e use model: "auto" para permitir que o OmniRoute escolha o melhor para cada solicitação.

O OmniRoute ignora automaticamente os provedores que falharam e tenta o próximo. Você não precisa fazer nada.

Acesse Provedores → clique no provedor → clique em Desconectar.

Sim! Se você já tem chaves de API da OpenAI, Anthropic, Google etc., pode usá-las no OmniRoute. Basta colá-las ao conectar o provedor.


As imagens do plano Cursor usam IMAGE_PROVIDERS.cursor (cursor-agent-image). Consulte CURSOR_IMAGE.md.


Código-fonte do OmniRoute (a58000c7685f)

HagiCode

HagiCode é um ambiente de programação com agentes, fluxos estruturados, execução multiagente e visualizações Hero Dungeon.

Transforme ideias em software útil com um fluxo de trabalho com agentes mais inteligente, rápido e agradável.

Interface principal do HagiCode no tema claro
  • SmartFluxos estruturados transformam intenções em um caminho executável da ideia à entrega.
  • EfficientFluxos multiagente mantêm pesquisa, implementação e revisão em andamento simultaneamente.
  • FunO Hero Dungeon torna longas sessões de programação mais visuais e colaborativas.
Acessar HagiCode