Aller au contenu
OmniRoute source

Auto-Combo: Let OmniRoute Pick the Best AI for You (Français)

Au lieu de choisir un modèle d’IA spécifique (comme GPT-4o ou Claude), vous pouvez laisser OmniRoute sélectionner automatiquement le meilleur pour chaque requête. Il prend en compte :

  • Disponibilité — Le fournisseur fonctionne-t-il actuellement ?
  • Vitesse — Quelle est sa rapidité ?
  • Coût — Combien coûte-t-il ?
  • Qualité — Est-il adapté à ce type de tâche ?
  • Capacité — Dispose-t-il encore d’un quota ?

OmniRoute attribue un score à tous vos fournisseurs connectés et sélectionne le meilleur. En cas d’échec, il essaie automatiquement le suivant.


Étape 1 : Définissez votre modèle sur auto dans votre IDE ou votre CLI :

model: "auto"

Étape 2 : C’est tout ! OmniRoute s’occupe du reste.

Étape 3 (facultative) : Utilisez une variante pour des tâches spécifiques :

model: "auto/coding" # Idéal pour le code
model: "auto/fast" # Réponse la plus rapide
model: "auto/cheap" # Option la moins chère

Si vous voulez… Utilisez ceci Idéal pour Fonctionnement
Le meilleur compromis auto Questions générales, chat Équilibre vitesse, coût et qualité
Le meilleur code auto/coding Écriture de code, débogage Sélectionne les modèles adaptés aux tâches de codage
La réponse la plus rapide auto/fast Réponses rapides, faible latence Donne la priorité absolue à la vitesse
L’option la moins chère auto/cheap Économiser de l’argent Sélectionne le fournisseur le moins cher
Le modèle le plus intelligent auto/smart Tâches complexes Priorité à la qualité et exploration de nouveaux modèles
La meilleure disponibilité auto/offline Lorsque les fournisseurs sont occupés Sélectionne les fournisseurs ayant le plus de capacité
Fenêtre de terminal
# Chat général — équilibré
curl http://localhost:20128/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{"model":"auto","messages":[{"role":"user","content":"Bonjour !"}]}'
# Génération de code — priorité à la qualité
curl http://localhost:20128/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{"model":"auto/coding","messages":[{"role":"user","content":"Écrivez une fonction Python"}]}'
# Réponse rapide — priorité à la vitesse
curl http://localhost:20128/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{"model":"auto/fast","messages":[{"role":"user","content":"Combien font 2+2 ?"}]}'

Lorsque vous envoyez une requête avec model: "auto", OmniRoute :

  1. Examine tous vos fournisseurs connectés — Chaque fournisseur que vous avez ajouté (OpenAI, Anthropic, Google, etc.)
  2. Attribue un score à chacun, en tenant compte notamment des éléments suivants :
    • Fonctionne-t-il ? (disponibilité)
    • Dispose-t-il de capacité ? (quota)
    • Combien coûte-t-il ? (prix)
    • Quelle est sa rapidité ? (vitesse)
    • Est-il adapté à cette tâche ? (qualité)
  3. Sélectionne le meilleur — Le fournisseur ayant obtenu le score le plus élevé reçoit votre requête
  4. Récupère automatiquement après un échec — En cas d’échec, OmniRoute essaie automatiquement le suivant

Chaque fournisseur reçoit un score compris entre 0 et 1. Plus le score est élevé, plus le fournisseur est adapté.

Facteur Pondération Signification
Disponibilité 20% Le fournisseur fonctionne-t-il ? (état du disjoncteur)
Quota 15% Dispose-t-il encore de capacité ?
Coût 15% Est-il cher ? (moins cher = score plus élevé)
Vitesse 12% Est-il rapide ? (latence plus faible = score plus élevé)
Adéquation à la tâche 8% Est-il adapté à ce type de tâche ?
Stabilité 5% Est-il fiable ? (faible taux d’erreur)
Niveau 5% Niveau du compte (Ultra > Pro > Free)
Autres 20% Affinité contextuelle, densité des connexions, etc.

Chaque variante utilise des pondérations différentes :

Variante Priorité Pondérations principales
auto Équilibre health=20%, quota=15%, cost=15%
auto/coding Qualité taskFit=37%, stability=15%
auto/fast Vitesse latency=32%, health=28%
auto/cheap Coût cost=37%
auto/smart Qualité + exploration taskFit=37%, exploration=10%
auto/offline Capacité quota=37%, health=28%

OmniRoute dispose de trois niveaux de protection :

Si le meilleur fournisseur échoue, OmniRoute essaie automatiquement le suivant. Vous n’avez rien à faire.

Si un fournisseur échoue de manière répétée :

  • Score < 0.2 → Exclu pendant 5 minutes
  • Disjoncteur ouvert → Exclu automatiquement
  • Plus de 50 % des fournisseurs indisponibles → Mode incident (aucune exploration)

Si tous les fournisseurs échouent, OmniRoute achemine les requêtes vers des fournisseurs gratuits et stables (comme Kiro ou Qoder) en dernier recours.


Si vous disposez de plusieurs comptes pour un même fournisseur (par exemple, deux clés OpenAI), OmniRoute traite chacun comme un candidat distinct. Cela signifie que :

  • Le compte A dispose encore d’un quota → l’utiliser
  • Le compte B est soumis à une limitation de débit → l’ignorer
  • Le compte C est moins cher → le privilégier

Chaque compte est évalué indépendamment en fonction de son propre état de santé, de son quota et de sa vitesse.


OmniRoute explore occasionnellement de nouveaux fournisseurs afin de découvrir de meilleures options :

  • Par défaut : 5 % des requêtes sont envoyées à des fournisseurs aléatoires
  • Auto/smart : taux d’exploration de 10 %
  • Désactivée lorsque plus de 50 % des fournisseurs sont défaillants

Cela permet à OmniRoute d’identifier les fournisseurs les mieux adaptés à vos habitudes d’utilisation.


« Choisira-t-il toujours le modèle le plus cher ? »

Section intitulée « « Choisira-t-il toujours le modèle le plus cher ? » »

Non. Le coût ne représente par défaut que 15 % du score. Un fournisseur bon marché, rapide et fiable peut l’emporter sur un fournisseur coûteux. Utilisez auto/cheap si vous souhaitez accorder encore plus d’importance au coût.

« Que se passe-t-il si un fournisseur devient indisponible ? »

Section intitulée « « Que se passe-t-il si un fournisseur devient indisponible ? » »

OmniRoute l’ignore automatiquement et essaie le suivant. Si un fournisseur échoue de manière répétée, il est temporairement exclu (pendant 5 à 30 minutes). Vous n’avez rien à faire.

« Puis-je voir quel fournisseur a été utilisé ? »

Section intitulée « « Puis-je voir quel fournisseur a été utilisé ? » »

Consultez les en-têtes de la réponse : OmniRoute y indique le fournisseur et le modèle utilisés pour chaque réponse.

Oui ! Le système de notation utilise les données historiques (latence, taux d’erreur et taux de réussite) pour prendre de meilleures décisions au fil du temps.

« Quelle est la différence entre auto et auto/smart ? »

Section intitulée « « Quelle est la différence entre auto et auto/smart ? » »
  • auto — Équilibré, avec 5 % d’exploration
  • auto/smart — Priorité à la qualité (mêmes pondérations que auto/coding), avec 10 % d’exploration

Utilisez auto/smart lorsque vous recherchez la meilleure qualité et acceptez une exploration occasionnelle.

« Puis-je imposer un fournisseur spécifique ? »

Section intitulée « « Puis-je imposer un fournisseur spécifique ? » »

Oui ! Utilisez un combo avec la stratégie priority au lieu de auto, puis indiquez le nom exact du combo dans le champ model (par exemple, model: "my-combo" — et non auto). Consultez la Référence technique pour plus de détails.

Le round-robin parcourt les fournisseurs dans l’ordre. L’auto-combo attribue un score à chaque fournisseur et sélectionne le meilleur. Il est plus intelligent : il tient compte de l’état de santé, de la vitesse, du coût et de la qualité.



Pour les développeurs et les contributeurs, consultez la référence technique d’Auto-Combo pour obtenir :

  • L’algorithme de notation complet à 16 facteurs
  • Les tableaux de pondération des packs de modes
  • Les chemins d’accès aux fichiers d’implémentation
  • Les points de terminaison de l’API
  • Les détails de l’algorithme d’auto-réparation

Code source d’OmniRoute (a58000c7685f)

HagiCode

HagiCode est un espace de développement agentique qui associe workflows structurés, exécution multi-agent et vues Hero Dungeon.

Transformez vos idées en logiciels utiles grâce à un workflow agentique plus intelligent, rapide et agréable.

Interface principale de HagiCode en thème clair
  • SmartDes workflows structurés transforment une intention en parcours exécutable, de l’idée à la livraison.
  • EfficientLes workflows multi-agents font avancer recherche, réalisation et revue en parallèle.
  • FunHero Dungeon rend les longues sessions de code plus visuelles et collaboratives.
Visiter HagiCode