Prix temps réel depuis OpenRouter
Scores basés sur les benchmarks officiels (Artificial Analysis & Design Arena). Le Score Valeur estime le rapport performance/prix (plus il est élevé, mieux c'est).
Assignez le bon modèle à la bonne tâche pour optimiser le ratio performance/coût, comme un moteur de routage intelligent.
Réponses rapides, questions factuelles, échanges conversationnels courts.
Modèle : Qwen 3.6 Plus ou MiniMax M3
Rédaction d'emails, résumé de threads, reformulation de contenu, ton professionnel.
Modèle : Google Gemini 3.5 Flash ou Qwen 3.7 Plus
Création de features, refactoring, review de PR, compréhension d'un codebase entier.
Modèle : Claude Opus 4.8 (Premium) ou DeepSeek V4 Pro (Budget)
Lancement de commandes, analyse de logs d'erreur, debugging d'exécution, scripts bash.
Modèle : OpenAI GPT-5.5
Lecture de PDF, extraction de données depuis de gros contextes, recherche sémantique.
Modèle : Google Gemini 3.5 Flash ou Claude Opus 4.8
Agents autonomes, classification, nettoyage de données, appels d'outils en boucle à haut volume.
Modèle : DeepSeek V4 Flash ou Qwen 3.6 Plus
🎯 Règle d'or du routing :
Ne paie pas le prix fort pour ce qui peut être fait par un modèle mid-tier. Réserve Opus 4.8 et GPT-5.5 aux tâches critiques (code complexe, debug), et délègue le reste (rédaction, chat, background) aux modèles Qwen, Gemini Flash ou DeepSeek pour diviser tes coûts par 10 à 20.
| ID du Modèle (à copier) | Nom | Input / 1M | Output / 1M | Action |
|---|
Tu as ajouté des modèles localement ? Exporte ta configuration pour déploiement.