Choisir un modèle
Il n’existe pas de « meilleur » modèle dans l’absolu : il y a le bon compromis entre qualité, vitesse et coût pour votre usage. Cette page vous aide à le trouver en quelques minutes.
Les quatre critères
- La difficulté de la tâche : un raisonnement long, un gros refactoring ou un agent autonome demandent un modèle de haut niveau ; une classification, une extraction ou une reformulation se contentent d’un modèle rapide.
- Le coût : l’écart de prix entre deux gammes peut atteindre un facteur 10 à 50 pour une même tâche (voir le comparatif plus bas).
- La longueur du contexte : la quantité de texte que le modèle peut lire d’un coup (documents, historique, dépôt de code).
- Les capacités : vision (lecture d’images), appels d’outils, génération d’images ou de vidéos. Elles sont indiquées pour chaque modèle dans le catalogue.
Les gammes du catalogue
Chaque modèle du catalogue appartient à une gamme. Les noms diffèrent d’une famille à l’autre, mais la logique est la même.
| Gamme | Pour quoi faire | Exemples |
|---|---|---|
| Frontière / Phare | Raisonnement complexe, agents autonomes, code difficile, analyses longues | claude-opus-5-5, gpt-6-sol, deepseek-v4-pro, kimi-k3 |
| Équilibrée | Usage quotidien : code, rédaction, synthèse, assistants métier. Le meilleur point de départ | claude-sonnet-5-5, gpt-5.6-terra, mimo-v2.5-pro |
| Rapide / Économique | Gros volumes, classification, extraction, réponses courtes, prototypes | deepseek-v4-flash, gemini-3-flash, gpt-6-luna, qwen3.8-flash |
Quel modèle pour quelle tâche
| Votre besoin | Point de départ conseillé | Si ça ne suffit pas |
|---|---|---|
| Coder avec un assistant (Claude Code, Cursor, Cline…) | claude-sonnet-5-5 | claude-opus-5-5 pour les tâches difficiles |
| Agent autonome, tâches longues avec outils | claude-sonnet-5-5 ou gpt-6-sol | claude-opus-5-5 |
| Lire un très long document ou un dépôt entier | Un modèle à contexte de 1 million de tokens (la plupart des modèles Claude, GPT, Gemini et DeepSeek V4) | Découper le document et utiliser le cache de prompts |
| Traiter beaucoup de requêtes pour peu cher | deepseek-v4-flash, gpt-6-luna, gemini-3-flash | claude-sonnet-5-5 |
| Lire des images, captures d’écran, PDF scannés | Un modèle « multimodal » avec vision déclarée (colonne Vision du catalogue) | Voir Vision |
| Générer des images ou des vidéos | Voir Génération d’images et de vidéos | — |
Ce que coûte la même tâche selon le modèle
Comparatif pour une session de code typique (200 000 tokens lus, 30 000 écrits), aux tarifs actuels du catalogue :
| Modèle | Gamme | Coût (200K tokens en entrée, 30K en sortie) |
|---|---|---|
Claude Opus 5.5claude-opus-5-5 | Phare | 1,40 $ |
Kimi K3kimi-k3 | Frontière | 1,05 $ |
GPT-5.6 Terragpt-5.6-terra | Équilibrée | 0,95 $ |
GPT-6 Solgpt-6-sol | Frontière | 0,70 $ |
Qwen 3.8 Maxqwen3.8-max | Frontière | 0,48 $ |
Claude Sonnet 5.5claude-sonnet-5-5 | Équilibrée | 0,35 $ |
Claude Haiku 4.5claude-haiku-4-5 | Rapide | 0,35 $ |
DeepSeek V4 Prodeepseek-v4-pro | Frontière | 0,19 $ |
Gemini 3 Flashgemini-3-flash | Rapide | 0,19 $ |
DeepSeek V4 Flashdeepseek-v4-flash | Rapide | 0,06 $ |
GPT-6 Lunagpt-6-luna | Économique | 0,04 $ |
Lecture du tableau
Le coût est calculé à partir des tarifs par million de tokens. Il ne tient pas compte du cache de prompts, qui réduit fortement le prix des tokens répétés, ni du multiplicateur de crédit de votre recharge (voir les tarifs). À ce jour,
claude-haiku-4-5 est au même tarif que claude-sonnet-5-5 : à prix égal, privilégiez le modèle le plus récent.La méthode qui marche
- Commencez par une gamme équilibrée (par exemple
claude-sonnet-5-5) sur vos vrais prompts, pas sur des exemples théoriques. - Montez d’une gamme uniquement si le résultat est insuffisant, en comparant sur 10 à 20 cas réels.
- Descendez d’une gamme dès que c’est possible pour les tâches répétitives : l’économie se compte en multiples, pas en pourcentages.
- Mesurez : chaque réponse contient le champ
usage(tokens lus et écrits) et votre tableau de bord affiche le coût par modèle. - Gardez le modèle configurable (variable d’environnement) pour en changer sans modifier le code.
Pour lister les modèles disponibles avec votre clé :
bash
curl https://api-ai.fr/v1/models -H "Authorization: Bearer $API_AI_KEY"Aller plus loin
- Fiches détaillées par famille : Claude, GPT, Gemini, DeepSeek et autres
- Optimiser vos coûts
- Catalogue complet et tarifs
Dernière mise à jour : 4 octobre 2026Une erreur ? support@minedom-france.fr