Choisir un modèle

Il n’existe pas de « meilleur » modèle dans l’absolu : il y a le bon compromis entre qualité, vitesse et coût pour votre usage. Cette page vous aide à le trouver en quelques minutes.

Les quatre critères

  • La difficulté de la tâche : un raisonnement long, un gros refactoring ou un agent autonome demandent un modèle de haut niveau ; une classification, une extraction ou une reformulation se contentent d’un modèle rapide.
  • Le coût : l’écart de prix entre deux gammes peut atteindre un facteur 10 à 50 pour une même tâche (voir le comparatif plus bas).
  • La longueur du contexte : la quantité de texte que le modèle peut lire d’un coup (documents, historique, dépôt de code).
  • Les capacités : vision (lecture d’images), appels d’outils, génération d’images ou de vidéos. Elles sont indiquées pour chaque modèle dans le catalogue.

Les gammes du catalogue

Chaque modèle du catalogue appartient à une gamme. Les noms diffèrent d’une famille à l’autre, mais la logique est la même.

Tableau
GammePour quoi faireExemples
Frontière / PhareRaisonnement complexe, agents autonomes, code difficile, analyses longuesclaude-opus-5-5, gpt-6-sol, deepseek-v4-pro, kimi-k3
ÉquilibréeUsage quotidien : code, rédaction, synthèse, assistants métier. Le meilleur point de départclaude-sonnet-5-5, gpt-5.6-terra, mimo-v2.5-pro
Rapide / ÉconomiqueGros volumes, classification, extraction, réponses courtes, prototypesdeepseek-v4-flash, gemini-3-flash, gpt-6-luna, qwen3.8-flash

Quel modèle pour quelle tâche

Tableau
Votre besoinPoint de départ conseilléSi ça ne suffit pas
Coder avec un assistant (Claude Code, Cursor, Cline…)claude-sonnet-5-5claude-opus-5-5 pour les tâches difficiles
Agent autonome, tâches longues avec outilsclaude-sonnet-5-5 ou gpt-6-solclaude-opus-5-5
Lire un très long document ou un dépôt entierUn modèle à contexte de 1 million de tokens (la plupart des modèles Claude, GPT, Gemini et DeepSeek V4)Découper le document et utiliser le cache de prompts
Traiter beaucoup de requêtes pour peu cherdeepseek-v4-flash, gpt-6-luna, gemini-3-flashclaude-sonnet-5-5
Lire des images, captures d’écran, PDF scannésUn modèle « multimodal » avec vision déclarée (colonne Vision du catalogue)Voir Vision
Générer des images ou des vidéosVoir Génération d’images et de vidéos—

Ce que coûte la même tâche selon le modèle

Comparatif pour une session de code typique (200 000 tokens lus, 30 000 écrits), aux tarifs actuels du catalogue :

Tableau
ModèleGammeCoût (200K tokens en entrée, 30K en sortie)
Claude Opus 5.5
claude-opus-5-5
Phare1,40 $
Kimi K3
kimi-k3
Frontière1,05 $
GPT-5.6 Terra
gpt-5.6-terra
Équilibrée0,95 $
GPT-6 Sol
gpt-6-sol
Frontière0,70 $
Qwen 3.8 Max
qwen3.8-max
Frontière0,48 $
Claude Sonnet 5.5
claude-sonnet-5-5
Équilibrée0,35 $
Claude Haiku 4.5
claude-haiku-4-5
Rapide0,35 $
DeepSeek V4 Pro
deepseek-v4-pro
Frontière0,19 $
Gemini 3 Flash
gemini-3-flash
Rapide0,19 $
DeepSeek V4 Flash
deepseek-v4-flash
Rapide0,06 $
GPT-6 Luna
gpt-6-luna
Économique0,04 $
Lecture du tableau
Le coût est calculé à partir des tarifs par million de tokens. Il ne tient pas compte du cache de prompts, qui réduit fortement le prix des tokens répétés, ni du multiplicateur de crédit de votre recharge (voir les tarifs). À ce jour, claude-haiku-4-5 est au même tarif que claude-sonnet-5-5 : à prix égal, privilégiez le modèle le plus récent.

La méthode qui marche

  1. Commencez par une gamme équilibrée (par exemple claude-sonnet-5-5) sur vos vrais prompts, pas sur des exemples théoriques.
  2. Montez d’une gamme uniquement si le résultat est insuffisant, en comparant sur 10 à 20 cas réels.
  3. Descendez d’une gamme dès que c’est possible pour les tâches répétitives : l’économie se compte en multiples, pas en pourcentages.
  4. Mesurez : chaque réponse contient le champ usage (tokens lus et écrits) et votre tableau de bord affiche le coût par modèle.
  5. Gardez le modèle configurable (variable d’environnement) pour en changer sans modifier le code.

Pour lister les modèles disponibles avec votre clé :

bash
curl https://api-ai.fr/v1/models -H "Authorization: Bearer $API_AI_KEY"

Aller plus loin

Dernière mise à jour : 4 octobre 2026Une erreur ? support@minedom-france.fr