DeepSeek et autres
Des modèles très performants à des prix souvent bien plus bas que les gammes équivalentes : DeepSeek, GLM, Grok, Kimi, MiMo et Qwen. Idéal pour les gros volumes, les prototypes et les tâches où le coût prime.
Ce qu’il faut savoir
- Format OpenAI : tous ces modèles se consomment sur
/v1/chat/completionsavec votre clémdf-…. - Capacités variables : vérifiez la colonne Vision / outils avant de bâtir un agent. Certains modèles ne déclarent ni vision ni appels d’outils.
- Contexte : jusqu’à 1 million de tokens pour DeepSeek V4, GLM 5.3, Kimi K3 et MiMo ; « — » signifie que le catalogue ne l’indique pas.
- Cache très avantageux : sur DeepSeek et MiMo, les tokens relus depuis le cache coûtent une fraction infime du tarif d’entrée.
DeepSeek
Des tarifs parmi les plus bas du catalogue pour des modèles de haut niveau.
| Modèle | Gamme | Contexte | Entrée / 1M | Sortie / 1M | Lecture cache / 1M | Vision / outils |
|---|---|---|---|---|---|---|
DeepSeek V4 Prodeepseek-v4-pro | Frontière | 1M | 0,66 $ | 1,98 $ | 0,02 $ | Oui / Oui |
DeepSeek V4 Flashdeepseek-v4-flash | Rapide | 1M | 0,22 $ | 0,66 $ | 0,01 $ | Oui / Oui |
DeepSeek V4 Flash Vision Expdeepseek-v4-flash-vision-exp | Rapide | 1M | 0,22 $ | 0,66 $ | 0,01 $ | Oui / Oui |
Qwen
| Modèle | Gamme | Contexte | Entrée / 1M | Sortie / 1M | Lecture cache / 1M | Vision / outils |
|---|---|---|---|---|---|---|
Qwen 3.7 Maxqwen3.7-max | Frontière | — | 1,65 $ | 4,95 $ | 0,17 $ | n. c. / n. c. |
Qwen 3.8 Maxqwen3.8-max | Frontière | — | 1,65 $ | 4,95 $ | 0,33 $ | n. c. / n. c. |
Qwen 3.6 Plusqwen3.6-plus | Équilibrée | — | 0,50 $ | 3,00 $ | 0,10 $ | n. c. / n. c. |
Qwen 3.7 Plusqwen3.7-plus | Équilibrée | — | 0,40 $ | 1,60 $ | 0,08 $ | n. c. / n. c. |
Qwen 3.6 27Bqwen3.6-27b | Rapide | — | 0,60 $ | 3,60 $ | 0,12 $ | n. c. / n. c. |
Qwen 3.6 Flashqwen3.6-flash | Rapide | — | 0,17 $ | 0,99 $ | 0,03 $ | n. c. / n. c. |
Qwen 3.8 Flashqwen3.8-flash | Rapide | — | 0,15 $ | 0,47 $ | 0,03 $ | n. c. / n. c. |
Qwen 3.5 9Bqwen3.5-9b | Rapide | — | 0,10 $ | 0,15 $ | 0,02 $ | n. c. / n. c. |
Kimi
| Modèle | Gamme | Contexte | Entrée / 1M | Sortie / 1M | Lecture cache / 1M | Vision / outils |
|---|---|---|---|---|---|---|
Kimi K3kimi-k3 | Frontière | 1,05M | 3,00 $ | 15,00 $ | 0,30 $ | Oui / Non |
Kimi K2.6kimi-k2.6 | Phare | — | 0,95 $ | 3,96 $ | 0,16 $ | n. c. / n. c. |
Kimi K2.7 Codekimi-k2.7-code | Équilibrée | 262K | 0,95 $ | 4,00 $ | 0,19 $ | Oui / Non |
Kimi K2.7 Code Highspeedkimi-k2.7-code-highspeed | Rapide | 262K | 1,90 $ | 8,00 $ | 0,38 $ | Oui / Non |
GLM
| Modèle | Gamme | Contexte | Entrée / 1M | Sortie / 1M | Lecture cache / 1M | Vision / outils |
|---|---|---|---|---|---|---|
GLM 5.3glm-5.3 | Frontière | 1M | 1,40 $ | 4,40 $ | 0,26 $ | Oui / Oui |
GLM 5.1glm-5.1 | Phare | — | 1,40 $ | 4,40 $ | 0,28 $ | n. c. / n. c. |
GLM 5.3 Flashglm-5.3-flash | Rapide | 1,05M | 0,15 $ | 0,50 $ | 0,03 $ | Oui / Oui |
MiMo
| Modèle | Gamme | Contexte | Entrée / 1M | Sortie / 1M | Lecture cache / 1M | Vision / outils |
|---|---|---|---|---|---|---|
MiMo V2.5 Promimo-v2.5-pro | Équilibrée | 1,05M | 0,43 $ | 0,87 $ | 0,00 $ | Oui / Oui |
Grok
| Modèle | Gamme | Contexte | Entrée / 1M | Sortie / 1M | Lecture cache / 1M | Vision / outils |
|---|---|---|---|---|---|---|
Grok 4.6grok-4.6 | Frontière | 500K | 2,00 $ | 6,00 $ | 0,50 $ | Non / Non |
Grok 4.7grok-4.7 | Frontière | 500K | 2,00 $ | 6,00 $ | 0,50 $ | Non / Non |
Grok 4.5grok-4.5 | Phare | 500K | 2,00 $ | 6,00 $ | 0,30 $ | Non / Non |
Grok 4.3grok-4.3 | Phare | — | 1,25 $ | 2,50 $ | 0,20 $ | n. c. / n. c. |
Lequel choisir
- Petits budgets, qualité élevée :
deepseek-v4-propour la qualité,deepseek-v4-flashpour le volume. - Prix plancher :
qwen3.5-9b,qwen3.8-flash,glm-5.3-flash. - Code et agents longs :
kimi-k3oukimi-k2.7-code. - Tarif d’entrée très bas avec contexte de 1 million de tokens :
mimo-v2.5-pro.
Exemple d’appel
python
import os
from openai import OpenAI
client = OpenAI(api_key=os.environ["API_AI_KEY"], base_url="https://api-ai.fr/v1")
reponse = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[{"role": "user", "content": "Extrais les dates de ce texte : « RDV le 3 mars, relance le 17. »"}],
)
print(reponse.choices[0].message.content)Pour aller plus loin
Dernière mise à jour : 4 octobre 2026Une erreur ? support@minedom-france.fr