DeepSeek et autres

Des modèles très performants à des prix souvent bien plus bas que les gammes équivalentes : DeepSeek, GLM, Grok, Kimi, MiMo et Qwen. Idéal pour les gros volumes, les prototypes et les tâches où le coût prime.

Ce qu’il faut savoir

  • Format OpenAI : tous ces modèles se consomment sur /v1/chat/completions avec votre clé mdf-….
  • Capacités variables : vérifiez la colonne Vision / outils avant de bâtir un agent. Certains modèles ne déclarent ni vision ni appels d’outils.
  • Contexte : jusqu’à 1 million de tokens pour DeepSeek V4, GLM 5.3, Kimi K3 et MiMo ; « — » signifie que le catalogue ne l’indique pas.
  • Cache très avantageux : sur DeepSeek et MiMo, les tokens relus depuis le cache coûtent une fraction infime du tarif d’entrée.

DeepSeek

Des tarifs parmi les plus bas du catalogue pour des modèles de haut niveau.

Tableau
ModèleGammeContexteEntrée / 1MSortie / 1MLecture cache / 1MVision / outils
DeepSeek V4 Pro
deepseek-v4-pro
Frontière1M0,66 $1,98 $0,02 $Oui / Oui
DeepSeek V4 Flash
deepseek-v4-flash
Rapide1M0,22 $0,66 $0,01 $Oui / Oui
DeepSeek V4 Flash Vision Exp
deepseek-v4-flash-vision-exp
Rapide1M0,22 $0,66 $0,01 $Oui / Oui

Qwen

Tableau
ModèleGammeContexteEntrée / 1MSortie / 1MLecture cache / 1MVision / outils
Qwen 3.7 Max
qwen3.7-max
Frontière—1,65 $4,95 $0,17 $n. c. / n. c.
Qwen 3.8 Max
qwen3.8-max
Frontière—1,65 $4,95 $0,33 $n. c. / n. c.
Qwen 3.6 Plus
qwen3.6-plus
Équilibrée—0,50 $3,00 $0,10 $n. c. / n. c.
Qwen 3.7 Plus
qwen3.7-plus
Équilibrée—0,40 $1,60 $0,08 $n. c. / n. c.
Qwen 3.6 27B
qwen3.6-27b
Rapide—0,60 $3,60 $0,12 $n. c. / n. c.
Qwen 3.6 Flash
qwen3.6-flash
Rapide—0,17 $0,99 $0,03 $n. c. / n. c.
Qwen 3.8 Flash
qwen3.8-flash
Rapide—0,15 $0,47 $0,03 $n. c. / n. c.
Qwen 3.5 9B
qwen3.5-9b
Rapide—0,10 $0,15 $0,02 $n. c. / n. c.

Kimi

Tableau
ModèleGammeContexteEntrée / 1MSortie / 1MLecture cache / 1MVision / outils
Kimi K3
kimi-k3
Frontière1,05M3,00 $15,00 $0,30 $Oui / Non
Kimi K2.6
kimi-k2.6
Phare—0,95 $3,96 $0,16 $n. c. / n. c.
Kimi K2.7 Code
kimi-k2.7-code
Équilibrée262K0,95 $4,00 $0,19 $Oui / Non
Kimi K2.7 Code Highspeed
kimi-k2.7-code-highspeed
Rapide262K1,90 $8,00 $0,38 $Oui / Non

GLM

Tableau
ModèleGammeContexteEntrée / 1MSortie / 1MLecture cache / 1MVision / outils
GLM 5.3
glm-5.3
Frontière1M1,40 $4,40 $0,26 $Oui / Oui
GLM 5.1
glm-5.1
Phare—1,40 $4,40 $0,28 $n. c. / n. c.
GLM 5.3 Flash
glm-5.3-flash
Rapide1,05M0,15 $0,50 $0,03 $Oui / Oui

MiMo

Tableau
ModèleGammeContexteEntrée / 1MSortie / 1MLecture cache / 1MVision / outils
MiMo V2.5 Pro
mimo-v2.5-pro
Équilibrée1,05M0,43 $0,87 $0,00 $Oui / Oui

Grok

Tableau
ModèleGammeContexteEntrée / 1MSortie / 1MLecture cache / 1MVision / outils
Grok 4.6
grok-4.6
Frontière500K2,00 $6,00 $0,50 $Non / Non
Grok 4.7
grok-4.7
Frontière500K2,00 $6,00 $0,50 $Non / Non
Grok 4.5
grok-4.5
Phare500K2,00 $6,00 $0,30 $Non / Non
Grok 4.3
grok-4.3
Phare—1,25 $2,50 $0,20 $n. c. / n. c.

Lequel choisir

  • Petits budgets, qualité élevée : deepseek-v4-pro pour la qualité, deepseek-v4-flash pour le volume.
  • Prix plancher : qwen3.5-9b, qwen3.8-flash, glm-5.3-flash.
  • Code et agents longs : kimi-k3 ou kimi-k2.7-code.
  • Tarif d’entrée très bas avec contexte de 1 million de tokens : mimo-v2.5-pro.

Exemple d’appel

python
import os
from openai import OpenAI

client = OpenAI(api_key=os.environ["API_AI_KEY"], base_url="https://api-ai.fr/v1")

reponse = client.chat.completions.create(
    model="deepseek-v4-flash",
    messages=[{"role": "user", "content": "Extrais les dates de ce texte : « RDV le 3 mars, relance le 17. »"}],
)
print(reponse.choices[0].message.content)

Pour aller plus loin

Dernière mise à jour : 4 octobre 2026Une erreur ? support@minedom-france.fr