Consommation et facturation
La consommation de chaque requête est renvoyée dans chaque réponse : vous pouvez facturer à partir de ces chiffres en toute confiance. Un instantané du solde est disponible via GET /v1/dashboard/balance.
Consommation par requête
Chaque réponse de /v1/messages contient un objet usage avec le décompte des tokens :
{
"usage": {
"input_tokens": 48,
"output_tokens": 92,
"cache_creation_input_tokens": 0,
"cache_read_input_tokens": 0
}
}Pour chat-completions, les mêmes chiffres apparaissent sous prompt_tokens, completion_tokens et total_tokens.
Solde de la clé — GET /v1/dashboard/balance
L’instantané du solde est lu directement dans notre base de données, sans appel au fournisseur amont. La réponse est instantanée et ne dépend jamais de la disponibilité d’un fournisseur. Ce point d’accès renvoie uniquement votre solde API-AI ; les quotas et capacités des fournisseurs ne sont jamais exposés.
Authorization: Bearer mdf-... (contrairement à /v1/messages, qui accepte aussi x-api-key). Adresse : https://api-ai.fr/v1/dashboard/balance.curl -H "Authorization: Bearer mdf-VOTRE_CLE" \
https://api-ai.fr/v1/dashboard/balanceRéponse 200 OK :
{
"object": "balance",
"balance_usd": 54.77,
"expires_at": "2026-07-29T19:00:00Z",
"is_active": true,
"last_synced_at": "2026-06-29T19:52:00Z"
}balance_usd— solde API-AI actuel.expires_at— expiration de la clé (ISO 8601 UTC,nullsi aucune).is_active—falsesi la clé est suspendue ou désactivée.last_synced_at— dernière synchronisation avec le fournisseur amont.
Erreurs : 401 — en-tête Authorization: Bearer manquant ou invalide ; 429 — limite de débit dépassée (30 requêtes par minute et par IP). Solde et dépenses sont aussi visibles dans le dashboard, ou sur demande à support@minedom-france.fr.
Tarifs effectifs
Nous facturons un tarif fixe par million de tokens, celui publié sur la page Tarifs. Pas de multiplicateur, pas de minimum, pas d’arrondi. Le calcul est le suivant :
cost = (input_tokens / 1_000_000) * rate_in
+ (output_tokens / 1_000_000) * rate_out
+ (cache_read_input_tokens / 1_000_000) * (rate_in * 0.10)
+ (cache_creation_input_tokens / 1_000_000) * (rate_in * 1.25)- Les lectures de cache sont facturées à 10 % du tarif d’entrée.
- La création de cache (la première fois que l’amont enregistre un point de cache) est facturée à 125 % du tarif d’entrée.
Quand le solde est épuisé
Lorsque balance_usd ≤ 0, la clé est désactivée automatiquement et la passerelle renvoie 401 authentication_error pour les requêtes qui l’utilisent. Rechargez depuis la page Recharger le solde : le crédit est disponible dès la confirmation du paiement.
Limite de débit (429)
La passerelle limite la concurrence et les rafales par clé. En cas de dépassement, vous recevez une 429 rate_limit_error avec un en-tête Retry-After en secondes :
HTTP/1.1 429 Too Many Requests
Retry-After: 2
Content-Type: application/json
{
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Rate limit exceeded. Retry after 2s."
}
}Respectez Retry-After à la lettre — ne réessayez pas plus tôt. Si les 429 sont fréquentes, réduisez la concurrence côté client ; les requêtes limitées ne consomment pas de solde.
Précision de la consommation par requête
La somme des objets usage de chaque requête correspond exactement à la dépense réelle de la clé. Vérifié le 8 mai 2026 sur un échantillon de 24 h de 25 845 requêtes : écart maximal inférieur à 0,001 $ (arrondi à la 6e décimale). Vous pouvez facturer à partir du usage de chaque requête en toute confiance.