Vision (images en entrée)
Tous les modèles Claude acceptent des images. Passez-les en ligne en base64 ou via une URL dans un bloc de contenu image.
Bloc de contenu image
Mélangez blocs texte et image dans le même tableau content. Le modèle les traite comme un seul flux ordonné.
json
{
"model": "claude-sonnet-5-5",
"max_tokens": 512,
"messages": [
{
"role": "user",
"content": [
{ "type": "text", "text": "Describe this image in one sentence." },
{
"type": "image",
"source": {
"type": "base64",
"media_type": "image/png",
"data": "iVBORw0KGgoAAAANSUhEUgAAA..."
}
}
]
}
]
}Source par URL
La passerelle accepte aussi une URL HTTPS publique — l’image est récupérée côté serveur avant d’être transmise en amont.
json
{
"type": "image",
"source": {
"type": "url",
"url": "https://example.com/diagram.png"
}
}Formats et limites
- Types de médias :
image/jpeg,image/png,image/gif,image/webp. - Jusqu’à 20 images par requête et 5 Mo par image avant encodage base64.
- Les GIF animés sont réduits à leur première image.
- Les tokens de vision sont facturés comme des tokens d’entrée — une image de 1024×1024 représente environ 1 600 tokens.
Python (fichier → base64)
python
import base64, mimetypes
from anthropic import Anthropic
client = Anthropic(base_url="https://api-ai.fr")
def encode_image(path: str):
with open(path, "rb") as f:
data = base64.standard_b64encode(f.read()).decode("ascii")
return {
"type": "base64",
"media_type": mimetypes.guess_type(path)[0] or "image/png",
"data": data,
}
msg = client.messages.create(
model="claude-sonnet-5-5",
max_tokens=512,
messages=[{
"role": "user",
"content": [
{"type": "text", "text": "What's in this screenshot?"},
{"type": "image", "source": encode_image("./screen.png")},
],
}],
)
print(msg.content[0].text)Choisir un modèle pour la vision
- OCR et texte dense —
claude-opus-4-8quand la précision compte plus que le coût. - Description d’objets et de scènes —
claude-sonnet-5-5, le choix équilibré par défaut. - Schémas simples et captures d’interface —
claude-haiku-4-5pour du traitement par lots peu coûteux ; passez à Sonnet ou Opus pour les cas complexes.
Pas de génération d’images ici
La vision fonctionne uniquement en entrée : Claude ne génère pas d’images sur ce point d’accès. Pour générer des images, consultez le guide Génération d’images.
Dernière mise à jour : 2 octobre 2026Une erreur ? support@minedom-france.fr