Tableau des prix
Prix par million de tokens. Le ratio indique combien de fois la sortie coûte l'entrée.
| Modèle | Fournisseur | Tier | Input $/1M ▼ | Output $/1M ▼ | Ratio out/in ▼ |
|---|
À retenir avant de choisir
DeepSeek : peak vs off-peak
Le pic (1h–4h et 6h–10h UTC en semaine) double le prix. Off-peak = la moitié. L'input en cache hit tombe à $0.022 / $0.044.
Gemini Flash : promo temporaire
Le $0.75 / $3.75 est une offre valable jusqu'au 31 déc 2026, ensuite $1.50 / $7.50.
Batch = −50%
OpenAI, Anthropic et Mistral divisent le prix par deux sur les jobs asynchrones.
Cache d'entrée = −90%
OpenAI et Mistral coupent l'input de 90% sur les prompts répétés. Anthropic facture la lecture à ~10%.
Grok : le meilleur ratio du haut de gamme
Grok 4.7 sort à 3x son entrée ($2 / $6), contre 5x pour la plupart des flagships.
Long contexte = surcoût
OpenAI (x2 sur l'input long) et Grok (x2 dès 200k tokens) facturent plus au-delà du seuil.