Claude Haiku 5.5 Tarifs
Claude Haiku 5.5 coûte 0,10 $ par million de jetons d’entrée et 0,50 $ par million de jetons de sortie pour les invites allant jusqu’à 100 000 jetons. Au-delà de 100 000 jetons, les tarifs passent à 0,50 $ en entrée et 2
Claude Haiku 5.5 coûte 0,10 $ par million de jetons d’entrée et 0,50 $ par million de jetons de sortie pour les invites allant jusqu’à 100 000 jetons. Au-delà de 100 000 jetons, les tarifs passent à 0,50 $ en entrée et 2,50 $ en sortie. Les lectures de cache commencent à 0,01 $, l’API Batch divise les tarifs par deux, et Anthropic estime que le modèle coûte « environ 75 % moins cher à exécuter » que Haiku 4.5 en moyenne.
Essayez Apidog dès aujourd’hui
Ce guide détaille les postes de coût, explique l’estimation des 75 %, fournit des exemples pratiques — y compris une requête de plus de 100 000 jetons — et montre comment mesurer vos coûts réels. Si vous découvrez le modèle, commencez par ce qu’est Claude Haiku 5.5. Pour vérifier ces chiffres sur votre trafic, envoyez des requêtes depuis Apidog et lisez le bloc usage de chaque réponse.
Tableau des prix de l’API Claude Haiku 5.5
Prix par million de jetons (MTok), d’après la documentation tarifaire d’Anthropic :
| Poste | Invites jusqu’à 100 000 jetons | Invites de plus de 100 000 jetons |
|---|---|---|
| Entrée | 0,10 $ | 0,50 $ |
| Sortie | 0,50 $ | 2,50 $ |
| Écriture cache de 5 minutes | 0,125 $ | 0,625 $ |
| Écriture cache d’une heure | 0,20 $ | 1,00 $ |
| Lecture cache (succès et actualisations) | 0,01 $ | 0,05 $ |
| Entrée par lot | 0,05 $ | 0,25 $ |
| Sortie par lot | 0,25 $ | 1,25 $ |
La règle à automatiser est simple : une invite de plus de 100 000 jetons applique les tarifs élevés à l’appel.
Points à intégrer dans vos estimations :
-
Inférence uniquement aux États-Unis : le routage avec
inference_geocoûte 1,1× plus cher pour chaque catégorie de jetons. Sous 100 000 jetons, cela représente 0,11 $ en entrée et 0,55 $ en sortie. - Nouveau tokeniseur : le même texte produit environ 30 % de jetons en plus qu’avec Haiku 4.5.
-
Coût des outils réduit : l’invite système pour l’utilisation d’outils est de 286 jetons (
auto/aucun), contre 496 avec Haiku 4.5. - Pas de Priority Tier ni de mode rapide.
Formule de coût sans cache
Pour une requête sans cache :
coût = (jetons_entrée × tarif_entrée + jetons_sortie × tarif_sortie) / 1 000 000
Exemple sous le seuil : 4 000 jetons d’entrée et 110 jetons de sortie.
coût = (4 000 × 0,10 + 110 × 0,50) / 1 000 000
= 0,000455 $
Exemple au-dessus du seuil : 150 000 jetons d’entrée et 2 000 jetons de sortie.
coût = (150 000 × 0,50 + 2 000 × 2,50) / 1 000 000
= 0,08 $
D’où vient le « environ 75 % de moins »
Haiku 5.5 est tarifé 90 % moins cher que Haiku 4.5 jusqu’à 100 000 jetons et 50 % moins cher au-delà. Anthropic indique que 90 % des requêtes Haiku 4.5 étaient sous 100 000 jetons, tout en tenant compte du nouveau tokeniseur.
Une reconstruction approximative :
- Pondérez par nombre de requêtes :
0,9 × 90 % + 0,1 × 50 % = 86 % de réduction
- Ajoutez environ 30 % de jetons supplémentaires avec le nouveau tokeniseur :
coût restant = 14 % × 1,3 = 18,2 %
économie estimée = 81,8 %
Le chiffre d’Anthropic est plus prudent : les invites longues représentent probablement une part plus importante des dépenses que du volume de requêtes. Utilisez donc 75 % comme moyenne de référence, puis calculez votre propre valeur à partir de usage.
Coût par tentative selon le niveau d’effort
Haiku 5.5 est le premier Haiku avec des niveaux d’effort, de low à max. La valeur par défaut de l’API est medium.
L’effort peut influencer votre facture davantage que la grille tarifaire. Les chiffres ci-dessous proviennent des graphiques de lancement : Anthropic a exécuté OSWorld et Terminal-Bench, tandis qu’Artificial Analysis a exécuté GDPval-AA.
| Effort | OSWorld 2.1 (score, $/tentative) | GDPval-AA v2.1 (Elo, $/tâche) | Terminal-Bench 4.0 (score, $/tentative) |
|---|---|---|---|
low |
42,0 %, 0,0695 $ | 1125, 0,0117 $ | 12,7 %, 0,424 $ |
medium |
53,3 %, 0,1257 $ | 1277, 0,0304 $ | 20,3 %, 0,6798 $ |
high |
61,3 %, 0,1827 $ | 1420, 0,0894 $ | 24,8 %, 1,0372 $ |
xhigh |
67,6 %, 0,2792 $ | 1513, 0,2673 $ | 31,5 %, 1,7545 $ |
max |
72,4 %, 0,6111 $ | 1620, 0,8659 $ | 39,2 %, 2,6433 $ |
Pour choisir un niveau d’effort :
- Commencez en
lowoumediumavec un jeu d’évaluation représentatif. - Comparez le taux de réussite, les jetons de sortie et le coût par tâche.
- Passez à
highoumaxseulement si le gain de qualité justifie la hausse du coût.
À retenir :
-
maxcoûte 4,9× plus cher quemediumsur OSWorld :0,6111 ÷ 0,1257. - Sur GDPval-AA,
maxcoûte 28,5× plus cher quemedium:0,86593 ÷ 0,03042. - Les scores mis en avant au lancement correspondent à
max. Avec le réglage par défautmedium, GDPval-AA atteint 1277, et non 1620. - Pour le codage agentique complexe, examinez Sonnet. Sur Terminal-Bench, Sonnet 5.5 en
lowavec des lectures de cache à 0,10 $ atteint 20 % pour 0,6205 $, contre 20,3 % et 0,6798 $ pour Haiku 5.5 enmedium.
Notre analyse des benchmarks contient toutes les lignes de comparaison.
Comment Haiku 5.5 se compare en termes de prix
| Modèle | Entrée / sortie par MJetons | Lecture cache | Écriture cache 5 min | Règle des invites longues |
|---|---|---|---|---|
| Claude Haiku 5.5 | Jusqu’à 100K : 0,10 $ / 0,50 $ | 0,01 $ | 0,125 $ | Plus de 100K : 0,50 $ / 2,50 $ |
| GPT-6 Luna | 0,10 $ / 0,50 $ | 0,01 $ | 0,125 $ | Entrée de plus de 272K : 2× entrée et cache, 1,5× sortie (0,20 $ / 0,75 $) |
| Claude Haiku 4.5 | 1 $ / 5 $ | 0,10 $ | 1,25 $ | Tarif unique, contexte 200K |
| Claude Sonnet 5.5 | 2 $ / 10 $ | 0,10 $ | 2,50 $ | Tarif unique sur 1M |
GPT-6 Luna correspond à Haiku 5.5 jusqu’à 100 000 jetons, mais son seuil de majoration est différent. Selon la page du modèle d’OpenAI, la majoration Luna commence au-delà de 272 000 jetons et s’applique à la requête entière.
Pour l’exemple à 150 000 jetons d’entrée et 2 000 jetons de sortie :
Luna = (150 000 × 0,10 + 2 000 × 0,50) / 1 000 000
= 0,016 $
Haiku 5.5 = 0,08 $
Les tokeniseurs diffèrent également : un commentateur de Hacker News a estimé que 100 000 jetons Claude équivalent à environ 60 000 à 65 000 jetons GPT. Sur le graphique OSWorld d’Anthropic, Haiku 5.5 en medium atteint 53,3 % pour 0,1257 $, contre 48,9 % pour Luna en max à 0,205 $.
Consultez aussi Claude Haiku 5.5 vs GPT-6 Luna.
Sonnet 5.5 a réduit ses lectures de cache de 0,20 $ à 0,10 $ le même jour, soit environ 20 % moins cher sur la plupart des tâches agentiques selon Anthropic. Notre guide tarifaire de Sonnet 5.5 est antérieur à cette réduction.
Haiku 4.5 n’est pas obsolète. Consultez Haiku 5.5 vs Haiku 4.5 pour identifier les changements à corriger en priorité.
Crédits API et forfaits consommateurs
Crédits API Max et Team
- Max 5× : 100 $ par mois en crédits Claude Platform.
- Max 20× : 200 $ par mois.
- Team : 20 $ par siège Standard et 100 $ par siège Premium.
- Les crédits sont cumulés et plafonnés à 500 $.
- Les plans Gratuit, Pro et Enterprise ne sont pas éligibles.
Selon la documentation des crédits API, ces crédits couvrent l’API Claude, mais pas Claude Code ni les services cloud. Ils ne sont pas reportables.
À 0,10 $ par MJetons d’entrée, 100 $ correspondent à 1 milliard de jetons d’entrée, soit environ 220 000 requêtes de l’exemple à 0,000455 $.
Forfaits consommateurs
D’après claude.com/pricing, les utilisateurs des forfaits Gratuit, Pro, Max, Team et Enterprise peuvent sélectionner Haiku 5.5 dans Claude.ai, sur le web, iOS et Android.
- Pro coûte 17 $/mois avec facturation annuelle, ou 20 $/mois.
- Max commence à 100 $/mois.
- Le forfait Gratuit n’inclut pas Claude Code.
- Un forfait de chat ne permet pas d’exécuter un script ou un travail d’intégration continue.
Pour les options sans coût, consultez comment utiliser Claude Haiku 5.5 gratuitement.
Clouds
Bedrock, Google Cloud et Foundry facturent Haiku 5.5 selon leurs propres pages tarifaires.
Suivre le coût par requête dans Apidog
Chaque réponse de l’API Messages renvoie un objet usage. Vous pouvez l’utiliser pour calculer le coût de chaque appel dans Apidog.
1. Stockez la clé API
Ajoutez votre clé comme variable d’environnement :
ANTHROPIC_API_KEY=...
2. Créez une requête par niveau d’effort
Conservez la même invite et testez au minimum low, medium et high.
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 4000,
"thinking": {"type": "adaptive"},
"output_config": {"effort": "medium"},
"messages": [
{
"role": "user",
"content": "Classify this support ticket: ..."
}
]
}'
3. Ajoutez un post-processeur de coût
Ce script traite input_tokens comme la longueur de l’invite. Il convient aux appels sans mise en cache.
const body = pm.response.json();
const u = body.usage;
const long = u.input_tokens > 100000;
const rateIn = long ? 0.50 : 0.10;
const rateOut = long ? 2.50 : 0.50;
const cost =
(u.input_tokens * rateIn + u.output_tokens * rateOut) / 1e6;
pm.environment.set("haiku_call_usd", cost.toFixed(6));
pm.test("not a refusal", () => {
pm.expect(body.stop_reason).to.not.eql("refusal");
});
4. Comparez les résultats
Exécutez chaque requête, puis comparez côte à côte :
input_tokensoutput_tokens- le niveau d’effort
haiku_call_usd- le résultat fonctionnel attendu
La vérification des refus est importante : les classificateurs de sécurité de Haiku 5.5 n’ont pas de repli côté serveur. Pour le flux API complet, consultez comment utiliser l’API Claude Haiku 5.5.
FAQ
Combien coûte Claude Haiku 5.5 par million de jetons ?
0,10 $ en entrée et 0,50 $ en sortie jusqu’à 100 000 jetons ; 0,50 $ et 2,50 $ au-delà.
Haiku 5.5 est-il moins cher que Haiku 4.5 ?
Oui. Il coûte 90 % moins cher par jeton jusqu’à 100 000 jetons, 50 % moins cher au-delà et environ 75 % moins cher en moyenne selon Anthropic.
Haiku 5.5 est-il au même prix que GPT-6 Luna ?
Jusqu’à 100 000 jetons, oui. Au-delà, Haiku 5.5 passe à un tarif 5× plus élevé, tandis que Luna reste au tarif de base jusqu’à 272 000 jetons. Consultez aussi cet aperçu de GPT-6 Luna.
Les crédits du forfait Max fonctionnent-ils dans Claude Code ?
Non. Ils couvrent l’API Claude Platform, pas Claude Code. Consultez Claude Haiku 5.5 dans Claude Code pour l’accès via les forfaits.
Étape suivante : estimez le coût de votre charge de travail
- Identifiez vos trois types de requêtes les plus fréquents.
- Mesurez combien dépassent 100 000 jetons.
- Exécutez chaque type avec
lowetmedium. - Récupérez les valeurs
usage. - Appliquez les tarifs du tableau pour calculer le coût par appel et le coût mensuel.
Téléchargez Apidog pour centraliser vos requêtes, vos variables d’environnement et votre script de calcul dans un seul projet.
Originally published by Dev.to AI. Aggregated on AIWithGhost for educational purposes — full credit and traffic to the original publisher.