Claude Haiku 5.5 API Nasıl Kullanılır
Claude Haiku 5.5 API’yi çağırmak için https://api.anthropic.com/v1/messages adresine POST isteği gönderin. İstekte model: "claude-haiku-5-5", x-api-key başlığı ve anthropic-version: 2023-06-01 bulunmalıdır. Model, 100K t
Claude Haiku 5.5 API’yi çağırmak için https://api.anthropic.com/v1/messages adresine POST isteği gönderin. İstekte model: "claude-haiku-5-5", x-api-key başlığı ve anthropic-version: 2023-06-01 bulunmalıdır. Model, 100K token’a kadar olan istemlerde milyon giriş/çıkış token başına 0,10$/0,50$ maliyetlidir; 100K üzerindeki istemlerde bu ücret 0,50$/2,50$ olur. 1M token bağlam okuyabilir, 128K token üretebilir ve uyarlanabilir düşünme açıkken varsayılan çaba seviyesi medium’dür.
Anthropic, Haiku 5.5’i 7 Ekim 2026’da yayınladı. Bu, çaba seviyelerini destekleyen ilk Haiku sürümüdür. Claude Haiku 5.5 nedir yazısı modelin özelliklerini ve konumlandırmasını açıklar.
Bu rehberde ilk isteğinizi curl, Python ve TypeScript ile oluşturacak; ardından çaba, düşünme, önbellekleme, toplu işlem, ret durumları ve araç setlerini yapılandıracaksınız. İstekleri kaydetmek ve doğrulamak için Apidog kullanabilirsiniz.
Claude Haiku 5.5 API’ye hızlı bakış
| Parametre | Haiku 5.5 davranışı |
|---|---|
| Model kimliği |
claude-haiku-5-5 — Bedrock: anthropic.claude-haiku-5-5; ayrı takma ad yok |
| 100K token’a kadar istemler için MTok fiyatı | 0,10$ giriş, 0,50$ çıkış, 0,01$ önbellek okuma |
| 100K token üzeri istemler için MTok fiyatı | 0,50$ giriş, 2,50$ çıkış, 0,05$ önbellek okuma |
| Bağlam / maksimum çıkış | 1M / 128K; toplu işlemde output-300k-2026-03-24 beta başlığıyla 300K |
output_config.effort |
low, medium (varsayılan), high, xhigh, max
|
thinking |
Varsayılan olarak adaptive; yalnızca high veya daha düşük çaba seviyesinde disabled kullanılabilir |
thinking.display |
Varsayılan olarak boş thinking alanı; summarized okunabilir özet döndürür |
temperature, top_p, top_k
|
Varsayılan olmayan değerler 400 hatası döndürür |
| Asistan ön doldurma | Düşünme kapalı olsa bile 400 hatası döndürür |
| Minimum önbelleğe alınabilir istem | 512 token — Haiku 4.5’te 4.096 token |
Kaynaklar: Haiku 5.5 model sayfası ve Claude API fiyatlandırma belgeleri.
İlk Claude Haiku 5.5 API çağrınız
Claude Console’da bir API anahtarı oluşturun. Anthropic API anahtar kılavuzu bu süreci adım adım açıklar.
Anahtarı ortam değişkeni olarak tanımlayın:
export ANTHROPIC_API_KEY="anahtariniz"
API anahtarını kaynak koda, Git deposuna veya istemci tarafı uygulamasına yazmayın.
Ardından ilk isteği gönderin:
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 4096,
"output_config": {"effort": "medium"},
"thinking": {"type": "adaptive", "display": "summarized"},
"messages": [{
"role": "user",
"content": "Bu talebi faturalandırma, hata veya özellik isteği olarak sınıflandırın: Dışa aktarma düğmesi büyük projelerde zaman aşımına uğruyor."
}]
}'
Python ile çağrı
Python SDK, ANTHROPIC_API_KEY değişkenini ortamdan otomatik olarak alır:
import anthropic
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-haiku-5-5",
max_tokens=4096,
output_config={"effort": "medium"},
thinking={"type": "adaptive", "display": "summarized"},
messages=[
{
"role": "user",
"content": "Bu talebi faturalandırma, hata veya özellik isteği olarak sınıflandırın: Dışa aktarma düğmesi büyük projelerde zaman aşımına uğruyor."
}
],
)
for block in response.content:
if block.type == "thinking":
print("[thinking]", block.thinking)
elif block.type == "text":
print(block.text)
print(response.stop_reason, response.usage)
TypeScript ile çağrı
import Anthropic from "@anthropic-ai/sdk";
const client = new Anthropic();
const response = await client.messages.create({
model: "claude-haiku-5-5",
max_tokens: 4096,
output_config: { effort: "medium" },
thinking: { type: "adaptive", display: "summarized" },
messages: [
{
role: "user",
content:
"Bu talebi faturalandırma, hata veya özellik isteği olarak sınıflandırın: Dışa aktarma düğmesi büyük projelerde zaman aşımına uğruyor.",
},
],
});
for (const block of response.content) {
if (block.type === "text") {
console.log(block.text);
}
}
console.log(response.stop_reason, response.usage);
Uygulamanızda şu üç kuralı izleyin:
-
response.content[0].textvarsayımı yapmayın. Yanıt ilk olarakthinkingbloğuyla gelebilir; bloklarıtypealanına göre ayırın. -
max_tokensiçin yeterli pay bırakın. Düşünme tokenları da bu sınıra dahildir. - İstek gövdesini sade tutun.
temperature,top_p,top_k,budget_tokensveya asistan ön doldurma göndermeyin. Bu alanlar Haiku 5.5’te 400 hatasına neden olur.
Haiku 4.5’ten geçiş yapıyorsanız, Haiku 5.5 ve Haiku 4.5 karşılaştırma kılavuzu bozucu değişiklikleri önceki ve sonraki JSON örnekleriyle listeler.
Bir çaba seviyesi seçin
output_config.effort, kalite, gecikme ve maliyeti etkileyen temel ayardır. İstem kılavuzu şu başlangıç noktalarını önerir:
-
low: Sohbet, kısa araç görevleri ve yüksek hacimli basit istekler için en hızlı ve düşük maliyetli seçenek. -
medium: Varsayılan seviye. Aracı kodlama dahil çoğu iş yükü için buradan başlayın. -
high: Bilgi işleri, uzun aracı görevler ve katı talimat takibi için. -
xhighvemax: Yalnızca kendi değerlendirmeleriniz ölçülebilir bir kalite kazancı gösteriyorsa kullanın. Anthropic, aynı değerlendirmeleri Claude Sonnet 5.5 üzerinde de çalıştırıp karşılaştırmanızı önerir.
Anthropic’in OSWorld 2.1 çevrimdışı alt kümesi için yayınladığı sonuçlar:
| Çaba | Puan | Deneme başına maliyet |
|---|---|---|
low |
%42,0 | 0,0695$ |
medium |
%53,3 | 0,1257$ |
high |
%61,3 | 0,1827$ |
xhigh |
%67,6 | 0,2792$ |
max |
%72,4 | 0,6111$ |
xhigh seviyesinden max seviyesine geçmek, beş puanın altındaki artış için maliyeti iki kattan fazla yükseltir. Haiku 5.5 karşılaştırma dökümü diğer çaba seviyesi tablolarını içerir.
Çok turlu sohbetlerde xhigh seviyesinde model bazen tüm yanıtını düşünme bölümüne yazıp görünür metin üretmeden turu bitirebilir. Kullanıcıya yanıt göstermeden önce metin bloklarının boş olup olmadığını kontrol edin.
Düşünmeyi kontrol edin
Uyarlanabilir düşünme varsayılan olarak açıktır. Haiku 4.5’e göre iki önemli davranış değişikliği vardır:
- Varsayılan olarak düşünme metni gizlenir. Her
thinkingbloğu boş birthinkingalanı ve yalnızca birsignatureiçerebilir. - Günlüklerde veya kullanıcı arayüzünde okunabilir özet istiyorsanız
"display": "summarized"gönderin.
Daha az düşünme tokenı kullanmak için çaba seviyesini azaltın. Modeli doğrudan yanıt vermeye zorlayan istemler, Anthropic testlerinde düşünmeyi durdurmamıştır.
Düşünmeyi yalnızca high veya daha düşük çaba seviyelerinde kapatabilirsiniz:
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"thinking": { "type": "disabled" },
"output_config": { "effort": "low" },
"messages": [
{
"role": "user",
"content": "Fatura numarasını şuradan çıkarın: INV-2291, son tarih 3 Kasım."
}
]
}
Aynı gövdeyi xhigh veya max ile gönderirseniz API 400 hatası döndürür.
Zorunlu tool_choice ayarı (any veya adlandırılmış araç) kullanılabilir. Ancak yanıt araç çağrısıyla başlar ve düşünme bloğu içermez.
Çok turlu ya da araç kullanan akışlarda:
- Her
thinkingbloğunu değişmeden sonraki isteğe geri gönderin. - Geçmişi yalnızca ekleme yaparak koruyun.
- Döndürülen düşünme bloğundan önce
system,toolsveya öncekimessagesalanlarını değiştirmeyin.
Bu alanları değiştirmek 400 hatasına yol açabilir. Düşünme blokları yalnızca onları üreten hesapta veya bağlı bir hesapta çalışır.
İstemleri önbelleğe alın ve toplu işlem kullanın
Önbellekleme, tekrar eden büyük bağlamlarda Haiku 5.5 maliyetini düşürür.
100K token’a kadar olan istemler için:
- Taze giriş: milyon token başına 0,10$
- Önbellek okuma: milyon token başına 0,01$
- 5 dakikalık önbellek yazma: milyon token başına 0,125$
- 1 saatlik önbellek yazma: milyon token başına 0,20$
Minimum önbelleğe alınabilir istem artık 512 token’dır. Haiku 4.5’te bu sınır 4.096 token’dı. Bu nedenle kısa sistem istemleri ve araç listeleri de önbellekleme için uygundur.
Kararlı sistem önekini cache_control ile işaretleyin:
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"system": [
{
"type": "text",
"text": "Siz bir destek triyaj asistanısınız. <burada uzun, kararlı politika metni>",
"cache_control": { "type": "ephemeral" }
}
],
"messages": [
{
"role": "user",
"content": "Talep: 10 gün sonra iade alınmadı."
}
]
}
İstekler arasında üst düzey effort değerini değiştirmek önbelleği geçersiz kılar. Mesaj başına çaba ayarı, mid-conversation-output-config-2026-07-01 beta başlığıyla Claude API ve Google Cloud’da bu önbelleği korur.
TTL ayrıntıları için istem önbelleğe alma belgelerine, kavramsal açıklama için istem önbelleğe alma rehberine bakın.
Bekleyebilen işler için Mesaj Toplu İşlem API’sini kullanın. Giriş ve çıkış maliyeti %50 azalır:
- 100K token’a kadar: 0,05$ giriş / 0,25$ çıkış
- 100K token üzeri: 0,25$ giriş / 1,25$ çıkış
Toplu işlem, output-300k-2026-03-24 beta başlığıyla 300K çıkış tokenına ulaşmanın da tek yoludur.
100K sınırını dikkatle yönetin: Anthropic’e göre 100.000 token’dan uzun bir istem, daha yüksek fiyatlandırmaya tabi olur.
Haiku 5.5 fiyatlandırma kılavuzu her iki fiyatlandırma eşiği için örnekler içerir.
stop_reason: "refusal" durumunu ele alın
Haiku 5.5, bir isteği reddedebilen güvenlik sınıflandırıcıları kullanır. Sunucu tarafında otomatik geri dönüş yoktur.
Reddedilen isteklerde şu değer döner:
{
"stop_reason": "refusal"
}
Olası kategoriler:
cyberfrontier_llmbiogeneral_harms
Haiku 4.5’ten geçiyorsanız bu ret davranışının yeni olduğunu unutmayın. Aynı isteği körü körüne tekrar göndermek genellikle başka bir ret üretir.
Python’da retleri açıkça yönetin:
def run(client, messages):
response = client.messages.create(
model="claude-haiku-5-5",
max_tokens=4096,
messages=messages,
)
if response.stop_reason == "refusal":
details = getattr(response, "stop_details", None)
category = getattr(details, "category", "unknown")
log_refusal(category, messages) # sizin günlüklemeniz
return {
"status": "refused",
"category": category,
}
text = "".join(
block.text
for block in response.content
if block.type == "text"
)
return {
"status": "ok",
"text": text,
}
content alanını işlemeye başlamadan önce stop_reason değerine göre dallanın. Retleri uygulamanızda insan incelemesine veya başka bir modele yönlendirin.
cyber veya bio sınıflandırıcıları nedeniyle engellenen meşru güvenlik ya da yaşam bilimleri çalışmaları için ekipler Anthropic’in Siber Doğrulama Programı veya Yaşam Bilimleri Doğrulama Programına başvurabilir.
Bilgisayar kullanımı ve tarayıcı kullanımı
Claude API ve Google Cloud üzerinde Haiku 5.5:
- Bilgisayar kullanımını yalnızca
computer_toolset_20260801araç setiyle destekler. - Bu araç seti beta başlığı gerektirmez.
- Eski
computer_20250124aracını göndermek 400 hatası döndürür. - Tarayıcı kullanımını
browser_toolset_20260801ile destekler. Haiku 4.5 bu araç setini desteklemiyordu.
Python ve TypeScript SDK’leri, lansman gününde her iki araç seti için beta sınıfları ekledi. Üye araçlar ve kullanım akışı için bilgisayar kullanım aracı belgelerine bakın.
Oran sınırlamaları
Haiku 5.5, Haiku 4.5 ile aynı oran sınırlamalarını kullanır:
| Katman | Dakikadaki istek | Giriş tokenı | Çıkış tokenı |
|---|---|---|---|
| Başlangıç | 1.000 | 2M | 400K |
| Ölçek | 10.000 | 10M | 2M |
Öncelik Katmanı desteklenmez.
429 hatalarını yönetmek için oran sınırlaması aşıldı kılavuzuna bakın.
Claude Haiku 5.5 API’yi Apidog’da test edin
Kaydedilmiş istekler, çaba seviyesi karşılaştırmalarını ve ret hata ayıklamasını tekrarlanabilir hale getirir. Apidog ile şu kurulumu yapın:
- Bir ortam oluşturun ve
ANTHROPIC_API_KEYdeğerini gizli değişken olarak ekleyin. -
x-api-keybaşlığında{{ANTHROPIC_API_KEY}}kullanın. Ayrıcaanthropic-version: 2023-06-01vecontent-type: application/jsonbaşlıklarını ekleyin. -
https://api.anthropic.com/v1/messagesadresine birPOSTisteği oluşturun, ilk çağrı gövdesini yapıştırın ve kaydedin. - Şu doğrulamaları ekleyin:
- Durum kodu
200 -
$.stop_reasondeğeriend_turn -
$.usage.output_tokensdeğeri0’dan büyük -
$.content[*].typealanıtextiçeriyor
- Durum kodu
- İsteği
low,high,xhighvemaxiçin çoğaltın. Klasörü çalıştırarak her çaba seviyesi içinusageverisini karşılaştırın. - Önbelleğe alınmış sistem istemi varyantını ekleyin. İkinci çalıştırmada
$.usage.cache_read_input_tokensdeğerinin0’dan büyük olduğunu doğrulayın.
Bu doğrulamalar, ret yanıtlarının veya boş xhigh yanıtlarının yanlışlıkla başarılı test olarak geçmesini engeller.
Daha geniş test kalıpları için LLM uygulamalarını test etme rehberine bakın.
Sıkça sorulan sorular
Claude Haiku 5.5 model kimliği nedir?
Claude API, Google Cloud, Microsoft Foundry ve AWS’deki Claude Platform için model kimliği claude-haiku-5-5 değeridir. Tarih son eki veya ayrı takma ad yoktur. Amazon Bedrock’ta anthropic.claude-haiku-5-5 kullanılır.
Ücretsiz Claude Haiku 5.5 API var mı?
Sürekli bir ücretsiz katman yoktur. Yeni API kullanıcıları API’yi denemek için küçük miktarda ücretsiz kredi alabilir. Ücretsiz Claude.ai kullanıcıları sohbet içinde Haiku 5.5’i seçebilir; ancak bu, API anahtarı sağlamaz.
Max ve Ekip planları artık aylık API kredileri içerir. Ayrıntılar için ücretsiz erişim kılavuzuna bakın.
Haiku 4.5 isteğim neden 400 döndürüyor?
Şu alanları kontrol edin:
budget_tokens- Varsayılan olmayan
temperature - Varsayılan olmayan
top_p - Herhangi bir
top_k - Asistan ön doldurma
- Eski
computer_20250124aracı
Bu alanlar en yaygın 400 hata nedenleridir.
Haiku 5.5’i Claude Code’da kullanabilir miyim?
Evet. v2.1.293 sürümünden itibaren kullanılabilir. Anthropic API’deki haiku takma adı Haiku 5.5’e çözümlenir. Daha fazla bilgi için Claude Code’da Claude Haiku 5.5 rehberine bakın.
Aracı kodlama için Haiku 5.5 mi, Sonnet 5.5 mi kullanmalıyım?
Anthropic, Sonnet 5.5 ve Opus 5.5’in karmaşık aracı kodlama görevleri için daha iyi seçenekler olmaya devam ettiğini belirtir.
Haiku 5.5’i şu dar kapsamlı işler için tercih edin:
- Sınıflandırma
- Özetleme
- Sıkıştırma
- Alt ajan görevleri
- Tarayıcı kullanımı
Sonraki adım
İlk isteği medium çaba seviyesiyle çalıştırın. Ardından kendi iş yükünüzden gerçekçi bir istem seçin ve aynı isteği low ile high seviyelerinde yeniden gönderin.
Karşılaştırırken en az şu metrikleri kaydedin:
- Yanıt kalitesi
usage.output_tokens- Gecikme
- İstek başına maliyet
stop_reason
Üç çalıştırmayı doğrulamalarla saklamak için Apidog’u indirin. Böylece sonraki model sürümünde yalnızca model alanını değiştirerek aynı test setini tekrar çalıştırabilirsiniz.
Originally published by Dev.to AI. Aggregated on AIWithGhost for educational purposes — full credit and traffic to the original publisher.