Claude Haiku 5.5 vs Haiku 4.5: Apa yang Berubah dan Perubahan Merusak yang Harus Diperbaiki Pertama
Claude Haiku 5.5 (claude-haiku-5-5, dirilis 7 Oktober 2026) berharga 90% lebih murah daripada Haiku 4.5 untuk prompt hingga 100K token ($0,10/$0,50 per juta token input/output vs. $1/$5). Model ini memiliki jendela konte
Claude Haiku 5.5 (claude-haiku-5-5, dirilis 7 Oktober 2026) berharga 90% lebih murah daripada Haiku 4.5 untuk prompt hingga 100K token ($0,10/$0,50 per juta token input/output vs. $1/$5). Model ini memiliki jendela konteks 1M token, bukan 200K, serta skor lebih tinggi pada setiap tolok ukur peluncuran yang mencantumkan keduanya. Namun, lima pola request yang valid di 4.5 akan mengembalikan 400 di 5.5, sementara perubahan lain dapat mengubah respons atau biaya tanpa memunculkan error.
Artikel ini mencakup perbandingan model, perubahan breaking dengan JSON sebelum/sesudah, perubahan senyap, dan rencana pengujian di Apidog. Untuk spesifikasi lengkap, baca apa itu Claude Haiku 5.5. Jika Anda masih memakai model lama, lihat panduan API Claude Haiku 4.5.
Haiku 4.5 vs. Haiku 5.5 Sekilas
| Claude Haiku 4.5 | Claude Haiku 5.5 | |
|---|---|---|
| ID model (Claude API) | claude-haiku-4-5-20251001 |
claude-haiku-5-5 |
| Konteks / output maks. | 200K / 64K | 1M / 128K |
| Input / output per MTok | $1 / $5 | $0,10 / $0,50 hingga 100K token; $0,50 / $2,50 di atas itu |
| Baca cache / tulis 5m per MTok | $0,10 / $1,25 | $0,01 / $0,125 hingga 100K; $0,05 / $0,625 di atas itu |
| Input / output batch per MTok | $0,50 / $2,50 | $0,05 / $0,25 hingga 100K; $0,25 / $1,25 di atas itu |
| Thinking |
budget_tokens manual |
Hanya adaptif, aktif secara default |
| Tingkat upaya | Tidak ada |
low, medium (default), high, xhigh, max
|
| Prompt minimum yang bisa di-cache | 4.096 token | 512 token |
| Tokenisasi | Lebih hemat | Sekitar 30% lebih banyak token untuk teks yang sama |
| Parameter sampling non-default dan prefill | Diterima | Error 400 |
| Tingkat Prioritas | Didukung | Tidak didukung |
| Status | Aktif, pensiun tidak lebih cepat dari 15 Okt 2026 | Aktif, pensiun tidak lebih cepat dari 7 Okt 2027 |
Haiku 4.5 belum usang. Halaman model usang mencantumkannya sebagai aktif tanpa tanggal penghentian, sehingga Anda dapat memigrasikan aplikasi sesuai jadwal. Batas kecepatan juga sama pada kedua model.
Lima perubahan breaking
Setiap perubahan berikut mengembalikan 400 di Haiku 5.5 untuk request yang sebelumnya bekerja di Haiku 4.5. Lihat daftar resminya di panduan migrasi Haiku 5.5.
1. Thinking manual dengan budget_tokens
Haiku 5.5 hanya mendukung thinking adaptif. Anggaran thinking tetap ditolak.
// Sebelum: Haiku 4.5
{
"model": "claude-haiku-4-5-20251001",
"max_tokens": 16000,
"thinking": { "type": "enabled", "budget_tokens": 8000 },
"messages": [{ "role": "user", "content": "Classify this ticket." }]
}
// Sesudah: Haiku 5.5
{
"model": "claude-haiku-5-5",
"max_tokens": 16000,
"thinking": { "type": "adaptive" },
"output_config": { "effort": "medium" },
"messages": [{ "role": "user", "content": "Classify this ticket." }]
}
Gunakan output_config.effort sebagai pengganti anggaran manual:
- Anggaran kecil di 4.5 β gunakan
low - Default umum β gunakan
medium - Penalaran yang lebih kompleks β gunakan
high,xhigh, ataumax
Anda masih dapat mengirim thinking: {"type": "disabled"}, tetapi hanya hingga effort high. Pada xhigh atau max, konfigurasi tersebut juga menghasilkan 400.
2. Parameter sampling
Hapus temperature, top_p, dan top_k dari request migrasi.
Nilai yang diterima hanya:
temperature: 1top_p: 0.99
Nilai lain menghasilkan 400, termasuk:
temperature: 0.2top_p: 1- Nilai
top_kapa pun - Mengirim
temperaturedantop_psecara bersamaan
// Sebelum: Haiku 4.5
{
"model": "claude-haiku-4-5-20251001",
"max_tokens": 1024,
"temperature": 0.2,
"top_k": 40,
"messages": [
{ "role": "user", "content": "Extract the order ID." }
]
}
// Sesudah: Haiku 5.5
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"messages": [
{ "role": "user", "content": "Extract the order ID." }
]
}
Jika Anda sebelumnya memakai suhu rendah untuk hasil yang konsisten, nyatakan batasan itu di prompt. Misalnya: βReturn only one JSON object using the schema below.β
3. Prefill asisten
Giliran assistant terakhir untuk melanjutkan output tidak lagi didukung, bahkan ketika thinking dimatikan. Request harus berakhir dengan pesan user.
// Sebelum: Haiku 4.5
{
"model": "claude-haiku-4-5-20251001",
"max_tokens": 1024,
"messages": [
{ "role": "user", "content": "Return the sentiment as JSON." },
{ "role": "assistant", "content": "{\"sentiment\": \"" }
]
}
// Sesudah: Haiku 5.5
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"system": "Reply with only a JSON object. No preamble.",
"messages": [
{ "role": "user", "content": "Return the sentiment as JSON." }
]
}
Untuk format output yang ketat, gunakan output terstruktur atau tool dengan bidang enum untuk kasus klasifikasi.
4. Computer use: computer_20250124 ke computer_toolset_20260801
Di Claude API dan Google Cloud, Haiku 5.5 hanya mendukung computer use melalui toolset baru.
Tindakan migrasi:
- Hapus header beta
computer-use-2025-01-24. - Hapus
fine-grained-tool-streaming-2025-05-14bila masih dikirim. - Ganti tool lama dengan
computer_toolset_20260801.
// Sebelum: Haiku 4.5
// Header: anthropic-beta: computer-use-2025-01-24
{
"model": "claude-haiku-4-5-20251001",
"max_tokens": 4096,
"tools": [
{
"type": "computer_20250124",
"name": "computer",
"display_width_px": 1280,
"display_height_px": 800
}
],
"messages": [
{ "role": "user", "content": "Open the settings page." }
]
}
// Sesudah: Haiku 5.5, tanpa header beta
{
"model": "claude-haiku-5-5",
"max_tokens": 4096,
"tools": [
{ "type": "computer_toolset_20260801" }
],
"messages": [
{ "role": "user", "content": "Open the settings page." }
]
}
Loop agen juga berubah:
- Gunakan
namedantoolset_namepada setiap bloktool_use. - Jangan lagi mengandalkan
input.action. - Sertakan
toolset_namesaat mengembalikan hasil tool.
Haiku 5.5 juga memperoleh browser tool melalui browser_toolset_20260801, yang tidak didukung Haiku 4.5. Lihat penggunaan komputer Claude Code untuk konteks lebih luas.
5. Mengedit giliran sebelumnya sebelum blok thinking
Blok thinking Haiku 5.5 hanya valid jika seluruh konteks sebelumnya tidak berubah. Jika Anda mengubah system, tools, atau pesan terdahulu lalu mengirim ulang blok thinking, API mengembalikan 400.
// Sebelum: system diubah + blok thinking diputar ulang = 400
{
"model": "claude-haiku-5-5",
"max_tokens": 4096,
"system": "You are a billing agent. Be brief.",
"messages": [
{ "role": "user", "content": "Why was I charged twice?" },
{
"role": "assistant",
"content": [
{
"type": "thinking",
"thinking": "",
"signature": "<from turn 1>"
},
{ "type": "text", "text": "Checking." }
]
},
{ "role": "user", "content": "Order 4412." }
]
}
// Sesudah: konteks sebelumnya tidak berubah
{
"model": "claude-haiku-5-5",
"max_tokens": 4096,
"system": "You are a billing agent.",
"messages": [
{ "role": "user", "content": "Why was I charged twice?" },
{
"role": "assistant",
"content": [
{
"type": "thinking",
"thinking": "",
"signature": "<from turn 1>"
},
{ "type": "text", "text": "Checking." }
]
},
{ "role": "user", "content": "Order 4412. Be brief." }
]
}
Masukkan instruksi baru ke pesan pengguna terbaru, bukan dengan mengubah konteks yang sudah terikat ke blok thinking.
Pada akun yang dibuat sebelum 31 Agustus 2026 pukul 00:00 UTC, error ini hanya muncul pada request yang mengatur thinking.block_binding.prefix_mismatch_behavior.
Perubahan senyap yang tidak menghasilkan error
-
Bidang thinking kosong secara default. Blok
thinkingkini mengembalikanthinkingkosong dansignature. Haiku 4.5 mengembalikan ringkasan reasoning. Jika Anda perlu mencatat atau menampilkannya, gunakanthinking: {"type": "adaptive", "display": "summarized"}. -
Respons dapat dimulai dengan thinking. Thinking adaptif aktif secara default. Cari blok berdasarkan
type, bukan indeks array konten. -
Sekitar 30% lebih banyak token. Tokenizer baru menghitung teks yang sama sebagai sekitar 30% lebih banyak token. Hitung ulang ukuran prompt dan ingat bahwa token thinking juga dihitung ke
max_tokens. -
max_tokenskecil dapat menghentikan respons sebelum teks keluar. Respons dapat berakhir denganstop_reason: "max_tokens"tanpa blok teks jika token thinking telah memakai anggaran. -
tool_choicepaksa melewati thinking.anyatau tool bernama tetap bekerja, tetapi respons langsung dimulai dengan tool call tanpa blokthinking. Gunakantool_choice: {"type": "auto"}bila model perlu bernalar sebelum memilih tool. -
Penolakan baru tanpa fallback. Haiku 5.5 menjalankan pengklasifikasi keamanan (
cyber,frontier_llm,bio,general_harms) yang dapat mengembalikanstop_reason: "refusal". Retry biasanya akan ditolak lagi. - Tingkat Prioritas dihapus. Jika Anda memakai komitmen Tingkat Prioritas di Haiku 4.5, rencanakan kapasitas secara terpisah.
- Blok thinking terikat akun. Blok hanya dapat digunakan di akun pembuatnya atau akun yang terhubung. Jangan memutar ulang percakapan yang tersimpan melalui akun lain sambil mempertahankan reasoning tersebut.
- Caching lebih murah dan aktif lebih cepat. Prompt minimum yang dapat di-cache turun dari 4.096 menjadi 512 token. Prompt sistem pendek yang tidak bisa di-cache di 4.5 kini dapat di-cache.
Apa yang menjadi lebih baik
Berikut angka yang dilaporkan Anthropic untuk Haiku 5.5 pada effort maksimum. Artificial Analysis menjalankan GDPval-AA dan AA-Briefcase secara independen.
| Tolok ukur | Haiku 4.5 | Haiku 5.5 |
|---|---|---|
| GDPval-AA v2.1 (Elo) | 735 | 1620 |
| AA-Briefcase v1.1 (Elo) | 614 | 1578 |
| OSWorld 2.1, subset offline | 15,7% | 72,4% |
| Ujian Terakhir Manusia, dengan tool | 18,7% | 57,4% |
| Terminal-Bench 4.0 | 0,0% | 39,2% |
| SWE-bench Multibahasa | 67,4% | 83,7% |
| Kartografi, tanpa tool | 6,4% | 46,4% |
Jalur Terminal-Bench Haiku 4.5 memakai anggaran thinking tetap 63.999 token. Pada effort default medium, Haiku 5.5 mencetak 1277 di GDPval-AA, masih jauh di atas 4.5.
Box melaporkan skor 11 poin lebih tinggi dibanding Haiku 4.5 dengan latensi sekitar setengahnya. Lihat tolok ukur Claude Haiku 5.5 untuk tabel lengkap.
Anthropic masih memosisikan Sonnet 5.5 dan Opus 5.5 sebagai pilihan lebih baik untuk pengodean agen yang kompleks. Haiku 5.5 ditujukan untuk klasifikasi, ekstraksi, ringkasan, pemadatan, subagen, dan browser use.
Dari sisi biaya, Anthropic menyatakan Haiku 5.5 rata-rata sekitar 75% lebih murah. Perhitungan ini menggabungkan harga 90% lebih rendah hingga 100K token dan 50% lebih rendah di atas batas tersebut, termasuk token ekstra dari tokenizer baru. Prompt sistem untuk tool use juga menyusut dari 496 menjadi 286 token dengan pilihan tool auto.
Contoh perhitungan tersedia di harga Claude Haiku 5.5.
Uji migrasi di Apidog
Di Apidog, buat satu proyek dengan tiga request tersimpan ke:
https://api.anthropic.com/v1/messages
Buat tiga request berikut:
Dasar
Gunakan body Haiku 4.5 saat ini. Tambahkan assertion untuk status200.Body lama, model baru
Ubah hanyamodelmenjadiclaude-haiku-5-5. Tambahkan assertion untuk status400. Simpan salinan terpisah untuk setiap perubahan breaking yang ditemukan.-
Dimigrasikan
Gunakan body yang sudah diperbaiki. Tambahkan assertion untuk:- Status
200 -
stop_reasonbukanrefusal -
stop_reasonbukanmax_tokens - Blok teks ditemukan berdasarkan
type, bukan posisi indeks
- Status
Simpan ANTHROPIC_API_KEY sebagai environment variable dan gunakan di header:
x-api-key: {{ANTHROPIC_API_KEY}}
anthropic-version: 2023-06-01
Bandingkan usage.input_tokens antara request dasar dan request hasil migrasi untuk mengukur dampak tokenizer baru terhadap prompt Anda sendiri.
Simpan kumpulan request ini sebagai test scenario. Dengan begitu, perubahan seperti memasukkan kembali temperature akan menggagalkan test sebelum masuk ke produksi. Untuk dasar request, lihat cara menggunakan API Claude Haiku 5.5.
Jika Anda bekerja di Claude Code, jalankan:
/claude-api migrate this project to claude-haiku-5-5
Perintah tersebut menerapkan perubahan ID model dan perbaikan parameter, lalu menghasilkan daftar periksa. Perhatikan bahwa alias haiku hanya menunjuk ke Haiku 5.5 di Anthropic API. Lihat Claude Haiku 5.5 di Claude Code.
FAQ
Apakah Claude Haiku 4.5 usang?
Tidak. Model ini terdaftar sebagai aktif tanpa tanggal usang dan pensiunnya tidak lebih cepat dari 15 Oktober 2026.
Mengapa request Haiku 4.5 saya mengembalikan 400 di Haiku 5.5?
Periksa budget_tokens, temperature, top_p, top_k, prefill asisten, computer_20250124, serta pengeditan konteks sebelum blok thinking. Itu adalah lima perubahan breaking utama.
Apakah Haiku 5.5 lebih murah untuk prompt panjang?
Ya. Untuk prompt di atas 100K token, harganya $0,50/$2,50 per juta token, yaitu setengah dari $1/$5 di Haiku 4.5. Haiku 4.5 juga tidak dapat menerima prompt di atas 200K token.
Haruskah semua workload dipindahkan ke Haiku 5.5?
Untuk klasifikasi, ekstraksi, dan subagen, uji dahulu lalu migrasikan. Bandingkan dengan alternatif terdekat di Haiku 5.5 vs GPT-6 Luna.
Langkah selanjutnya
Simpan setiap request Haiku 4.5 berdampingan dengan versi Haiku 5.5-nya. Konfirmasi error 400 pada body lama, perbaiki satu per satu, lalu alihkan traffic setelah request yang dimigrasikan lulus pengujian.
Unduh Apidog untuk membuat pasangan request dan test scenario tersebut.
Originally published by Dev.to AI. Aggregated on AIWithGhost for educational purposes β full credit and traffic to the original publisher.