Claude Haiku 5.5 vs Haiku 4.5: อัปเดตใหม่ ความแตกต่าง และจุดที่ต้องแก้ไขด่วน
Claude Haiku 5.5 (claude-haiku-5-5, เปิดตัว 7 ตุลาคม 2026) มีราคาถูกกว่า Haiku 4.5 ถึง 90% สำหรับ prompts สูงสุด 100K โทเค็น: $0.10/$0.50 ต่อล้านโทเค็นอินพุต/เอาต์พุต เทียบกับ $1/$5 มี context window ขนาด 1M โทเค็นแทน 20
Claude Haiku 5.5 (claude-haiku-5-5, เปิดตัว 7 ตุลาคม 2026) มีราคาถูกกว่า Haiku 4.5 ถึง 90% สำหรับ prompts สูงสุด 100K โทเค็น: $0.10/$0.50 ต่อล้านโทเค็นอินพุต/เอาต์พุต เทียบกับ $1/$5 มี context window ขนาด 1M โทเค็นแทน 200K และได้คะแนนสูงกว่ามากในเกณฑ์มาตรฐานที่ระบุ อย่างไรก็ตาม คำขอ 5 รูปแบบที่ใช้ได้กับ 4.5 จะส่งคืน 400 บน 5.5 และยังมีการเปลี่ยนแปลงที่กระทบผลลัพธ์และค่าใช้จ่ายโดยไม่เกิดข้อผิดพลาด
บทความนี้สรุปความต่างของรุ่น, JSON ก่อน/หลังสำหรับการเปลี่ยนแปลงที่กระทบระบบ, รายการพฤติกรรมที่เปลี่ยนแบบไม่แจ้งข้อผิดพลาด และแผนทดสอบการย้ายข้อมูลด้วย Apidog ดูข้อมูลจำเพาะเพิ่มเติมได้ที่ Claude Haiku 5.5 คืออะไร และหากยังใช้รุ่นเดิม โปรดดู API ของ Claude Haiku 4.5
Haiku 4.5 เทียบกับ Haiku 5.5 โดยสรุป
| Claude Haiku 4.5 | Claude Haiku 5.5 | |
|---|---|---|
| รหัสโมเดล (Claude API) | claude-haiku-4-5-20251001 |
claude-haiku-5-5 |
| บริบท / เอาต์พุตสูงสุด | 200K / 64K | 1M / 128K |
| อินพุต / เอาต์พุต ต่อ MTok | $1 / $5 | $0.10 / $0.50 สำหรับ prompts สูงสุด 100K โทเค็น; $0.50 / $2.50 สำหรับส่วนที่เกิน |
| อ่านแคช / เขียน 5 นาที ต่อ MTok | $0.10 / $1.25 | $0.01 / $0.125 สูงสุด 100K; $0.05 / $0.625 สำหรับส่วนที่เกิน |
| อินพุต / เอาต์พุตแบบ Batch ต่อ MTok | $0.50 / $2.50 | $0.05 / $0.25 สูงสุด 100K; $0.25 / $1.25 สำหรับส่วนที่เกิน |
| การคิด (Thinking) |
budget_tokens แบบกำหนดเอง |
ปรับอัตโนมัติเท่านั้น และเปิดใช้งานโดยค่าเริ่มต้น |
| ระดับความพยายาม (Effort levels) | ไม่มี | ต่ำ, ปานกลาง (ค่าเริ่มต้น), สูง, สูงมาก, สูงสุด |
| Prompt ที่สามารถแคชได้ขั้นต่ำ | 4,096 โทเค็น | 512 โทเค็น |
| Tokenization | แบบเก่า | จำนวนโทเค็นสูงขึ้นประมาณ 30% สำหรับข้อความเดียวกัน |
| พารามิเตอร์การสุ่มตัวอย่างที่ไม่ใช่ค่าเริ่มต้น / prefill | ยอมรับ | ส่งคืน 400 |
| Priority Tier | รองรับ | ไม่รองรับ |
| สถานะ | ใช้งานอยู่, จะไม่เลิกใช้งานก่อน 15 ต.ค. 2026 | ใช้งานอยู่, จะไม่เลิกใช้งานก่อน 7 ต.ค. 2027 |
Haiku 4.5 ยังไม่ถูกยกเลิก โดยหน้า การยกเลิกโมเดล ระบุว่ายังคงใช้งานอยู่และไม่มีกำหนดวันยกเลิก คุณจึงสามารถวางแผนย้ายข้อมูลตามรอบการพัฒนาของทีมได้ ขีดจำกัดอัตรา (rate limits) ยังคงเหมือนกันระหว่างทั้งสองรุ่น
การเปลี่ยนแปลงหลักห้าประการ
รายการต่อไปนี้ทำให้ body ที่ทำงานบน Haiku 4.5 ส่งคืน 400 เมื่อเปลี่ยนเป็น Haiku 5.5 ตรวจสอบรายละเอียดเพิ่มเติมจาก คู่มือย้ายข้อมูล Haiku 5.5
1. เลิกใช้การคิดแบบกำหนดเองด้วย budget_tokens
Haiku 5.5 รองรับเฉพาะ adaptive thinking และจะปฏิเสธงบประมาณการคิดที่กำหนดล่วงหน้า
// ก่อน: Haiku 4.5
{
"model": "claude-haiku-4-5-20251001",
"max_tokens": 16000,
"thinking": { "type": "enabled", "budget_tokens": 8000 },
"messages": [
{ "role": "user", "content": "Classify this ticket." }
]
}
// หลัง: Haiku 5.5
{
"model": "claude-haiku-5-5",
"max_tokens": 16000,
"thinking": { "type": "adaptive" },
"output_config": { "effort": "medium" },
"messages": [
{ "role": "user", "content": "Classify this ticket." }
]
}
ใช้ output_config.effort แทนการควบคุมงบประมาณโดยตรง:
- งานที่เคยใช้
budget_tokensต่ำ: เริ่มทดสอบด้วยlow - งานทั่วไป: ใช้
medium - งานที่ต้องใช้เหตุผลมาก: ทดสอบ
highขึ้นไป
ยังส่ง thinking: { "type": "disabled" } ได้ แต่ต้องใช้ effort ระดับ high หรือต่ำกว่า หากใช้ xhigh หรือ max จะได้รับ 400
2. ลบพารามิเตอร์การสุ่มตัวอย่าง
ลบ temperature, top_p และ top_k ออกจาก request โดย Haiku 5.5 ยอมรับเพียง:
temperature: 1top_p: 0.99
ค่าอื่นทั้งหมด รวมถึง top_p: 1, top_k ทุกค่า หรือการส่ง temperature และ top_p พร้อมกัน จะส่งคืน 400
// ก่อน: Haiku 4.5
{
"model": "claude-haiku-4-5-20251001",
"max_tokens": 1024,
"temperature": 0.2,
"top_k": 40,
"messages": [
{ "role": "user", "content": "Extract the order ID." }
]
}
// หลัง: Haiku 5.5
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"messages": [
{ "role": "user", "content": "Extract the order ID." }
]
}
หากเดิมใช้ temperature ต่ำเพื่อให้ผลลัพธ์สม่ำเสมอ ให้ย้ายข้อกำหนดนั้นไปไว้ใน prompt เช่น ระบุรูปแบบเอาต์พุต ฟิลด์ที่ต้องมี และข้อห้ามอย่างชัดเจน
3. เลิกใช้ Assistant prefill
Haiku 5.5 ปฏิเสธการลงท้าย messages ด้วยข้อความจาก assistant เพื่อให้โมเดลตอบต่อ แม้ปิด thinking ไว้ก็ตาม ให้จบรายการข้อความด้วย user แทน
// ก่อน: Haiku 4.5
{
"model": "claude-haiku-4-5-20251001",
"max_tokens": 1024,
"messages": [
{ "role": "user", "content": "Return the sentiment as JSON." },
{ "role": "assistant", "content": "{\"sentiment\": \"" }
]
}
// หลัง: Haiku 5.5
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"system": "Reply with only a JSON object. No preamble.",
"messages": [
{ "role": "user", "content": "Return the sentiment as JSON." }
]
}
หากต้องการรูปแบบผลลัพธ์ที่เข้มงวด ให้ใช้ structured outputs หรือกำหนดเครื่องมือที่มีฟิลด์ enum สำหรับงานจัดหมวดหมู่
4. เปลี่ยน computer_20250124 เป็น computer_toolset_20260801
บน Claude API และ Google Cloud, Haiku 5.5 รองรับ computer use ผ่าน toolset ใหม่เท่านั้น
สิ่งที่ต้องทำ:
- ลบ beta header
computer-use-2025-01-24 - ลบ
fine-grained-tool-streaming-2025-05-14หากส่งอยู่ - เปลี่ยน tool type เป็น
computer_toolset_20260801
// ก่อน: Haiku 4.5
// header: anthropic-beta: computer-use-2025-01-24
{
"model": "claude-haiku-4-5-20251001",
"max_tokens": 4096,
"tools": [
{
"type": "computer_20250124",
"name": "computer",
"display_width_px": 1280,
"display_height_px": 800
}
],
"messages": [
{ "role": "user", "content": "Open the settings page." }
]
}
// หลัง: Haiku 5.5
// ไม่ต้องมี beta header
{
"model": "claude-haiku-5-5",
"max_tokens": 4096,
"tools": [
{ "type": "computer_toolset_20260801" }
],
"messages": [
{ "role": "user", "content": "Open the settings page." }
]
}
Agent loop ต้องปรับเช่นกัน:
- อ่าน
nameและtoolset_nameจากแต่ละtool_useblock - ไม่พึ่ง
input.actionแบบเดิม - ส่ง
toolset_nameกลับในผลลัพธ์ของเครื่องมือ
Haiku 5.5 ยังรองรับ browser toolset (browser_toolset_20260801) ซึ่งไม่มีใน Haiku 4.5 ดูภาพรวมเพิ่มเติมได้ที่ การใช้งานคอมพิวเตอร์ของ Claude Code
5. ห้ามแก้ไขเทิร์นก่อนหน้าก่อน replay thinking block
Thinking block ของ Haiku 5.5 ใช้ได้ต่อเมื่อข้อมูลทั้งหมดก่อน block นั้นไม่เปลี่ยนแปลง หากแก้ไข system, tools หรือข้อความก่อนหน้า แล้วส่ง thinking block เดิมกลับไป จะได้รับ 400
ตัวอย่าง: เทิร์นแรกใช้ "system": "You are a billing agent." จากนั้นเทิร์นสองพยายามแก้ไข system prompt
// ก่อน: แก้ system แล้ว replay thinking block = 400
{
"model": "claude-haiku-5-5",
"max_tokens": 4096,
"system": "You are a billing agent. Be brief.",
"messages": [
{ "role": "user", "content": "Why was I charged twice?" },
{
"role": "assistant",
"content": [
{
"type": "thinking",
"thinking": "",
"signature": "<from turn 1>"
},
{ "type": "text", "text": "Checking." }
]
},
{ "role": "user", "content": "Order 4412." }
]
}
// หลัง: คงข้อมูลก่อนหน้าเดิม แล้วเพิ่มคำสั่งในข้อความใหม่
{
"model": "claude-haiku-5-5",
"max_tokens": 4096,
"system": "You are a billing agent.",
"messages": [
{ "role": "user", "content": "Why was I charged twice?" },
{
"role": "assistant",
"content": [
{
"type": "thinking",
"thinking": "",
"signature": "<from turn 1>"
},
{ "type": "text", "text": "Checking." }
]
},
{ "role": "user", "content": "Order 4412. Be brief." }
]
}
สำหรับบัญชีที่สร้างก่อน 31 สิงหาคม 2026 เวลา 00:00 UTC ข้อผิดพลาดนี้จะเกิดเฉพาะเมื่อ request ตั้งค่า thinking.block_binding.prefix_mismatch_behavior
การเปลี่ยนแปลงที่ไม่แจ้งให้ทราบซึ่งไม่ก่อให้เกิดข้อผิดพลาด
-
ฟิลด์
thinkingว่างเปล่าโดยค่าเริ่มต้น แต่ละ thinking block จะมีthinkingว่างและมีเพียงsignatureเท่านั้น ต่างจาก Haiku 4.5 ที่ส่งคืนข้อความสรุปการคิด หากต้องบันทึกหรือแสดงผล ให้ตั้งค่า:
{
"thinking": {
"type": "adaptive",
"display": "summarized"
}
}
คำตอบอาจเริ่มต้นด้วย thinking block
Adaptive thinking เปิดใช้งานโดยค่าเริ่มต้น ดังนั้นอย่าอ่าน content ตาม index ให้ค้นหา block ด้วยค่าtypeเช่นtext,thinkingหรือtool_useจำนวนโทเค็นเพิ่มขึ้นประมาณ 30%
Tokenizer ใหม่อาจนับข้อความเดียวกันมากขึ้นประมาณ 30% ให้นับ prompts ใหม่ และเผื่อmax_tokensสำหรับ thinking tokens ด้วย มิฉะนั้น request อาจจบที่stop_reason: "max_tokens"ก่อนสร้างข้อความตอบกลับtool_choiceแบบบังคับจะข้าม thinking
tool_choice: { "type": "any" }หรือการระบุชื่อเครื่องมือยังใช้ได้ แต่คำตอบจะเริ่มด้วยการเรียกใช้เครื่องมือและไม่มี thinking block หากต้องการให้โมเดลพิจารณาก่อนเรียกเครื่องมือ ให้ใช้:
{
"tool_choice": { "type": "auto" }
}
จากนั้นระบุใน prompt ว่าควรเรียกใช้เครื่องมือเมื่อใด
มีการปฏิเสธรูปแบบใหม่และไม่มี fallback
Haiku 5.5 ใช้ตัวจัดประเภทความปลอดภัย เช่นcyber,frontier_llm,bioและgeneral_harmsซึ่งอาจส่งคืนstop_reason: "refusal"ไม่มี fallback ฝั่งเซิร์ฟเวอร์ และการ retry เดิมมักถูกปฏิเสธอีกครั้งPriority Tier ถูกยกเลิก
หากระบบเดิมมีข้อผูกพัน Priority Tier สำหรับ Haiku 4.5 ให้แยกแผน capacity ของ Haiku 5.5 ออกมาต่างหากThinking block ผูกกับบัญชี
Thinking block ใช้ได้เฉพาะบัญชีที่สร้างหรือเชื่อมโยง block นั้น การ replay conversation จากบัญชีอื่นจะทำให้ไม่สามารถใช้ reasoning เดิมได้การแคชที่ถูกลงเริ่มต้นเร็วขึ้น
Prompt ที่แคชได้ขั้นต่ำลดจาก 4,096 เหลือ 512 โทเค็น ทำให้ system prompt ขนาดสั้นที่เดิมไม่เข้าเงื่อนไขบน 4.5 สามารถแคชบน 5.5 ได้
สิ่งที่ได้รับการปรับปรุง
ตัวเลขต่อไปนี้เป็นผลที่ Anthropic รายงาน โดย Haiku 5.5 ใช้ effort ระดับสูงสุด ขณะที่ Artificial Analysis ทดสอบ GDPval-AA และ AA-Briefcase อย่างอิสระ
| เกณฑ์มาตรฐาน | Haiku 4.5 | Haiku 5.5 |
|---|---|---|
| GDPval-AA v2.1 (Elo) | 735 | 1620 |
| AA-Briefcase v1.1 (Elo) | 614 | 1578 |
| OSWorld 2.1, ชุดย่อยแบบออฟไลน์ | 15.7% | 72.4% |
| Humanity’s Last Exam, พร้อมเครื่องมือ | 18.7% | 57.4% |
| Terminal-Bench 4.0 | 0.0% | 39.2% |
| SWE-bench Multilingual | 67.4% | 83.7% |
| Chartography, ไม่มีเครื่องมือ | 6.4% | 46.4% |
การทดสอบ Terminal-Bench ของ Haiku 4.5 ใช้ budget_tokens จำนวน 63,999 โทเค็น ขณะที่ Haiku 5.5 ที่ effort ค่าเริ่มต้น medium ได้ 1277 คะแนนบน GDPval-AA ซึ่งยังสูงกว่า 4.5 อย่างมาก Box รายงานคะแนนที่สูงกว่า Haiku 4.5 อยู่ 11 จุด และมี latency ลดลงประมาณครึ่งหนึ่ง
ดูตารางผลทดสอบฉบับเต็มได้ที่ เกณฑ์มาตรฐานของ Claude Haiku 5.5
Anthropic ยังคงวาง Sonnet 5.5 และ Opus 5.5 เป็นตัวเลือกสำหรับงาน agentic coding ที่ซับซ้อนกว่า ส่วน Haiku 5.5 เหมาะกับงานจัดหมวดหมู่, ดึงข้อมูล, สรุป, ย่อข้อความ, subagents และ browser use
ด้านราคา Anthropic ระบุว่า Haiku 5.5 ถูกลงโดยเฉลี่ยประมาณ 75% ตัวเลขนี้รวมส่วนลด 90% สำหรับโทเค็นสูงสุด 100K และส่วนลด 50% สำหรับโทเค็นส่วนเกิน หลังหักผลจาก tokenizer ใหม่แล้ว นอกจากนี้ system prompt สำหรับการใช้เครื่องมือยังลดจาก 496 เหลือ 286 โทเค็นเมื่อใช้ auto tool choice ดูตัวอย่างการคำนวณเพิ่มเติมได้ที่ ราคาของ Claude Haiku 5.5
ทดสอบการย้ายข้อมูลใน Apidog
ใน Apidog ให้สร้างโปรเจกต์เดียวและบันทึก request 3 รายการไปที่ https://api.anthropic.com/v1/messages
Baseline
ใช้ body Haiku 4.5 ที่ใช้งานจริง ตรวจสอบว่าได้สถานะ200Body เดิม, โมเดลใหม่
เปลี่ยนเฉพาะmodelเป็นclaude-haiku-5-5ตรวจสอบว่าได้400เก็บสำเนาแยกสำหรับทุก breaking change ที่พบ-
Migrated
ใช้ body ที่แก้ไขแล้ว ตรวจสอบว่า:- สถานะเป็น
200 -
stop_reasonไม่ใช่refusalหรือmax_tokens - พบข้อความตอบกลับจาก content block ที่มี
type: "text"
- สถานะเป็น
เก็บ ANTHROPIC_API_KEY เป็น environment variable และอ้างอิงใน header x-api-key ด้วย {{ANTHROPIC_API_KEY}} พร้อม header นี้:
anthropic-version: 2023-06-01
เปรียบเทียบ usage.input_tokens ระหว่าง baseline และ migrated request เพื่อวัดผลของ tokenizer ใหม่กับ prompts จริงของคุณ จากนั้นบันทึกทั้งชุดเป็น test scenario เพื่อให้การใส่ temperature กลับมาโดยไม่ได้ตั้งใจทำให้ test ล้มเหลวก่อนถึง production
ดู request พื้นฐานได้ที่ วิธีการใช้ Claude Haiku 5.5 API
หากทำงานใน Claude Code ให้ใช้คำสั่งนี้เพื่อสลับ model ID และแก้ไขพารามิเตอร์เบื้องต้น:
/claude-api migrate this project to claude-haiku-5-5
คำสั่งจะสร้าง checklist ให้ตรวจสอบต่อ โปรดทราบว่าชื่อย่อ haiku จะอ้างถึง Haiku 5.5 เฉพาะบน Anthropic API เท่านั้น ดูรายละเอียดที่ Claude Haiku 5.5 ใน Claude Code
คำถามที่พบบ่อย
Claude Haiku 4.5 ถูกยกเลิกแล้วหรือยัง?
ยังไม่ถูกยกเลิก โดยระบุว่ายังคงใช้งานอยู่และไม่มีกำหนดวันยกเลิก อีกทั้งจะไม่ถูกถอดออกก่อน 15 ตุลาคม 2026
ทำไมคำขอ Haiku 4.5 ของฉันจึงส่งคืน 400 บน Haiku 5.5?
ตรวจสอบ budget_tokens, temperature/top_p/top_k, assistant prefill, computer_20250124 และการแก้ไขเทิร์นก่อนหน้าก่อน replay thinking block ทั้งหมดคือ breaking changes หลัก
Haiku 5.5 ถูกกว่า Haiku 4.5 สำหรับ prompts ยาวหรือไม่?
ใช่ สำหรับโทเค็นเกิน 100K ราคาอยู่ที่ $0.50/$2.50 ต่อล้านโทเค็น ซึ่งเป็นครึ่งหนึ่งของ Haiku 4.5 ที่ $1/$5 และ Haiku 4.5 ไม่รองรับ prompt ที่เกิน 200K อยู่แล้ว
ควรย้ายทุกอย่างไป Haiku 5.5 หรือไม่?
สำหรับงานจัดหมวดหมู่, ดึงข้อมูล และ subagents ให้ทดสอบก่อนแล้วจึงย้าย โดยเปรียบเทียบกับตัวเลือกใกล้เคียงได้ที่ Haiku 5.5 vs GPT-6 Luna
ขั้นตอนถัดไป
บันทึก request ของ Haiku 4.5 ไว้คู่กับ request ของ Haiku 5.5 ยืนยัน breaking change ที่ทำให้เกิด 400 แก้ไข body แล้วค่อยย้าย traffic เมื่อ migrated request ผ่าน test scenario ครบถ้วน
ดาวน์โหลด Apidog เพื่อสร้างและรันชุดทดสอบเปรียบเทียบดังกล่าว
Originally published by Dev.to AI. Aggregated on AIWithGhost for educational purposes — full credit and traffic to the original publisher.