Claude Haiku 5.5 adalah model Anthropic terkecil dan tercepat saat ini, dirilis pada 7 Oktober 2026 dengan ID API claude-haiku-5-5. Biayanya $0,10 per juta token input dan $0,50 per juta token output untuk prompt hingga 100 ribu token, lalu $0,50/$2,50 untuk prompt di atas 100 ribu token. Dalam posting peluncurannya, Anthropic menyatakan model ini “sekitar 75% lebih murah untuk dijalankan” daripada Haiku 4.5 secara rata-rata dan merupakan “model tercepat kami hingga saat ini.” Ini juga Haiku pertama yang mendukung pengaturan upaya dan memiliki jendela konteks 1 juta token.
Artikel ini membahas spesifikasi, harga dua tingkat, perbedaan dari Haiku 4.5, tolok ukur, platform yang mendukungnya, serta langkah implementasi pertama. Untuk rincian biaya, baca panduan harga Haiku 5.5. Untuk mengirim request saat membaca, Apidog dapat mengimpor request Messages, menyimpan API key dalam environment variable, dan menampilkan respons beserta penggunaan token.
Spesifikasi Claude Haiku 5.5 secara sekilas
| Spesifikasi | Claude Haiku 5.5 |
|---|---|
| Tanggal rilis | 7 Oktober 2026 |
| ID model — API Claude, Google Cloud, Microsoft Foundry, Platform Claude di AWS |
claude-haiku-5-5 — ID tetap, tanpa sufiks tanggal |
| ID model — Amazon Bedrock | anthropic.claude-haiku-5-5 |
| Jendela konteks | 1 juta token — Haiku 4.5: 200 ribu |
| Output maksimum | 128 ribu token — Haiku 4.5: 64 ribu; 300 ribu pada Batch API dengan header beta output-300k-2026-03-24
|
| Pemikiran | Hanya adaptif |
| Tingkat upaya |
low, medium (default), high, xhigh, max
|
| Batas pengetahuan | Juni 2026 |
| Harga per MTok, prompt hingga 100 ribu token | $0,10 input, $0,50 output |
| Harga per MTok, prompt di atas 100 ribu token | $0,50 input, $2,50 output |
| Penghentian | Tidak lebih cepat dari 7 Oktober 2027 |
Posisi Haiku 5.5 dalam jajaran Claude
| Model | Input / output per MTok | Upaya default | Latensi |
|---|---|---|---|
| Claude Fable 5.1 | $10 / $50 | tinggi | Lebih lambat |
| Claude Opus 5.5 | $4 / $20 | sedang | Sedang |
| Claude Sonnet 5.5 | $2 / $10 | tinggi | Cepat |
| Claude Haiku 5.5 | $0,10 / $0,50 untuk prompt hingga 100 ribu token | sedang | Tercepat |
Keempat model memiliki jendela konteks 1 juta token, output maksimum 128 ribu token, dan batas pengetahuan Juni 2026. Anthropic membangun Haiku 5.5 untuk tugas bervolume tinggi dan sensitif terhadap latensi, termasuk:
- klasifikasi;
- ekstraksi data;
- perutean;
- ringkasan;
- dukungan langsung;
- penggunaan browser;
- pekerjaan sub-agen di bawah Opus 5.5 atau Sonnet 5.5.
Klaim “tercepat” memiliki catatan: model ini tercepat pada kecepatan standar masing-masing model, tetapi lebih lambat daripada Opus dalam Mode Cepat. Anthropic tidak mempublikasikan angka token per detik.
Harga Claude Haiku 5.5
Harga bergantung pada panjang prompt. Prompt yang melampaui 100.000 token masuk ke tingkat harga yang lebih tinggi.
Sumber: Harga API Claude.
Angka “sekitar 75% lebih murah” adalah rata-rata:
- 90% lebih murah daripada Haiku 4.5 untuk prompt hingga 100 ribu token;
- 50% lebih murah untuk prompt di atas 100 ribu token;
- 90% request Haiku 4.5 berada di bawah ambang batas tersebut.
Perhitungan ini sudah memperhitungkan tokenizer baru yang menghasilkan sekitar 30% lebih banyak token untuk teks yang sama.
Inferensi khusus AS (inference_geo) dikenai biaya 1,1x di setiap kategori token. Prompt minimum yang dapat menggunakan cache turun dari 4.096 token pada Haiku 4.5 menjadi 512 token.
Di bawah 100 ribu token, harga daftar sama dengan GPT-6 Luna:
- $0,10 input;
- $0,50 output;
- $0,01 cache read;
- $0,125 cache write.
Perbedaannya ada pada ambang harga tambahan: Luna mulai mengenakan biaya tambahan di atas 272 ribu token input. Baca perbandingan Haiku 5.5 vs GPT-6 Luna dan panduan harga Haiku 5.5 untuk contoh perhitungan biaya.
Apa yang berubah dari Haiku 4.5
Haiku 5.5 meningkatkan jendela konteks lima kali lipat, menggandakan output maksimum, dan menambahkan kontrol tingkat upaya. Namun, panduan migrasi memperingatkan bahwa beberapa request Haiku 4.5 akan gagal dengan error 400.
1. Ganti anggaran pemikiran manual
Request berikut tidak didukung:
{
"thinking": {
"type": "enabled",
"budget_tokens": 10000
}
}
Gunakan pemikiran adaptif dan tentukan upaya melalui output_config.effort:
{
"thinking": {
"type": "adaptive"
},
"output_config": {
"effort": "medium"
}
}
2. Hapus parameter sampling
Jangan kirim:
temperaturetop_ptop_k
Nilai temperature atau top_p non-default akan gagal. Mengirim top_k, atau mengirim temperature dan top_p bersamaan, juga gagal.
3. Hapus pra-isi Asisten
Pra-isi pesan assistant ditolak, bahkan saat pemikiran dinonaktifkan. Mulai respons model dari pesan pengguna atau sistem, bukan dari konten Asisten yang Anda tulis sendiri.
4. Perbarui alat penggunaan komputer
Pada API Claude dan Google Cloud, gunakan:
computer_toolset_20260801
Jangan gunakan tool lama berikut:
computer_20250124
5. Gunakan riwayat percakapan append-only
Jangan mengubah:
-
system; -
tools; - pesan sebelumnya sebelum blok pemikiran yang dikembalikan.
Jika Anda meneruskan percakapan, simpan riwayat sebagai append-only.
Perubahan lain yang tidak menghasilkan error
Beberapa perubahan berikut tidak selalu gagal, tetapi dapat mengubah output atau biaya:
-
Tampilan pemikiran: blok pemikiran secara default kembali kosong dan hanya menyertakan tanda tangan. Gunakan
"display": "summarized"untuk melihat ringkasannya. -
Jumlah token: teks yang sama dapat menghasilkan sekitar 30% lebih banyak token. Nilai
max_tokensjuga mencakup token pemikiran. -
Pemanggilan alat paksa:
tool_choice: "any"atau pemilihan tool bernama tetap berfungsi, tetapi respons tidak memiliki blok pemikiran. -
Penolakan: klasifikator keamanan dapat mengembalikan
stop_reason: "refusal"tanpa fallback sisi server. - Tingkat Prioritas: tidak didukung di Haiku 5.5.
Pemikiran dapat dinonaktifkan pada upaya high atau di bawahnya. Pada xhigh dan max, menonaktifkan pemikiran menghasilkan error 400.
Haiku 4.5 belum usang dan masih terdaftar aktif. Lihat panduan Haiku 5.5 vs Haiku 4.5 untuk JSON sebelum dan sesudah migrasi.
Tolok ukur Claude Haiku 5.5
Skor Haiku 5.5 diukur pada upaya maksimum dan sebagian besar dirata-ratakan dari lima percobaan. Artificial Analysis menjalankan GDPval-AA dan AA-Briefcase, Cognition menjalankan FrontierCode, sedangkan Anthropic menilai Chartography—tolok ukur Surge AI—dengan implementasinya sendiri.
Ada beberapa detail penting saat membaca angka ini:
- FrontierCode membandingkan Haiku pada upaya maksimum dengan Sonnet 5.5 pada
xhigh. - Pada upaya maksimum, Sonnet mencetak 46,2%, sedikit di bawah skor Haiku sebesar 46,4%.
- Anthropic menjalankan skor OSWorld Luna melalui API OpenAI.
- Skor Terminal-Bench Luna berasal dari papan peringkat publik menggunakan Codex CLI.
- Pada upaya
mediumdefault, Haiku 5.5 mencetak 1277 pada GDPval-AA dan 1372 pada AA-Briefcase.
Anthropic menyatakan Sonnet 5.5 dan Opus 5.5 tetap lebih baik untuk tugas pengkodean agen yang kompleks. Per 8 Oktober 2026, belum ada papan peringkat independen dengan hasil Haiku 5.5. Cursor melaporkan skor 48,4% pada CursorBench miliknya sendiri pada upaya maksimum.
Untuk skor per tingkat upaya dan biaya terkait, baca analisis mendalam tolok ukur.
Di mana Anda dapat menggunakan Claude Haiku 5.5
| Platform | Akses | Catatan |
|---|---|---|
| API Claude | claude-haiku-5-5 |
Bayar per token |
| Amazon Bedrock | anthropic.claude-haiku-5-5 |
Ditagih melalui AWS Marketplace |
| Google Cloud, Microsoft Foundry, Platform Claude di AWS | claude-haiku-5-5 |
ID sama dengan API Claude |
| Claude.ai — web, iOS, Android | Pemilih model | Pengguna Gratis, Pro, Max, Tim, dan Perusahaan dapat memilihnya |
| Claude Code | /model claude-haiku-5-5 |
v2.1.293 atau lebih baru; paket berbayar |
| Vercel AI Gateway | anthropic/claude-haiku-5.5 |
Mulai dari $0,10 / $0,50 |
| Cursor | claude-haiku-5-5 |
Kumpulan Model Lain |
Per 8 Oktober 2026, model ini belum tersedia di OpenRouter dan belum diumumkan untuk GitHub Copilot.
Akses chat pada paket Gratis bukanlah API key. API tetap menggunakan skema bayar sesuai pemakaian, di luar kredit gratis kecil untuk pengguna baru. Paket Max dan Tim kini mencakup kredit API bulanan:
- $100 pada Max 5x;
- $200 pada Max 20x;
- hingga $500 yang dikumpulkan pada Tim.
Kredit tersebut tidak mencakup Claude Code. Baca panduan akses gratis untuk melihat rute gratis dan batasannya.
Di Claude Code, alias haiku berarti Haiku 5.5 hanya pada API Anthropic. Di platform lain, alias tersebut masih berarti Haiku 4.5. Lihat Haiku 5.5 di Claude Code untuk konfigurasi sub-agen.
Siapa yang harus beralih ke Haiku 5.5
- Pengguna Haiku 4.5: beralih setelah memperbaiki lima perubahan yang merusak. Haiku 5.5 mengungguli Haiku 4.5 pada semua baris tabel peluncuran yang memiliki skor untuk keduanya, dengan harga daftar lebih rendah.
- Pengguna Sonnet atau Opus untuk pekerjaan sederhana dan berulang: uji Haiku 5.5 untuk klasifikasi, ekstraksi, ringkasan, dan sub-agen. Gunakan model yang lebih besar untuk pengkodean agen yang kompleks.
- Pengguna dengan prompt di atas 100 ribu token: hitung biaya pada tingkat harga kedua sebelum migrasi. Di atas ambang batas, biaya input per token menjadi 5x lebih tinggi.
- Tim keamanan: perlindungan siber Haiku 5.5 masih memblokir pengujian penetrasi.
Dalam posting peluncuran, Asana melaporkan latensi penyelesaian tugas 30% lebih rendah. Box melaporkan skor 11 poin di atas Haiku 4.5 dengan latensi sekitar setengahnya. Ini adalah klaim pelanggan, bukan pengujian independen.
Kartu sistem juga mencatat bahwa model ini lebih sering menolak dibandingkan model lain dalam audit otomatis Anthropic. Uji tingkat penolakan menggunakan prompt produksi Anda sendiri sebelum menerapkannya secara luas.
Kirim request Haiku 5.5 pertama Anda
Gunakan API Messages dengan thinking.type: "adaptive" dan pilih tingkat upaya melalui output_config.effort.
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 4000,
"thinking": {"type": "adaptive", "display": "summarized"},
"output_config": {"effort": "low"},
"messages": [
{
"role": "user",
"content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error."
}
]
}'
Jangan sertakan parameter sampling atau pra-isi Asisten. Saat memproses respons, baca blok content berdasarkan field type, karena respons dapat dimulai dengan blok pemikiran.
Di Apidog, impor perintah curl sebagai request baru dan simpan key dalam environment variable ANTHROPIC_API_KEY.
Tambahkan assertion untuk memastikan stop_reason bukan:
refusal
atau:
max_tokens
Kemudian duplikat request dan ubah effort dari low ke medium. Bandingkan objek usage untuk mengukur dampak biaya dari tiap tingkat upaya.
Untuk caching, batch, dan streaming, buka panduan API Haiku 5.5. Jika belum memiliki key, ikuti panduan API key Anthropic.
FAQ
Kapan Claude Haiku 5.5 dirilis?
7 Oktober 2026, sembilan hari setelah Sonnet 5.5.
Apakah Claude Haiku 5.5 gratis?
Di aplikasi chat Claude.ai, pengguna Gratis dapat memilihnya. API berbayar, selain kredit uji coba kecil untuk pengguna baru. Lihat setiap rute gratis.
Berapa jendela konteks Claude Haiku 5.5?
1 juta token, dengan output maksimum 128 ribu token pada API Messages.
Apakah Haiku 4.5 akan dihentikan?
Belum. Model ini masih terdaftar aktif, dengan penghentian tidak lebih cepat dari 15 Oktober 2026.
Langkah selanjutnya
Pilih satu pekerjaan bervolume tinggi yang sudah berjalan hari ini, misalnya triase tiket atau ringkasan dokumen. Kirim workload tersebut ke claude-haiku-5-5 pada low dan medium, lalu:
- periksa kualitas output;
- catat
stop_reason; - bandingkan
usage; - bandingkan biaya dengan model yang Anda gunakan saat ini.
Unduh Apidog untuk menyimpan request dan assertion dalam satu proyek. Setelah itu, gunakan panduan harga untuk mengubah jumlah token menjadi estimasi tagihan bulanan.


Top comments (0)