Untuk menggunakan Claude Haiku 5.5 di Claude Code, perbarui Claude Code ke v2.1.293 atau lebih baru dengan claude update. Setelah itu, mulai sesi dengan claude --model claude-haiku-5-5 atau pilih model dari sesi aktif memakai /model claude-haiku-5-5. Untuk sebagian besar workflow, gunakan Haiku sebagai subagen: biarkan Sonnet 5.5 atau Opus 5.5 menangani keputusan kompleks, lalu delegasikan pencarian codebase, eksekusi pengujian, dan ringkasan ke Haiku. Dengan kunci API, tarifnya adalah $0.10/$0.50 per juta token input/output untuk prompt hingga 100K token, lalu $0.50/$2.50 di atas batas tersebut.
Artikel ini membahas pengaturan, perilaku alias haiku, tingkat upaya, file subagen, batas harga 100K token, dan kapan Sonnet atau Opus sebaiknya tetap memimpin. Untuk detail modelnya, baca apa itu Claude Haiku 5.5. Jika aplikasi Anda memanggil API, Apidog dapat menyimpan skenario pengujian yang dijalankan oleh subagen Haiku.
Claude Haiku 5.5 di Claude Code: ringkasan
| Pengaturan | Haiku 5.5 |
|---|---|
| Versi minimum | v2.1.293 (claude update) |
| ID model | claude-haiku-5-5 |
Alias haiku
|
Haiku 5.5 hanya pada Anthropic API |
| Konteks | 1M native pada setiap paket, tanpa sufiks [1m]
|
| Pemadatan otomatis | Sekitar 967K token secara default |
| Upaya default |
medium (tersedia low hingga max) |
| Berpikir | Selalu aktif; tidak dapat dimatikan di Claude Code |
| Harga API | $0.10/$0.50 hingga 100K token; $0.50/$2.50 di atas 100K |
| Paket | Pro, Max, Team, Enterprise, atau kunci API; bukan Gratis |
Langkah 1: Perbarui Claude Code
Haiku 5.5 memerlukan Claude Code v2.1.293 atau lebih baru. Changelog Claude Code menyebut Haiku sebagai model default pada Anthropic API.
claude update
Claude Code tidak tersedia untuk paket Gratis. Pengguna gratis dapat memilih Haiku 5.5 di aplikasi Claude.ai, tetapi Claude Code memerlukan Pro, Max, Team, Enterprise, atau kunci API Anthropic.
Menurut claude.com/pricing, Pro berharga $17 per bulan bila ditagih tahunan atau $20 per bulan, sementara Max mulai dari $100.
Langkah 2: Pilih Haiku 5.5 sebagai model utama
Mulai sesi baru dengan ID model lengkap:
claude --model claude-haiku-5-5
Dalam sesi aktif, gunakan:
/model claude-haiku-5-5
Jika konfigurasi tersimpan Anda menggunakan model: haiku, sesi lama yang menggunakan Haiku 4.5 akan berlanjut ke Haiku 5.5 hanya pada Anthropic API.
Alias haiku hanya menunjuk ke Haiku 5.5 pada Anthropic API
| Penyedia |
haiku merujuk ke |
|---|---|
| Anthropic API | Haiku 5.5 |
| Claude Platform di AWS | Haiku 4.5 |
| Amazon Bedrock, Google Cloud’s Agent Platform | Haiku 4.5 |
| Microsoft Foundry | Haiku 4.5 |
Pada penyedia cloud, /model haiku dan model: haiku di file subagen masih dapat memilih Haiku 4.5.
Gunakan ID eksplisit berikut sesuai platform:
-
Google Cloud dan Claude Platform di AWS:
claude-haiku-5-5 - Microsoft Foundry: nama deployment Anda
-
Amazon Bedrock: ID profil inferensi, misalnya
us.anthropic.claude-haiku-5-5
Alternatifnya, arahkan alias tersebut dengan ANTHROPIC_DEFAULT_HAIKU_MODEL seperti pada Langkah 5.
Langkah 3: Pilih tingkat upaya
Haiku 5.5 menyediakan kontrol upaya:
lowmediumhighxhighmax
Claude Code menggunakan medium secara default. Untuk menaikkan upaya saat memulai sesi:
claude --model claude-haiku-5-5 --effort high
Untuk mengubahnya dalam sesi aktif:
/effort low
Panduan praktis:
- Gunakan
lowuntuk tugas alat singkat dan permintaan ber-volume tinggi. - Gunakan
mediumuntuk sebagian besar pekerjaan. - Gunakan
highuntuk workflow agen yang lebih panjang. - Gunakan
xhighataumaxhanya jika evaluasi Anda menunjukkan hasil yang lebih baik.
Berpikir tetap aktif pada Haiku 5.5 di Claude Code. Pengaturan seperti alwaysThinkingEnabled: false dan MAX_THINKING_TOKENS=0 tidak menonaktifkannya. Jika ingin mengurangi token berpikir, turunkan effort.
Langkah 4: Jalankan Haiku 5.5 sebagai subagen
Haiku 5.5 cocok untuk subagen coding yang menjalankan pekerjaan berulang: pencarian file, membaca log, menjalankan pengujian, atau merangkum hasil.
Simpan file subagen Markdown di salah satu lokasi berikut:
.claude/agents/ # hanya untuk proyek saat ini
~/.claude/agents/ # tersedia untuk semua proyek
Frontmatter minimal membutuhkan name dan description. Berdasarkan dokumentasi subagen, nilai model dapat berupa sonnet, opus, haiku, fable, ID model lengkap, atau inherit.
Untuk panduan cakupan dan tools, baca panduan subagen Claude Code.
Ganti Explore dengan penjelajah berbiaya rendah
Subagen Explore bawaan berjalan pada model percakapan utama. Artinya, jika sesi utama menggunakan Opus 5.5, pencarian Explore juga menggunakan Opus.
Anda dapat menimpa Explore dengan subagen proyek bernama Explore dan menetapkan Haiku sebagai modelnya:
---
name: Explore
description: Pencarian codebase cepat hanya-baca. Gunakan untuk menemukan file, simbol, dan situs panggilan tanpa mengedit apa pun.
tools: Read, Grep, Glob
model: haiku
effort: low
---
Anda mencari di codebase dan melaporkan apa yang Anda temukan. Kembalikan jalur file dengan nomor baris dan ringkasan singkat setiap kecocokan. Jangan pernah mengedit file.
Simpan sebagai:
.claude/agents/Explore.md
Jalankan /tasks saat subagen bekerja untuk memeriksa model yang digunakan. Pada penyedia cloud, ganti haiku dengan ID lengkap yang sesuai dari Langkah 2.
Paksa semua subagen memakai Haiku
Jika setiap subagen harus menggunakan Haiku, termasuk Explore, tambahkan kedua variabel berikut ke blok env pada file pengaturan:
{
"env": {
"CLAUDE_CODE_SUBAGENT_MODEL": "haiku",
"CLAUDE_CODE_SUBAGENT_MODEL_FORCE": "1"
}
}
CLAUDE_CODE_SUBAGENT_MODEL tanpa CLAUDE_CODE_SUBAGENT_MODEL_FORCE hanya menetapkan default. Model yang didefinisikan dalam file subagen masih dapat menang, dan Explore bawaan tidak akan berubah.
Langkah 5: Arahkan pekerjaan latar belakang ke Haiku 5.5
Gunakan ANTHROPIC_DEFAULT_HAIKU_MODEL untuk menentukan model yang dipakai alias haiku dan pekerjaan latar belakang, misalnya ringkasan sesi untuk claude --resume.
Variabel lama ANTHROPIC_SMALL_FAST_MODEL sudah tidak digunakan lagi menurut referensi variabel lingkungan. Ganti variabel tersebut jika masih ada di profil shell Anda.
Pada Anthropic API, Anda tidak perlu mengatur apa pun. Untuk penyedia cloud, sematkan model Haiku 5.5 setelah model tersebut tersedia di akun Anda:
# Google Cloud's Agent Platform
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-5-5
# Amazon Bedrock (ID profil inferensi)
export ANTHROPIC_DEFAULT_HAIKU_MODEL=us.anthropic.claude-haiku-5-5
Pahami lonjakan harga setelah 100K token
Harga Haiku 5.5 bergantung pada panjang prompt. Karena Claude Code mengirim konteks percakapan sebagai prompt pada setiap giliran, sesi panjang dapat melewati ambang 100K token.
| Panjang prompt | Input/output per juta token |
|---|---|
| Hingga 100K token | $0.10 / $0.50 |
| Di atas 100K token | $0.50 / $2.50 |
Setelah melewati 100K token, tarif menjadi lima kali lebih tinggi. Dokumentasi tidak menjelaskan apakah token cache dihitung dalam batas tersebut, jadi anggap token cache ikut dihitung saat membuat anggaran.
Pemadatan otomatis juga tidak cukup untuk menghindari batas harga tersebut. Haiku 5.5 secara default memadatkan konteks sekitar 967K token, jauh setelah ambang 100K.
Terapkan dua kebiasaan berikut:
- Padatkan konteks lebih awal.
/autocompact 100k
Nilai tersebut adalah jendela minimum yang diterima Claude Code, sehingga sesi memadatkan konteks lebih dekat ke ambang harga.
- Delegasikan pekerjaan besar ke subagen. Subagen memiliki konteks sendiri. Log pengujian, hasil pencarian, dan output panjang tidak perlu masuk ke percakapan utama.
Bahkan pada prompt di atas 100K token, tarif $0.50/$2.50 masih seperempat dari tarif Sonnet 5.5 sebesar $2/$10. Namun, pada paket berbayar Anda menggunakan batas penggunaan, dan Anthropic belum mempublikasikan cara Haiku 5.5 dihitung terhadap batas tersebut.
Untuk detail perhitungannya, baca rincian harga Haiku 5.5.
Pelanggan Max dan Team perlu memperhatikan bahwa kredit API bulanan baru—$100 di Max 5x, $200 di Max 20x, dan hingga $500 yang dikumpulkan di Team—tidak mencakup Claude Code interaktif, berdasarkan dokumentasi kredit API Anthropic.
Kapan Sonnet 5.5 atau Opus 5.5 harus tetap memimpin
Sonnet 5.5 dan Opus 5.5 tetap lebih sesuai untuk tugas coding agentik yang kompleks.
Pada Terminal-Bench 4.0 yang dijalankan Anthropic di Claude Code dengan upaya maksimal, Haiku 5.5 mencetak 39.2%, sedangkan Sonnet 5.5 mencapai 70.6%.
| Upaya | Haiku 5.5 | Sonnet 5.5 |
|---|---|---|
medium |
20.3% dengan $0.68 | 28.8% dengan $0.68 |
high |
24.8% dengan $1.04 | 43% dengan $1.46 |
max |
39.2% dengan $2.64 | 70.6% dengan $10.44 |
Pada medium, keduanya memiliki biaya per percobaan yang hampir sama, tetapi Sonnet mendapat skor lebih tinggi. Harga token Haiku tidak selalu menghasilkan biaya lebih rendah pada pekerjaan shell yang panjang, jadi jangan menjadikannya pemimpin untuk sesi coding sulit.
Untuk penggunaan komputer, hasilnya berbeda. Pada OSWorld 2.1:
- Haiku 5.5 pada
medium: 53.3% dengan $0.13 per percobaan - Sonnet 5.5 pada
low: 57.9% dengan $0.68 per percobaan
Baca rincian benchmark Haiku 5.5 untuk semua hasil benchmark, serta panduan Claude Code Sonnet 5.5 untuk penggunaan model utama.
Pembagian praktis yang aman:
- Sonnet 5.5 atau Opus 5.5: model utama untuk perencanaan dan perubahan kompleks.
- Haiku 5.5: Explore, test runner, pembaca log, dan pengambil dokumentasi.
Contoh: subagen Haiku untuk menjalankan pengujian Apidog
Eksekusi pengujian biasanya menghasilkan output panjang dan berulang, sehingga cocok untuk Haiku. Apidog CLI dapat menjalankan skenario pengujian Apidog dari terminal, lalu subagen mengembalikan ringkasan hasil ke model utama.
---
name: api-test-runner
description: Menjalankan skenario pengujian Apidog proyek dengan Apidog CLI setelah perubahan endpoint API, lalu melaporkan jumlah lulus dan gagal beserta permintaan yang gagal.
tools: Bash, Read
model: haiku
effort: low
---
Jalankan perintah pengujian Apidog CLI yang didokumentasikan di README repo ini untuk skenario yang mencakup endpoint yang diubah. Laporkan jumlah lulus dan gagal. Untuk setiap kegagalan, berikan nama permintaan, hasil yang diharapkan, dan hasil aktual. Jangan mengedit kode. Jangan mencoba kembali eksekusi yang gagal lebih dari satu kali.
Simpan konfigurasi dan perintah eksekusi CLI di README proyek. Untuk setup autentikasi dan perintahnya, baca Apidog CLI di Claude Code.
Unduh Apidog untuk membuat skenario yang dijalankan subagen.
Migrasi aplikasi dari Haiku 4.5
Jika aplikasi Anda memanggil Haiku 4.5 melalui API, gunakan Claude Code untuk memulai migrasi:
/claude-api migrate this project to claude-haiku-5-5
Perhatikan perubahan yang dapat menyebabkan error 400 pada Haiku 5.5:
-
budget_tokensmanual untuk berpikir -
temperatureatautop_pnon-default - penggunaan
top_k - prefill asisten
Rincian Haiku 5.5 vs Haiku 4.5 mencantumkan perbaikan yang diperlukan.
Setelah migrasi:
- Simpan request lama dan request baru sebagai pasangan di Apidog.
- Simpan
ANTHROPIC_API_KEYsebagai variabel lingkungan. - Validasi
stop_reasondanusage. - Jadikan respons
refusalbaru atau lonjakan token sebagai kondisi gagal pengujian sebelum perubahan mencapai produksi.
FAQ
Apakah Haiku 5.5 adalah model default di Claude Code?
Tidak. Haiku 5.5 adalah model Haiku default pada Anthropic API, sehingga alias haiku menunjuk ke sana. Pilih sebagai model utama dengan --model atau /model.
Bisakah saya menggunakan Haiku 5.5 di Claude Code pada paket Gratis?
Tidak. Claude Code memerlukan paket berbayar atau kunci API. Pengguna gratis dapat memilih Haiku 5.5 di Claude.ai. Lihat cara menggunakan Claude Haiku 5.5 secara gratis.
Mengapa model: haiku memberi saya Haiku 4.5?
Anda kemungkinan menggunakan Bedrock, Google Cloud, Foundry, Claude Platform di AWS, atau Claude Code sebelum v2.1.293. Gunakan ID model lengkap atau atur ANTHROPIC_DEFAULT_HAIKU_MODEL.
Bisakah saya mematikan berpikir untuk menghemat token?
Tidak di Claude Code. Turunkan effort; low adalah pengaturan termurah.
Langkah berikutnya
- Jalankan
claude update. - Tambahkan override
Exploreberbasis Haiku. - Pertahankan model utama Anda saat ini selama satu minggu untuk membandingkan hasil.
- Tambahkan subagen test runner jika proyek memiliki API.
- Jika memanggil model dari kode sendiri, mulai dari panduan API Haiku 5.5.
Apidog gratis untuk memulai dan memberi subagen Anda skenario pengujian nyata untuk dijalankan.

Top comments (0)