DEV Community

Cover image for Apa Itu Claude Haiku 5.5
Walse
Walse

Posted on Originally published at apidog.com

Apa Itu Claude Haiku 5.5

Claude Haiku 5.5 adalah model Anthropic terkecil dan tercepat saat ini, dirilis pada 7 Oktober 2026 dengan ID API claude-haiku-5-5. Biayanya $0,10 per juta token input dan $0,50 per juta token output untuk prompt hingga 100 ribu token, lalu $0,50/$2,50 untuk prompt di atas 100 ribu token. Dalam posting peluncurannya, Anthropic menyatakan model ini “sekitar 75% lebih murah untuk dijalankan” daripada Haiku 4.5 secara rata-rata dan merupakan “model tercepat kami hingga saat ini.” Ini juga Haiku pertama yang mendukung pengaturan upaya dan memiliki jendela konteks 1 juta token.

Coba Apidog hari ini

Artikel ini membahas spesifikasi, harga dua tingkat, perbedaan dari Haiku 4.5, tolok ukur, platform yang mendukungnya, serta langkah implementasi pertama. Untuk rincian biaya, baca panduan harga Haiku 5.5. Untuk mengirim request saat membaca, Apidog dapat mengimpor request Messages, menyimpan API key dalam environment variable, dan menampilkan respons beserta penggunaan token.

Spesifikasi Claude Haiku 5.5 secara sekilas

Spesifikasi Claude Haiku 5.5
Tanggal rilis 7 Oktober 2026
ID model — API Claude, Google Cloud, Microsoft Foundry, Platform Claude di AWS claude-haiku-5-5 — ID tetap, tanpa sufiks tanggal
ID model — Amazon Bedrock anthropic.claude-haiku-5-5
Jendela konteks 1 juta token — Haiku 4.5: 200 ribu
Output maksimum 128 ribu token — Haiku 4.5: 64 ribu; 300 ribu pada Batch API dengan header beta output-300k-2026-03-24
Pemikiran Hanya adaptif
Tingkat upaya low, medium (default), high, xhigh, max
Batas pengetahuan Juni 2026
Harga per MTok, prompt hingga 100 ribu token $0,10 input, $0,50 output
Harga per MTok, prompt di atas 100 ribu token $0,50 input, $2,50 output
Penghentian Tidak lebih cepat dari 7 Oktober 2027

Posisi Haiku 5.5 dalam jajaran Claude

Model Input / output per MTok Upaya default Latensi
Claude Fable 5.1 $10 / $50 tinggi Lebih lambat
Claude Opus 5.5 $4 / $20 sedang Sedang
Claude Sonnet 5.5 $2 / $10 tinggi Cepat
Claude Haiku 5.5 $0,10 / $0,50 untuk prompt hingga 100 ribu token sedang Tercepat

Keempat model memiliki jendela konteks 1 juta token, output maksimum 128 ribu token, dan batas pengetahuan Juni 2026. Anthropic membangun Haiku 5.5 untuk tugas bervolume tinggi dan sensitif terhadap latensi, termasuk:

  • klasifikasi;
  • ekstraksi data;
  • perutean;
  • ringkasan;
  • dukungan langsung;
  • penggunaan browser;
  • pekerjaan sub-agen di bawah Opus 5.5 atau Sonnet 5.5.

Klaim “tercepat” memiliki catatan: model ini tercepat pada kecepatan standar masing-masing model, tetapi lebih lambat daripada Opus dalam Mode Cepat. Anthropic tidak mempublikasikan angka token per detik.

Harga Claude Haiku 5.5

Harga bergantung pada panjang prompt. Prompt yang melampaui 100.000 token masuk ke tingkat harga yang lebih tinggi.

Harga Claude Haiku 5.5

Sumber: Harga API Claude.

Angka “sekitar 75% lebih murah” adalah rata-rata:

  • 90% lebih murah daripada Haiku 4.5 untuk prompt hingga 100 ribu token;
  • 50% lebih murah untuk prompt di atas 100 ribu token;
  • 90% request Haiku 4.5 berada di bawah ambang batas tersebut.

Perhitungan ini sudah memperhitungkan tokenizer baru yang menghasilkan sekitar 30% lebih banyak token untuk teks yang sama.

Inferensi khusus AS (inference_geo) dikenai biaya 1,1x di setiap kategori token. Prompt minimum yang dapat menggunakan cache turun dari 4.096 token pada Haiku 4.5 menjadi 512 token.

Di bawah 100 ribu token, harga daftar sama dengan GPT-6 Luna:

  • $0,10 input;
  • $0,50 output;
  • $0,01 cache read;
  • $0,125 cache write.

Perbedaannya ada pada ambang harga tambahan: Luna mulai mengenakan biaya tambahan di atas 272 ribu token input. Baca perbandingan Haiku 5.5 vs GPT-6 Luna dan panduan harga Haiku 5.5 untuk contoh perhitungan biaya.

Apa yang berubah dari Haiku 4.5

Haiku 5.5 meningkatkan jendela konteks lima kali lipat, menggandakan output maksimum, dan menambahkan kontrol tingkat upaya. Namun, panduan migrasi memperingatkan bahwa beberapa request Haiku 4.5 akan gagal dengan error 400.

1. Ganti anggaran pemikiran manual

Request berikut tidak didukung:

{
  "thinking": {
    "type": "enabled",
    "budget_tokens": 10000
  }
}
Enter fullscreen mode Exit fullscreen mode

Gunakan pemikiran adaptif dan tentukan upaya melalui output_config.effort:

{
  "thinking": {
    "type": "adaptive"
  },
  "output_config": {
    "effort": "medium"
  }
}
Enter fullscreen mode Exit fullscreen mode

2. Hapus parameter sampling

Jangan kirim:

  • temperature
  • top_p
  • top_k

Nilai temperature atau top_p non-default akan gagal. Mengirim top_k, atau mengirim temperature dan top_p bersamaan, juga gagal.

3. Hapus pra-isi Asisten

Pra-isi pesan assistant ditolak, bahkan saat pemikiran dinonaktifkan. Mulai respons model dari pesan pengguna atau sistem, bukan dari konten Asisten yang Anda tulis sendiri.

4. Perbarui alat penggunaan komputer

Pada API Claude dan Google Cloud, gunakan:

computer_toolset_20260801
Enter fullscreen mode Exit fullscreen mode

Jangan gunakan tool lama berikut:

computer_20250124
Enter fullscreen mode Exit fullscreen mode

5. Gunakan riwayat percakapan append-only

Jangan mengubah:

  • system;
  • tools;
  • pesan sebelumnya sebelum blok pemikiran yang dikembalikan.

Jika Anda meneruskan percakapan, simpan riwayat sebagai append-only.

Perubahan lain yang tidak menghasilkan error

Beberapa perubahan berikut tidak selalu gagal, tetapi dapat mengubah output atau biaya:

  • Tampilan pemikiran: blok pemikiran secara default kembali kosong dan hanya menyertakan tanda tangan. Gunakan "display": "summarized" untuk melihat ringkasannya.
  • Jumlah token: teks yang sama dapat menghasilkan sekitar 30% lebih banyak token. Nilai max_tokens juga mencakup token pemikiran.
  • Pemanggilan alat paksa: tool_choice: "any" atau pemilihan tool bernama tetap berfungsi, tetapi respons tidak memiliki blok pemikiran.
  • Penolakan: klasifikator keamanan dapat mengembalikan stop_reason: "refusal" tanpa fallback sisi server.
  • Tingkat Prioritas: tidak didukung di Haiku 5.5.

Pemikiran dapat dinonaktifkan pada upaya high atau di bawahnya. Pada xhigh dan max, menonaktifkan pemikiran menghasilkan error 400.

Haiku 4.5 belum usang dan masih terdaftar aktif. Lihat panduan Haiku 5.5 vs Haiku 4.5 untuk JSON sebelum dan sesudah migrasi.

Tolok ukur Claude Haiku 5.5

Skor Haiku 5.5 diukur pada upaya maksimum dan sebagian besar dirata-ratakan dari lima percobaan. Artificial Analysis menjalankan GDPval-AA dan AA-Briefcase, Cognition menjalankan FrontierCode, sedangkan Anthropic menilai Chartography—tolok ukur Surge AI—dengan implementasinya sendiri.

Tolok ukur Claude Haiku 5.5

Ada beberapa detail penting saat membaca angka ini:

  • FrontierCode membandingkan Haiku pada upaya maksimum dengan Sonnet 5.5 pada xhigh.
  • Pada upaya maksimum, Sonnet mencetak 46,2%, sedikit di bawah skor Haiku sebesar 46,4%.
  • Anthropic menjalankan skor OSWorld Luna melalui API OpenAI.
  • Skor Terminal-Bench Luna berasal dari papan peringkat publik menggunakan Codex CLI.
  • Pada upaya medium default, Haiku 5.5 mencetak 1277 pada GDPval-AA dan 1372 pada AA-Briefcase.

Anthropic menyatakan Sonnet 5.5 dan Opus 5.5 tetap lebih baik untuk tugas pengkodean agen yang kompleks. Per 8 Oktober 2026, belum ada papan peringkat independen dengan hasil Haiku 5.5. Cursor melaporkan skor 48,4% pada CursorBench miliknya sendiri pada upaya maksimum.

Untuk skor per tingkat upaya dan biaya terkait, baca analisis mendalam tolok ukur.

Di mana Anda dapat menggunakan Claude Haiku 5.5

Platform Akses Catatan
API Claude claude-haiku-5-5 Bayar per token
Amazon Bedrock anthropic.claude-haiku-5-5 Ditagih melalui AWS Marketplace
Google Cloud, Microsoft Foundry, Platform Claude di AWS claude-haiku-5-5 ID sama dengan API Claude
Claude.ai — web, iOS, Android Pemilih model Pengguna Gratis, Pro, Max, Tim, dan Perusahaan dapat memilihnya
Claude Code /model claude-haiku-5-5 v2.1.293 atau lebih baru; paket berbayar
Vercel AI Gateway anthropic/claude-haiku-5.5 Mulai dari $0,10 / $0,50
Cursor claude-haiku-5-5 Kumpulan Model Lain

Per 8 Oktober 2026, model ini belum tersedia di OpenRouter dan belum diumumkan untuk GitHub Copilot.

Akses chat pada paket Gratis bukanlah API key. API tetap menggunakan skema bayar sesuai pemakaian, di luar kredit gratis kecil untuk pengguna baru. Paket Max dan Tim kini mencakup kredit API bulanan:

  • $100 pada Max 5x;
  • $200 pada Max 20x;
  • hingga $500 yang dikumpulkan pada Tim.

Kredit tersebut tidak mencakup Claude Code. Baca panduan akses gratis untuk melihat rute gratis dan batasannya.

Di Claude Code, alias haiku berarti Haiku 5.5 hanya pada API Anthropic. Di platform lain, alias tersebut masih berarti Haiku 4.5. Lihat Haiku 5.5 di Claude Code untuk konfigurasi sub-agen.

Siapa yang harus beralih ke Haiku 5.5

  • Pengguna Haiku 4.5: beralih setelah memperbaiki lima perubahan yang merusak. Haiku 5.5 mengungguli Haiku 4.5 pada semua baris tabel peluncuran yang memiliki skor untuk keduanya, dengan harga daftar lebih rendah.
  • Pengguna Sonnet atau Opus untuk pekerjaan sederhana dan berulang: uji Haiku 5.5 untuk klasifikasi, ekstraksi, ringkasan, dan sub-agen. Gunakan model yang lebih besar untuk pengkodean agen yang kompleks.
  • Pengguna dengan prompt di atas 100 ribu token: hitung biaya pada tingkat harga kedua sebelum migrasi. Di atas ambang batas, biaya input per token menjadi 5x lebih tinggi.
  • Tim keamanan: perlindungan siber Haiku 5.5 masih memblokir pengujian penetrasi.

Dalam posting peluncuran, Asana melaporkan latensi penyelesaian tugas 30% lebih rendah. Box melaporkan skor 11 poin di atas Haiku 4.5 dengan latensi sekitar setengahnya. Ini adalah klaim pelanggan, bukan pengujian independen.

Kartu sistem juga mencatat bahwa model ini lebih sering menolak dibandingkan model lain dalam audit otomatis Anthropic. Uji tingkat penolakan menggunakan prompt produksi Anda sendiri sebelum menerapkannya secara luas.

Kirim request Haiku 5.5 pertama Anda

Gunakan API Messages dengan thinking.type: "adaptive" dan pilih tingkat upaya melalui output_config.effort.

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 4000,
    "thinking": {"type": "adaptive", "display": "summarized"},
    "output_config": {"effort": "low"},
    "messages": [
      {
        "role": "user",
        "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error."
      }
    ]
  }'
Enter fullscreen mode Exit fullscreen mode

Jangan sertakan parameter sampling atau pra-isi Asisten. Saat memproses respons, baca blok content berdasarkan field type, karena respons dapat dimulai dengan blok pemikiran.

Di Apidog, impor perintah curl sebagai request baru dan simpan key dalam environment variable ANTHROPIC_API_KEY.

Tambahkan assertion untuk memastikan stop_reason bukan:

refusal
Enter fullscreen mode Exit fullscreen mode

atau:

max_tokens
Enter fullscreen mode Exit fullscreen mode

Kemudian duplikat request dan ubah effort dari low ke medium. Bandingkan objek usage untuk mengukur dampak biaya dari tiap tingkat upaya.

Untuk caching, batch, dan streaming, buka panduan API Haiku 5.5. Jika belum memiliki key, ikuti panduan API key Anthropic.

FAQ

Kapan Claude Haiku 5.5 dirilis?

7 Oktober 2026, sembilan hari setelah Sonnet 5.5.

Apakah Claude Haiku 5.5 gratis?

Di aplikasi chat Claude.ai, pengguna Gratis dapat memilihnya. API berbayar, selain kredit uji coba kecil untuk pengguna baru. Lihat setiap rute gratis.

Berapa jendela konteks Claude Haiku 5.5?

1 juta token, dengan output maksimum 128 ribu token pada API Messages.

Apakah Haiku 4.5 akan dihentikan?

Belum. Model ini masih terdaftar aktif, dengan penghentian tidak lebih cepat dari 15 Oktober 2026.

Langkah selanjutnya

Pilih satu pekerjaan bervolume tinggi yang sudah berjalan hari ini, misalnya triase tiket atau ringkasan dokumen. Kirim workload tersebut ke claude-haiku-5-5 pada low dan medium, lalu:

  1. periksa kualitas output;
  2. catat stop_reason;
  3. bandingkan usage;
  4. bandingkan biaya dengan model yang Anda gunakan saat ini.

Unduh Apidog untuk menyimpan request dan assertion dalam satu proyek. Setelah itu, gunakan panduan harga untuk mengubah jumlah token menjadi estimasi tagihan bulanan.

Top comments (0)