DEV Community

Cover image for Claude Opus 5 vs Sonnet 5: Pilih Tingkat Mana yang Tepat untuk Anda?
Walse
Walse

Posted on • Originally published at apidog.com

Claude Opus 5 vs Sonnet 5: Pilih Tingkat Mana yang Tepat untuk Anda?

Anthropic merilis Claude Opus 5 pada 24 Juli 2026 dan Claude Sonnet 5 pada 30 Juni 2026. Keduanya memiliki jendela konteks 1 juta token, output maksimum 128k token, pemikiran adaptif aktif secara default, serta parameter upaya (effort). Dari sisi API, keduanya tampak hampir identik—tetapi biaya dan reliabilitas per tugas dapat menghasilkan keputusan yang berbeda.

Coba Apidog hari ini

Sonnet 5 masih memakai tarif perkenalan $2 per juta token input dan $10 per juta token output hingga 31 Agustus 2026. Mulai 1 September 2026, tarifnya menjadi $3 / $15. Opus 5 tetap $5 / $25. Untuk beban kerja yang rilis pada Q4, hitung biaya menggunakan tarif Sonnet setelah September, bukan tarif perkenalan saat ini.

Perbandingan Claude Opus 5 dan Sonnet 5

Panduan ini membantu Anda memilih model berdasarkan biaya per tugas yang selesai, bukan sekadar biaya per token. Anda juga dapat menguji keduanya secara berdampingan di Apidog dan membandingkan objek usage dari respons API.

Gambaran harga dan tanggal perubahan

Berikut tarif dasar dari halaman harga Anthropic.

Model Input / Juta Token Output / Juta Token Status
Claude Opus 5 $5.00 $25.00 Standar
Claude Sonnet 5 (hingga 31 Agustus 2026) $2.00 $10.00 Perkenalan
Claude Sonnet 5 (mulai 1 September 2026) $3.00 $15.00 Standar

Sebelum menetapkan model default, pertimbangkan juga tarif Opus 5 berikut:

  • Cache prompt: $6.25 per juta token untuk penulisan cache 5 menit.
  • Cache prompt: $10 per juta token untuk penulisan cache 1 jam.
  • Cache hit: $0.50 per juta token.
  • Batch API: $2.50 / $12.50, atau diskon tetap 50%.
  • Mode cepat: $10 / $50 untuk output 2,5x lebih cepat. Ini adalah pratinjau penelitian, hanya tersedia pada API pihak pertama, dan tidak dapat digabungkan dengan batch.
  • inference_geo: "us" menambahkan pengganda 1,1x untuk setiap kategori token.

Lihat rincian implementasinya pada panduan harga Opus 5 dan rincian harga Sonnet 5.

Biaya Opus 5 sama dengan Opus 4.8. Anthropic tidak menaikkan harga Opus untuk lompatan generasi ini. Artinya, jika sebelumnya Anda membandingkan Opus 4.8 dengan Sonnet, perhitungan biaya dasarnya tetap sama—dengan kemampuan Opus yang lebih tinggi.

Spesifikasi: hampir identik di permukaan

Spesifikasi Claude Opus 5 Claude Sonnet 5
ID model claude-opus-5 claude-sonnet-5
Jendela konteks 1 juta token 1 juta token
Output maksimum 128k; 300k di Batch API dengan header beta 128k
Pemikiran adaptif Aktif secara default Aktif secara default
Tingkat upaya Lima tingkat hingga max; default high low, medium, high, xhigh
Batas pengetahuan Mei 2026 Januari 2026
Tingkat Prioritas Tidak didukung Tidak tersedia
Cache prompt, alat, batch, visi Didukung Didukung
Tokenisasi Tokenizer generasi 4.7 Tokenizer generasi 4.7

Tiga perbedaan berikut paling relevan saat implementasi.

1. Batas pengetahuan berbeda empat bulan

Opus 5 memiliki batas pengetahuan Mei 2026, sedangkan Sonnet 5 berhenti pada Januari 2026. Jika tugas Anda bergantung pada perubahan API, versi library, atau dokumentasi dari musim semi 2026, Opus 5 bisa memiliki konteks bawaan yang lebih baru.

Namun, untuk aplikasi dengan RAG atau pengambilan data eksternal, Anda dapat menutup celah ini pada kedua model. Jangan membayar Opus hanya untuk kekinian jika sumber data aplikasi Anda sudah diperbarui.

2. Tidak ada Tingkat Prioritas

Jika Anda bermigrasi dari Opus 4.8 dan bergantung pada Tingkat Prioritas untuk jaminan latensi, tidak ada model generasi saat ini yang dapat menggantikannya secara langsung. Periksa panduan migrasi Opus 4.8 ke Opus 5 sebelum memindahkan workload produksi.

3. Tokenizer bukan pembeda

Kedua model menggunakan tokenizer generasi 4.7. Input yang sama menghasilkan jumlah token yang sama pada Opus 5 dan Sonnet 5, sehingga tarif per token dapat dibandingkan langsung.

Mengapa biaya per token tidak cukup

Anthropic mendokumentasikan bahwa Claude 4.7 dan model setelahnya dapat menghasilkan sekitar 30% token lebih banyak untuk teks yang sama dibanding model sebelumnya. Perbedaan itu berlaku terhadap Sonnet 4.6 dan sebelumnya, bukan antara Opus 5 dan Sonnet 5.

Jadi, jika Anda memilih antara Opus 5 dan Sonnet 5:

  1. Jangan mengasumsikan ada selisih tokenisasi.
  2. Ukur panjang output aktual.
  3. Ukur jumlah percobaan ulang.
  4. Masukkan waktu review manusia ke perhitungan.

Output adalah sumber biaya yang penting karena token output berharga lima kali token input pada kedua model. Prompt yang tidak membatasi panjang jawaban dapat membuat model menghasilkan prosa lebih panjang dari kebutuhan.

Tambahkan batas eksplisit pada prompt:

Berikan jawaban maksimal 8 butir.
Jangan jelaskan teori umum.
Tampilkan hanya perubahan kode dan alasan singkat.
Jika informasi tidak cukup, ajukan satu pertanyaan klarifikasi.
Enter fullscreen mode Exit fullscreen mode

Panduan prompting Opus 5 membahas instruksi keringkasan lebih lanjut.

Gunakan juga endpoint penghitungan token Anthropic sebelum memproyeksikan biaya atas dokumen atau prompt besar.

Contoh biaya harian

Asumsikan beban kerja harian memakai 500k token input dan 40k token output.

Skenario Biaya Harian Rasio vs Sonnet 5
Opus 5 $3.50 Baseline
Sonnet 5, tarif perkenalan ($2/$10) $1.40 Opus 2,5x
Sonnet 5, tarif standar mulai 1 September ($3/$15) $2.10 Opus 1,67x
Opus 5 menghasilkan output 30% lebih panjang $3.80 Opus 1,81x

Selisih output yang tidak diperlukan dapat lebih mahal daripada perbedaan antar-tier. Perbaiki prompt sebelum mengubah model.

Percobaan ulang juga dapat membalikkan keputusan. Dengan tarif standar:

  • Satu eksekusi Opus 5: $3.50
  • Satu eksekusi Sonnet 5: $2.10
  • Dua eksekusi Sonnet 5 karena percobaan pertama gagal: $4.20

Jika Opus menyelesaikan tugas dalam satu kali jalan sementara Sonnet perlu diulang, Sonnet justru lebih mahal. Optimalkan retry, validasi, dan review menggunakan panduan mengurangi tagihan API Claude.

Kapan Opus 5 layak dibayar

Angka peluncuran Anthropic adalah hasil yang diterbitkan vendor dan, per 25 Juli 2026, belum direproduksi secara independen. Gunakan sebagai klaim bersumber, bukan ukuran netral.

Klaim benchmark Anthropic untuk Opus 5 mencakup:

  • Frontier-Bench v0.1: melampaui model lain dan lebih dari dua kali skor Opus 4.8, dengan biaya per tugas lebih rendah.
  • ARC-AGI 3: sekitar 3x skor model terbaik berikutnya.
  • OSWorld 2.0: melampaui Fable 5 dengan sekitar sepertiga biaya.
  • CursorBench 3.2: berada dalam 0,5% dari Fable 5 dengan setengah harga.
  • Zapier AutomationBench: tingkat kelulusan sekitar 1,5x model terbaik berikutnya.
  • Sains: kimia organik naik 10,2 poin dan analisis protein naik 7,7 poin dibanding Opus 4.8.

Sebaliknya, angka peluncuran Sonnet 5 berada sedikit di bawah Opus 4.8 pada beberapa benchmark agen: SWE-bench Pro 63,2% vs 69,2%, Terminal-Bench 2.1 80,4% vs 82,7%, dan OSWorld-Verified 81,2% vs 83,4%.

Baca atribusi lengkap pada rincian benchmark Opus 5 dan postingan benchmark Sonnet 5.

Pilih Opus 5 jika workload memiliki satu atau beberapa karakteristik berikut:

  • Pengkodean agen jangka panjang: refactoring multi-file, migrasi, atau loop yang menjalankan puluhan pemanggilan alat.
  • Kegagalan mahal: migrasi produksi, kode terkait keamanan, atau perubahan yang memerlukan review manusia intensif.
  • Penggunaan komputer: otomatisasi desktop dan interaksi antarmuka.
  • Penalaran ilmiah atau analitis sulit: termasuk chemistry atau analisis protein.
  • Kebutuhan pengetahuan Mei 2026: ketika data tersebut tidak dapat diberikan lewat RAG atau sumber eksternal.

Kapan Sonnet 5 sudah cukup

Untuk sebagian besar trafik produksi, Sonnet 5 adalah pilihan yang rasional. Jangan membayar kemampuan tambahan jika Anda tidak dapat mengukurnya pada metrik aplikasi.

Pilih Sonnet 5 ketika:

  • Volume tinggi dengan panggilan kecil: klasifikasi, ekstraksi, tagging, routing, dan ringkasan.
  • Output tervalidasi otomatis: schema validation, unit test, atau test suite dapat menangkap kegagalan dengan biaya rendah.
  • Latensi lebih penting daripada kedalaman: terutama UX interaktif dan prototyping.
  • Anda masih menguji use case: mulai dari Sonnet, lalu ukur peningkatan yang benar-benar diberikan Opus.

Sonnet 5 juga merupakan model default pada paket Claude gratis, sehingga Anda dapat melakukan sanity check terhadap prompt sebelum menulis integrasi API. Opus 5 tersedia bagi pelanggan Pro dan menjadi default untuk Max. Lihat panduan akses gratis Opus 5 untuk detail akses.

Tabel keputusan berdasarkan workload

Beban Kerja Pilih Mengapa
Refactoring multi-file atau migrasi dalam loop agen Opus 5 Kesalahan yang menumpuk membuat reliabilitas per langkah menjadi faktor biaya utama
Klasifikasi atau ekstraksi volume tinggi Sonnet 5 Kedua model dapat memenuhi batas kualitas; harga lebih menentukan
Chatbot pelanggan dengan RAG Sonnet 5 RAG menutup celah batas pengetahuan; latensi penting
Penggunaan komputer atau otomatisasi desktop Opus 5 Kesenjangan OSWorld 2.0 adalah klaim agen paling jelas dari Anthropic
Pemrosesan dokumen batch semalaman Sonnet 5 atau Opus 5 Batch API Diskon batch 50% dapat membuat Opus mendekati tarif Sonnet standar
Review keamanan atau kode produksi kritis Opus 5 Biaya kesalahan lebih besar daripada selisih token
Analisis ilmiah atau kuantitatif Opus 5 Klaim peningkatan chemistry dan analisis protein paling kuat
Prototyping dan alat internal Sonnet 5 Mulai murah, lalu ukur sebelum meningkatkan
Membutuhkan pengetahuan musim semi 2026 tanpa RAG Opus 5 Batas pengetahuan Mei 2026 vs Januari 2026
UX interaktif sensitif latensi Sonnet 5 Atau mode cepat Opus 5 jika kedalaman tidak dapat dikompromikan

Perhatikan opsi Batch API: Opus 5 pada batch berharga $2.50 / $12.50. Tarif input ini berada di bawah tarif standar Sonnet 5 mulai September sebesar $3 / $15, sedangkan tarif outputnya sedikit lebih tinggi. Jika workload Anda toleran terhadap pemrosesan asinkron, batch dapat mengubah keputusan model.

Bukan kedua model ini?

Opus 5 bukan puncak dari jajaran Claude. Fable 5 tetap menjadi model Anthropic paling mumpuni yang dirilis secara luas, dengan harga $10 / $50.

Opus 5 juga masih tertinggal dari Mythos 5 untuk eksploitasi keamanan siber dan penelitian biologi otonom, berdasarkan pernyataan Anthropic sendiri.

Gunakan Opus 5 sebagai model kemampuan kelas perintis dengan setengah harga perintis. Jika workload Anda berada pada kebutuhan tertinggi tersebut, bandingkan Opus 5 vs Fable 5, bukan Opus vs Sonnet.

Uji sendiri di Apidog

Benchmark adalah workload orang lain. Keputusan produksi harus menggunakan prompt, alat, data, dan kriteria penerimaan Anda sendiri.

Menguji model Claude di Apidog

Kedua model memakai endpoint Messages yang sama. Anda hanya perlu mengubah nilai model.

  1. Buat request ke endpoint Messages Anthropic.
  2. Simpan API key sebagai environment variable, bukan di request body.
  3. Duplikat request dengan prompt yang sama.
  4. Set model pertama ke claude-opus-5.
  5. Set model kedua ke claude-sonnet-5.
  6. Bandingkan objek usage, hasil validasi, durasi, dan jumlah retry.
  7. Tambahkan assertion agar respons terpotong atau penolakan gagal secara eksplisit.
  8. Untuk Opus 5, uji beberapa nilai output_config.effort dan cari konfigurasi termurah yang tetap lolos evaluasi.

Contoh request:

curl https://api.anthropic.com/v1/messages \
  --header "x-api-key: $ANTHROPIC_API_KEY" \
  --header "anthropic-version: 2023-06-01" \
  --header "content-type: application/json" \
  --data '{
    "model": "claude-opus-5",
    "max_tokens": 4096,
    "messages": [
      {
        "role": "user",
        "content": "Refactor handler ini agar menggunakan async I/O."
      }
    ]
  }'
Enter fullscreen mode Exit fullscreen mode

Contoh struktur evaluasi sederhana yang dapat Anda simpan pada setiap hasil:

{
  "model": "claude-opus-5",
  "passed_schema": true,
  "passed_tests": true,
  "retry_count": 0,
  "input_tokens": 0,
  "output_tokens": 0,
  "cache_read_input_tokens": 0,
  "latency_ms": 0
}
Enter fullscreen mode Exit fullscreen mode

Dua hal penting saat pengujian:

  • Pemikiran adaptif aktif secara default pada kedua model.
  • max_tokens membatasi token pemikiran dan respons secara bersamaan. Anggaran yang sebelumnya cukup pada model lama dapat menghasilkan respons terpotong.
  • Pada Opus 5, kombinasi thinking: {"type": "disabled"} dengan effort bernilai xhigh atau max menghasilkan respons HTTP 400.

Gunakan Apidog untuk menjalankan kedua request secara berdampingan. Untuk pengujian tingkat upaya, lihat panduan parameter effort Opus 5. Untuk alur request lengkap, baca panduan API Opus 5.

FAQ

Apakah Claude Opus 5 sepadan dengan 2,5x harga Sonnet 5?

Untuk pengkodean agen jangka panjang, penggunaan komputer, dan tugas yang mahal jika salah, ya. Untuk klasifikasi, ekstraksi, dan chat volume tinggi, biasanya tidak. Rasio 2,5x hanya berlaku hingga 1 September 2026; setelah tarif standar Sonnet 5 berlaku, rasio menjadi sekitar 1,67x.

Kapan harga Claude Sonnet 5 berubah?

Tarif perkenalan $2 / $10 berlaku hingga 31 Agustus 2026. Mulai 1 September 2026, tarif berubah menjadi $3 / $15. Opus 5 tetap $5 / $25.

Apakah Opus 5 dan Sonnet 5 melakukan tokenisasi secara berbeda?

Tidak. Keduanya memakai tokenizer generasi 4.7. Input yang identik menghasilkan jumlah token input yang identik. Kenaikan token sekitar 30% yang didokumentasikan Anthropic berlaku saat migrasi dari Sonnet 4.6 atau model sebelumnya, bukan saat memilih antara Opus 5 dan Sonnet 5.

Bandingkan biaya per tugas selesai, bukan hanya biaya per token: panjang output, retry, dan review manusia sering lebih menentukan.

Bisakah saya beralih antara Opus 5 dan Sonnet 5 tanpa perubahan kode?

Sebagian besar bisa. Keduanya memakai pemikiran adaptif secara default dan menolak parameter sampling non-default. Perbedaan yang perlu diperhatikan:

  • Opus 5 memiliki tingkat max dan default high.
  • Sonnet 5 mendukung low, medium, high, dan xhigh.
  • Opus 5 mengembalikan HTTP 400 jika pemikiran dinonaktifkan saat effort adalah xhigh atau max.

Model mana yang direkomendasikan Anthropic secara default?

Dokumen Anthropic merekomendasikan memulai dari Claude Opus 5 jika Anda tidak yakin. Itu adalah rekomendasi kemampuan, bukan analisis biaya. Mulai dari sana jika kualitas adalah prioritas, lalu ukur apakah Sonnet 5 menghasilkan output yang setara dengan biaya lebih rendah.

Untuk konteks historis tier, lihat juga perbandingan Sonnet 5 vs Opus 4.8.

Untuk spesifikasi lengkap, atribusi benchmark, dan matriks ketersediaan, mulai dari apa itu Claude Opus 5, lalu baca postingan peluncuran Opus 5 dan gambaran umum model Anthropic.

Top comments (0)