DEV Community

Cover image for Claude Fable 5.1 vs Opus 5: Kapan Harga Dua Kali Lipat Sepadan?
Walse
Walse

Posted on Originally published at apidog.com

Claude Fable 5.1 vs Opus 5: Kapan Harga Dua Kali Lipat Sepadan?

Claude Fable 5.1 berharga $10 per juta token masukan dan $50 per juta token keluaran, sedangkan Claude Opus 5 berharga $5 dan $25. Dokumentasi Anthropic menyarankan memulai dengan Opus 5, lalu beralih ke Fable 5.1 hanya jika evaluasi Opus 5 dengan upaya lebih tinggi masih belum memadai. Perbandingan ini menggunakan aturan tersebut: kapan Fable 5.1 unggul, kapan penyetelan prompt dapat menutup selisih, dan kapan pembacaan cache membuat Fable 5.1 lebih ekonomis.

Coba Apidog hari ini

Sumber utama adalah postingan peluncuran Anthropic, halaman model Fable 5.1, dan halaman harga. Untuk pengenalan model, baca apa itu Claude Fable 5.1 dan apa itu Claude Opus 5.

Perbandingan Samping-Samping

Claude Fable 5.1 Claude Opus 5
ID model claude-fable-5-1 claude-opus-5
Dirilis 1 September 2026 24 Juli 2026
Penempatan Penalaran menuntut dan pekerjaan keagenan berjangka panjang Pengkodean keagenan kompleks dan pekerjaan perusahaan; standar yang direkomendasikan
Masukan / keluaran $10 / $50 $5 / $25
Pembacaan cache $0.25 $0.50
Penulisan cache (5 menit / 1 jam) $12.50 / $20 $6.25 / $10
Batch $5 / $25 $2.50 / $12.50
Mode cepat Tidak Ya, $10 / $50
Tingkat prioritas Tidak Tidak
Konteks / keluaran maksimum 1 juta / 128K 1 juta / 128K; 300K pada Batch dengan beta
Batas pengetahuan Juni 2026 Mei 2026
Latensi komparatif Lebih lambat Sedang
Berpikir Selalu aktif; disabled mengembalikan 400 Aktif secara default; disabled diizinkan pada high atau lebih rendah
tool_choice yang dipaksakan 400 Diterima
Pengklasifikasi keamanan Siber, bio, LLM frontier, ekstraksi penalaran, bahaya umum Hanya siber
Retensi data nol Tidak tersedia kecuali diizinkan Tersedia
Upaya per pesan (beta) Ya Ya
Pemeriksaan pengeditan riwayat Ya Tidak

Apa Kata Tolok Ukur?

Semua angka berikut berasal dari Anthropic dan dijalankan oleh Anthropic. Belum ada reproduksi independen.

Tolok ukur Fable 5.1 Opus 5 Selisih
Terminal-Bench-Science 0.1 52.6% 29.0% +23.6
AutomationBench 31.4% 26.9% +4.5
Humanity’s Last Exam (tanpa alat) 60.9% 56.6% +4.3
Terminal-Bench 4.0 55.8% 52.3% +3.5
CursorBench 3.2.0 73.4% 70.0% +3.4
OSWorld 2.0 (sebagian) 77.9% 75.4% +2.5
OSWorld 2.0 (ketat) 41.7% 39.6% +2.1
Humanity’s Last Exam (dengan alat) 65.0% 63.6% +1.4
GDPval-AA v2 1853 1824 +29 Elo

Ada dua pola utama:

  • Pada Terminal-Bench-Science, Fable 5.1 hampir dua kali lipat Opus 5. Ini adalah tolok ukur penelitian berjangka panjang dan berat alat, dengan model yang menjalankan eksperimen melalui terminal dalam waktu lama.
  • Pada tolok ukur lain, selisihnya berkisar satu hingga lima poin. Selisih 4,5 poin pada AutomationBench tetap signifikan, sementara 1,4 poin pada Humanity’s Last Exam dengan alat atau 29 Elo pada GDPval berada dalam rentang yang mungkin berubah karena prompt dan pengaturan upaya.

Opus 5 diluncurkan pada Juli dengan skor 52,3% di Terminal-Bench 4.0, mengungguli Fable 5 sebesar 42,0%. Fable 5.1 kini kembali unggul pada 55,8%, tetapi selisihnya 3,5 poin—bukan 13,8 poin. Artinya, keunggulan Fable pada pengkodean keagenan nyata, tetapi lebih sempit dibandingkan persaingan pada bulan Juni. Lihat perbandingan Opus 5 vs Fable 5 untuk konteks awalnya.

Harga Tidak Selalu 2x Lipat

Tanpa cache, Fable 5.1 tepat dua kali lebih mahal daripada Opus 5 pada setiap kategori. Namun, pembacaan cache justru lebih murah: $0,25 untuk Fable 5.1 dibandingkan $0,50 untuk Opus 5. Pengganda biaya efektif bergantung pada proporsi input yang berasal dari awalan ter-cache.

Contoh: loop agen dengan banyak cache

Misalkan satu giliran menggunakan:

  • 150.000 token input ter-cache
  • 1.000 token input tanpa cache
  • 800 token output

Opus 5:

5(0.001) + 0.5(0.15) + 25(0.0008) = $0,005 + $0,075 + $0,02 = $0,10

Fable 5.1:

10(0.001) + 0.25(0.15) + 50(0.0008) = $0,01 + $0,0375 + $0,04 = $0,0875

Pada pola ini, Fable 5.1 lebih murah per giliran.

Contoh: tinjauan kode dengan output besar

Untuk 30.000 token input tanpa cache dan 4.000 token output:

  • Opus 5: $0,15 + $0,10 = $0,25
  • Fable 5.1: $0,30 + $0,20 = $0,50

Pada pola ini, Fable 5.1 tepat dua kali lebih mahal.

Titik persilangannya terjadi ketika token input ter-cache melebihi sekitar 20 kali jumlah token input tanpa cache dan lima kali token output. Kondisi ini umum pada loop agen dengan awalan panjang, tetapi hampir tidak mungkin pada workload yang didominasi output. Karena penulisan cache Fable 5.1 juga dua kali lebih mahal, sesi yang sering mereset cache akan kehilangan keuntungannya.

Lihat perincian harga Fable 5.1 dan perincian harga Opus 5 untuk tabel lengkap.

Di Mana Opus 5 Lebih Unggul?

1. Workload dengan pemikiran yang dimatikan

Opus 5 menerima thinking: {"type": "disabled"} pada upaya high atau lebih rendah. Fable 5.1 tidak mendukungnya. Untuk klasifikasi, ekstraksi, dan routing jawaban singkat, Opus 5 dengan pemikiran dinonaktifkan atau upaya low lebih murah dan lebih cepat.

2. Mode cepat

Opus 5 memiliki mode cepat pratinjau penelitian dengan kecepatan output hingga 2,5x, seharga $10 dan $50. Fable 5.1 tidak memiliki padanannya. Jika waktu respons lebih penting daripada selisih beberapa poin pada tolok ukur, Opus 5 adalah pilihan yang lebih tepat.

3. Latensi

Anthropic mencantumkan Fable 5.1 dengan latensi “lebih lambat” dan Opus 5 dengan latensi “sedang”. Giliran tunggal Fable 5.1 pada tugas sulit dengan upaya tinggi dapat berlangsung beberapa menit.

4. Retensi data nol

Opus 5 tersedia dengan ZDR. Fable 5.1 adalah Model Tertutup dan mengembalikan 400 kecuali Anthropic memberikan izin khusus untuk akses ZDR.

5. Penolakan lebih sedikit

Opus 5 hanya menggunakan pengklasifikasi keamanan siber. Fable 5.1 menggunakan rangkaian yang lebih luas: siber, bio, pengembangan LLM frontier, ekstraksi penalaran, dan bahaya umum. Workload ilmu hayat atau machine learning yang tidak berbahaya dapat memicu penolakan pada Fable 5.1 meskipun berjalan pada Opus 5. Dalam kasus tersebut, Opus 5 tetap menjadi target fallback.

6. Pemaksaan penggunaan alat

Opus 5 menerima tool_choice any dan tool, sedangkan Fable 5.1 mengembalikan 400. Jika integrasi mengandalkan tool call yang dipaksakan, Opus 5 menghindarkan Anda dari penulisan ulang.

7. Pengeditan riwayat

Opus 5 tetap berjalan ketika giliran sebelumnya diedit. Fable 5.1 membatalkan blok pemikiran berikutnya setelah pengeditan. Harness yang melakukan kompresi sisi klien atau menyuntikkan pengingat pada setiap giliran perlu diaudit sebelum bermigrasi ke Fable 5.1.

Di Mana Fable 5.1 Lebih Unggul?

1. Penelitian berjangka panjang dan agen terminal

Skor Terminal-Bench-Science sebesar 52,6% dibandingkan 29,0% adalah selisih terbesar dalam data Anthropic. Jika agen menjalankan eksperimen, melakukan riset web multi-langkah, atau bekerja selama berjam-jam, inilah workload yang dirancang untuk Fable 5.1.

2. Otomatisasi alur kerja bisnis

Pada AutomationBench, Fable 5.1 meraih 31,4% dibandingkan 26,9% untuk Opus 5. Tolok ukur ini memodelkan tugas end-to-end di berbagai aplikasi, sehingga selisih tersebut relevan untuk otomatisasi bisnis.

3. Agen dengan awalan ter-cache

Biaya pembacaan cache $0,25 dapat membuat Fable 5.1 lebih murah per giliran pada loop yang didominasi awalan panjang dan stabil.

4. Batas pengetahuan yang lebih baru

Batas pengetahuan Fable 5.1 adalah Juni 2026, sedangkan Opus 5 Mei 2026. Selisih satu bulan ini membuat Fable 5.1 menjadi model Claude yang paling baru.

5. Visi untuk dokumen padat

Anthropic menyebut peningkatan dalam membaca grafik, formulir, dan tabel di dalam PDF, terutama jika dipadukan dengan alat potong-dan-zoom. Karena Opus 5 belum dibandingkan dalam tolok ukur visi yang dipublikasikan, perlakukan klaim ini sebagai hipotesis yang perlu diuji.

6. Saat Opus 5 pada xhigh gagal

Ini adalah aturan pemilihan Anthropic yang paling praktis: jika tugas gagal pada Opus 5 dengan xhigh, coba Fable 5.1 pada high sebelum mengubah hal lain.

Upaya Mengubah Hasil Perbandingan

Kedua model menyediakan lima tingkat upaya. Anthropic secara khusus menyatakan bahwa Fable 5.1 pada upaya low sering kompetitif dengan model Claude Opus dan Sonnet dalam biaya per tugas, dengan skor yang lebih tinggi.

Karena itu, perbandingan untuk workload rutin tidak harus berupa Opus 5 high versus Fable 5.1 high. Uji juga:

  • Opus 5 pada high
  • Fable 5.1 pada low
  • Fable 5.1 pada medium

Upaya yang lebih rendah biasanya menghasilkan lebih sedikit token output, sehingga sebagian harga per token yang dua kali lipat dapat terkompensasi.

Sebaliknya, keunggulan Fable 5.1 atas Fable 5 paling besar pada xhigh dan max. Batas kemampuan tertinggi Fable 5.1 juga membutuhkan waktu dan biaya terbesar. Uji kedua model pada semua tingkat upaya menggunakan evaluasi Anda sendiri sebelum menarik kesimpulan dari tabel peluncuran.

Panduan parameter upaya Opus 5 membahas kelima tingkat tersebut; semantiknya sama pada Fable 5.1.

Kerangka Keputusan Praktis

Gunakan strategi bertahap berikut:

  1. Mulai dengan Opus 5 pada high. Ini adalah rekomendasi default Anthropic, dengan harga setengahnya, lebih sedikit pengklasifikasi keamanan, dan dukungan ZDR.
  2. Naikkan ke xhigh untuk tugas yang gagal. Langkah ini biasanya lebih murah daripada mengganti model.
  3. Pindahkan hanya tugas yang masih gagal ke Fable 5.1 pada high. Pertahankan Opus 5 untuk rute yang sudah berhasil.
  4. Periksa profil cache. Jika workload yang dipindahkan merupakan loop dengan awalan panjang, Fable 5.1 mungkin lebih murah per giliran.
  5. Audit harness sebelum migrasi. tool_choice yang dipaksakan dan pengeditan riwayat tidak kompatibel dengan Fable 5.1.

Baca panduan migrasi Fable 5.1 untuk daftar periksa implementasinya.

Menjalankan Perbandingan di Apidog

Buat satu koleksi berisi prompt produksi dan jadikan model sebagai variabel lingkungan. Jalankan koleksi tersebut dalam urutan berikut:

  1. claude-opus-5 pada high
  2. claude-opus-5 pada xhigh
  3. claude-fable-5-1 pada high
  4. claude-fable-5-1 pada low

Untuk setiap eksekusi, simpan:

  • Jawaban model
  • usage.output_tokens
  • usage.cache_read_input_tokens
  • Biaya berdasarkan tarif model dan tingkat upaya

Kalikan penggunaan token dengan tarif masing-masing model menggunakan skrip pasca-respons. Dengan begitu, Anda mendapatkan biaya per tugas, model, dan tingkat upaya dalam satu tabel.

Apidog menyimpan setiap eksekusi sebagai riwayat, sehingga hasil perbandingan tetap tersedia setelah model berikutnya dirilis. Unduh Apidog untuk memulai.

FAQ

Apakah Claude Fable 5.1 lebih baik daripada Opus 5?

Pada setiap tolok ukur yang diterbitkan Anthropic, Fable 5.1 unggul dengan selisih 1,4 hingga 23,6 poin. Selisih terbesar muncul pada Terminal-Bench-Science, sedangkan sebagian besar tolok ukur lain berada di bawah lima poin. Ingat bahwa semua hasil tersebut dijalankan oleh vendor.

Apakah Fable 5.1 sepadan dengan harga dua kali lipat?

Sering kali ya untuk penelitian berjangka panjang, agen terminal, otomatisasi bisnis, dan pada klasifikasi, biasanya tidak. Ikuti aturan Anthropic: naik ke Fable 5.1 hanya ketika Opus 5 pada tingkat upaya lebih tinggi gagal dalam evaluasi Anda.

Mana yang lebih cepat?

Opus 5. Anthropic mencantumkan latensinya sebagai “sedang”, dibandingkan “lebih lambat” untuk Fable 5.1. Opus 5 juga memiliki mode cepat dengan kecepatan output hingga 2,5x, sementara Fable 5.1 tidak.

Apakah Opus 5 memiliki pengklasifikasi keamanan yang sama?

Tidak. Opus 5 hanya menggunakan pengklasifikasi siber. Fable 5.1 juga mencakup bio, LLM frontier, ekstraksi penalaran, dan bahaya umum. Jika Fable 5.1 menolak permintaan, Opus 5 adalah salah satu target fallback yang diizinkan.

Bisakah Fable 5.1 digunakan dengan retensi data nol seperti Opus 5?

Tidak. Fable 5.1 memerlukan retensi 30 hari dan merupakan Model Tertutup. Opus 5 tersedia dengan ZDR.

Bisakah percakapan dipindahkan antara Opus 5 dan Fable 5.1?

Bisa saat menaikkan model: Fable 5.1 dapat membaca blok pemikiran dari Opus 5.

Saat menurunkan model, API menghapus blok pemikiran Fable 5.1 sebelum Opus 5 menerimanya dan tidak menagih token tersebut. Opus 5 kemudian merencanakan ulang giliran itu.

Top comments (0)