DEV Community

Cover image for Claude Fable 5.1 vs Fable 5: Perbedaan dan Haruskah Anda Upgrade?
Walse
Walse

Posted on Originally published at apidog.com

Claude Fable 5.1 vs Fable 5: Perbedaan dan Haruskah Anda Upgrade?

Claude Fable 5.1 vs Fable 5: Apakah Saatnya Migrasi?

Claude Fable 5.1 menggantikan Fable 5 pada 1 September 2026. Harganya tetap $10 dan $50 per juta token, sementara pembacaan cache turun dari $1 menjadi $0,25 per juta token. Anthropic juga melaporkan hasil yang lebih baik pada setiap tolok ukur yang dipublikasikan. Fable 5 masih tersedia dan dijamin hingga setidaknya 9 Juni 2027. Jadi, pertanyaannya bukan apakah Fable 5.1 lebih baik di atas kertas, melainkan apakah peningkatannya sepadan dengan biaya migrasi—dan apakah tiga perubahan yang merusak akan memengaruhi beban kerja Anda.

Coba Apidog hari ini

Perbandingan ini merangkum apa yang tetap sama, apa yang meningkat, apa yang menjadi lebih sulit, dan model mana yang sebaiknya dipilih berdasarkan beban kerja. Sumber utama adalah postingan peluncuran Anthropic, Apa yang baru di Claude Fable 5.1, dan lembar spesifikasi Claude Fable 5.1.

Perbandingan berdampingan

Spesifikasi Claude Fable 5.1 Claude Fable 5
ID model claude-fable-5-1 claude-fable-5
Dirilis 1 September 2026 9 Juni 2026; ditangguhkan 12 Juni, kembali 1 Juli
Pensiun Tidak lebih cepat dari 1 September 2027 Tidak lebih cepat dari 9 Juni 2027
Konteks / keluaran maksimum 1M / 128K 1M / 128K
Batas pengetahuan Juni 2026 Januari 2026
Harga masukan / keluaran $10 / $50 $10 / $50
Pembacaan cache $0,25 per juta $1,00 per juta
Penulisan cache $12,50 (5 menit), $20 (1 jam) Sama
Batch $5 / $25 Sama
Tokenizer Sama, generasi Opus 4.7 Sama
Berpikir Adaptif, selalu aktif Adaptif, selalu aktif
tool_choice paksa Mengembalikan 400 Diterima
Blok berpikir dapat dibaca model lama Tidak Ya
Pemeriksaan pengeditan riwayat Ya, untuk akun yang dibuat pada atau setelah 31 Agustus 2026 Tidak
Tingkat Prioritas Tidak didukung Didukung
Upaya per pesan Ya, beta Tidak
Pesan sistem dengan cakupan giliran Ya, beta Tidak
thinking.display: "updates" Ya, beta Ya, beta
Asal konten Tanda air teks + C2PA pada media Tanda air teks
Penyimpanan data Wajib 30 hari, Model Tercakup Sama
Kategori penolakan Lima kategori yang sama Lima kategori yang sama

Perbandingan Claude Fable 5.1 dan Fable 5

Apa yang tetap sama?

Lebih banyak komponen tetap kompatibel daripada yang mungkin Anda perkirakan:

  • Permukaan API
  • Jendela konteks 1M dan keluaran maksimum 128K
  • Harga per token
  • Tokenizer
  • Minimum cache 512 token
  • Pemikiran adaptif yang selalu aktif
  • Nilai default omitted untuk thinking.display
  • Larangan prefill dan parameter sampling
  • Pesan sistem di tengah percakapan
  • Kategori penolakan dan mekanisme fallback

Anthropic menyatakan bahwa prompt Fable 5 yang sudah ada seharusnya bekerja dengan baik di Fable 5.1 tanpa perubahan. Karena itu, panduan batas laju Fable 5, pengamanan, dan ketersediaan cloud masih relevan. Kedua model juga menggunakan kumpulan batas laju yang sama.

Apa yang meningkat?

1. Tolok ukur agen meningkat paling besar

Semua tolok ukur yang dipublikasikan Anthropic bergerak menguntungkan Fable 5.1, tetapi selisihnya tidak seragam.

Tolok ukur Fable 5.1 Fable 5 Delta
Terminal-Bench-Science 0.1 52,6% 24,7% +27,9
AutomationBench 31,4% 17,1% +14,3
Terminal-Bench 4.0 55,8% 42,0% +13,8
GDPval-AA v2 1853 1723 +130 Elo
OSWorld 2.0, ketat 41,7% 36,1% +5,6
OSWorld 2.0, parsial 77,9% 72,9% +5,0
Ujian Terakhir Kemanusiaan, tanpa alat 60,9% 57,8% +3,1
CursorBench 3.2.0 73,4% 70,5% +2,9
Ujian Terakhir Kemanusiaan, dengan alat 65,0% 63,8% +1,2

Lompatan terbesar muncul pada agen dengan horizon panjang: penelitian ilmiah melalui terminal, otomatisasi alur kerja bisnis, dan pengkodean agen. Peningkatannya jauh lebih kecil pada pengkodean berbasis pengetahuan dan alur kerja bergaya IDE. Semua hasil ini dijalankan oleh vendor dan belum memiliki reproduksi independen. Lihat rincian tolok ukur Fable 5.1 untuk analisis per baris.

2. Pembacaan cache turun menjadi seperempat harga

Menurut halaman harga Anthropic, pembacaan cache turun dari $1 menjadi $0,25 per juta token.

Misalnya, sesi agen yang membaca ulang awalan 150.000 token pada setiap giliran akan membayar:

  • Fable 5: $0,15 per giliran
  • Fable 5.1: $0,0375 per giliran

Anthropic memperkirakan penghematan sekitar 25% pada beban kerja biasa dan hingga 45% pada beban kerja agen. Rincian harga Fable 5.1 memuat tiga contoh perhitungan lengkap.

3. Lebih sedikit positif palsu dari pengamanan

Anthropic melaporkan bahwa:

  • Klasifikator biologi memicu 85% lebih jarang pada permintaan biologi dasar dan medis yang tidak berbahaya.
  • Pengamanan siber menghasilkan sekitar 60% lebih sedikit intervensi per sesi Claude Code.
  • Fable 5.1 dapat mengidentifikasi kerentanan dalam kode sumber yang sebelumnya ditolak Fable 5.

Pengembangan eksploitasi tetap ditolak. Kategori penolakan tidak berubah, sehingga penanganan penolakan dan fallback Anda tetap dapat digunakan.

4. Lebih banyak ruang untuk mengatur upaya

Anthropic menyatakan bahwa tingkat medium di Fable 5.1 kira-kira sebanding dengan Fable 5 tetapi dengan biaya lebih rendah. Peningkatan kualitas terbesar dibandingkan Fable 5 terlihat pada xhigh dan max.

Secara praktis, Anda dapat:

  • Memindahkan beban kerja Fable 5 pada high ke Fable 5.1 pada medium untuk mempertahankan kualitas dengan lebih sedikit token keluaran.
  • Tetap menggunakan high untuk mendapatkan kualitas yang lebih baik.
  • Menjalankan ulang evaluasi internal, bukan mengasumsikan setiap tingkat upaya memetakan secara langsung.

5. Batas pengetahuan lebih baru

Fable 5.1 memiliki batas pengetahuan Juni 2026, dibandingkan Januari 2026 pada Fable 5. Selisih lima bulan ini mencakup lebih banyak rilis framework, perubahan API, dan peluncuran model yang dapat dikenali tanpa instruksi tambahan.

6. Tiga fitur harness baru

Fable 5.1 menambahkan:

  1. Perubahan upaya per pesan tanpa mereset cache.
  2. Pesan sistem dengan cakupan giliran untuk pengingat per giliran.
  3. Pembaruan kemajuan yang dapat dibaca di antara panggilan alat.

Fable 5 sudah mendukung fitur terakhir, sedangkan dua fitur pertama baru tersedia di Fable 5.1.

Apa yang menjadi lebih sulit?

tool_choice paksa dihapus

tool_choice: "any" dan tool_choice yang memaksa tool mengembalikan HTTP 400 di Fable 5.1.

Gunakan alternatif berikut:

  • Untuk menjamin JSON, gunakan strict: true di bawah mode auto atau keluaran terstruktur.
  • Untuk memaksa panggilan pada giliran tertentu, tambahkan pesan sistem di tengah percakapan yang menjelaskan kewajiban tersebut.

Perubahannya tidak besar, tetapi setiap lokasi pemanggilan tool secara paksa harus diaudit.

Blok berpikir hanya kompatibel satu arah

Fable 5.1 dapat membaca blok berpikir dari Fable 5. Namun, Fable 5 tidak dapat membaca blok berpikir dari Fable 5.1.

Dalam migrasi bertahap, router mungkin mengirim percakapan kembali ke Fable 5. API akan menghapus blok yang tidak kompatibel tanpa menagihnya, lalu Fable 5 akan merencanakan ulang giliran tersebut. Rujuk panduan preserved thinking sebelum menjalankan kedua model secara bersamaan.

Pemeriksaan pengeditan riwayat

Blok berpikir Fable 5.1 hanya berlaku pada percakapan persis yang menghasilkan blok tersebut. Pada akun yang dibuat pada atau setelah 31 Agustus 2026, permintaan berikutnya dapat gagal jika Anda:

  • Mengedit giliran sebelumnya.
  • Membangun ulang prompt sistem.
  • Menukar larik tool.
  • Menyuntikkan atau menghapus pengingat per giliran.
  • Menyegarkan tanggal dalam prompt sistem.
  • Melakukan kompresi di sisi klien sambil mempertahankan giliran terbaru secara verbatim.

Jalankan pemeriksaan pengeditan riwayat tiga langkah dan perbaiki setiap prefix_binding_mismatch sebelum migrasi. Gunakan panduan migrasi Fable 5.1 untuk daftar periksa lengkap.

Tingkat Prioritas tidak tersedia

Fable 5.1 belum mendukung Tingkat Prioritas, sedangkan Fable 5 mendukungnya. Jika jaminan kapasitas perusahaan merupakan kebutuhan utama, tetap gunakan Fable 5 sampai fitur ini tersedia.

Perilaku loop agen berubah

Beberapa perubahan perilaku dapat memengaruhi orkestrasi agen:

  • Fable 5.1 mungkin menghasilkan satu panggilan tool per giliran ketika Fable 5 mengelompokkan beberapa panggilan.
  • Fable 5.1 menulis lebih sedikit pembaruan kemajuan.
  • Pada tingkat upaya low, Fable 5.1 lebih sering menjawab dari memori daripadaable-5-1?utm_source=dev.to&utm_medium=wanda&utm_content=n8n-post-automation).

Aturan keputusan berdasarkan beban kerja

Tingkatkan sekarang

Pilih Fable 5.1 sekarang jika beban kerja Anda mencakup:

  • Pengkodean agen yang berjalan lama.
  • Penelitian multi-langkah.
  • Pembuatan dokumen dan spreadsheet.

Pada skenario ini, peningkatan benchmark, penghematan pembacaan cache, dan penurunan positif palsu pengamanan paling terasa. Cognition juga menyatakan akan memindahkan lalu lintas Devin ke Fable 5.1 pada hari peluncuran.

Tingkatkan setelah audit harness

Lakukan audit terlebih dahulu jika kode Anda membangun larik messages sendiri dan melakukan lebih dari sekadar menambahkan giliran. Jalankan pemeriksaan pengeditan riwayat, perbaiki semua prefix_binding_mismatch, lalu migrasikan.

Turunkan tingkat upaya ke medium

Jika Fable 5 pada high sudah menyelesaikan pekerjaan rutin dengan baik dan Anda ingin menekan biaya, uji Fable 5.1 pada medium. Bandingkan hasil evaluasi internal; jangan berasumsi bahwa tingkat upaya kedua model sepenuhnya setara.

Tetap gunakan Fable 5

Pertahankan Fable 5 jika:

  • Tingkat Prioritas merupakan bagian penting dari kapasitas Anda.
  • Beban kerja padat keluaran dan hanya memiliki sedikit awalan yang di-cache.
  • Penghematan cache tidak cukup untuk menutup biaya migrasi.

Fable 5 dijamin tersedia hingga setidaknya 9 Juni 2027, sehingga Anda belum memiliki tenggat migrasi yang mendesak. Perhatikan bahwa Bedrock dan Google Cloud dapat menetapkan tanggal pensiun mereka sendiri. Detail umur model tersedia di halaman model Fable 5 Anthropic.

Pertimbangkan Opus 5

Jika Fable 5 sebenarnya sudah lebih mampu daripada kebutuhan Anda, pertimbangkan Opus 5. Panduan Anthropic menyarankan memulai dari Opus 5 dan hanya berpindah ke model yang lebih tinggi jika diperlukan. Lihat perbandingan Fable 5.1 dan Opus 5.

Uji kedua model di Apidog

Cara paling praktis untuk mengambil keputusan adalah membandingkan koleksi permintaan produksi secara berdampingan.

Di Apidog:

  1. Simpan sepuluh prompt produksi tersulit sebagai permintaan.
  2. Jadikan model sebagai variabel lingkungan.
  3. Jalankan koleksi dengan claude-fable-5.
  4. Jalankan kembali dengan claude-fable-5-1 dan tingkat upaya yang sama.
  5. Bandingkan tiga nilai untuk setiap permintaan:
    • Teks keluaran.
    • usage.output_tokens.
    • usage.cache_read_input_tokens.
  6. Tambahkan satu permintaan dengan tool_choice paksa untuk memastikan Anda melihat respons 400 sebelum pengguna menemukannya.

Unduh Apidog untuk menyiapkan pengujian, lalu gunakan panduan API Fable 5.1 sebagai referensi badan permintaan.

Pengujian Claude Fable 5.1 dan Fable 5 di Apidog

FAQ

Apakah Claude Fable 5.1 model baru atau pembaruan untuk Fable 5?

Fable 5.1 adalah model baru dengan ID claude-fable-5-1 dan tanggal pensiun sendiri. Model ini menggunakan tokenizer yang sama, harga per token yang sama, dan data pelatihan hingga Juni 2026.

Apakah Fable 5.1 lebih mahal dari Fable 5?

Tidak. Harga masukan dan keluaran tetap $10 dan $50 per juta token. Penulisan cache dan tarif batch juga sama. Pembacaan cache lebih murah: $0,25 per juta token dibandingkan $1.

Apakah kode Fable 5 akan berfungsi di Fable 5.1?

Sebagian besar akan berfungsi. Pengecualian utama adalah tool_choice paksa yang mengembalikan 400 dan kode yang mengedit riwayat percakapan sehingga blok berpikir tidak lagi cocok, khususnya pada akun yang dibuat pada atau setelah 31 Agustus 2026.

Apakah Fable 5 akan dihentikan?

Belum. Anthropic berkomitmen untuk tidak menghentikan Fable 5 sebelum 9 Juni 2027 pada platform yang dioperasikan Anthropic. Bedrock dan Google Cloud menetapkan jadwal mereka sendiri.

Mana yang lebih baik untuk coding, Fable 5.1 atau Fable 5?

Berdasarkan angka Anthropic, Fable 5.1 unggul: 55,8% berbanding 42,0% pada Terminal-Bench 4.0 dan 73,4% berbanding 70,5% pada CursorBench 3.2.0. Selisihnya besar pada coding agen berbasis terminal, tetapi kecil pada coding bergaya IDE. Keduanya merupakan hasil yang dijalankan vendor.

Apakah Fable 5.1 lebih jarang menolak permintaan?

Anthropic melaporkan 85% lebih sedikit positif palsu pada biologi dan sekitar 60% lebih sedikit intervensi siber per sesi Claude Code. Kategori penolakan tetap sama, jadi pertahankan mekanisme penolakan dan fallback yang sudah ada.

Top comments (0)