Claude Fable 5.1 vs Fable 5: Apakah Saatnya Migrasi?
Claude Fable 5.1 menggantikan Fable 5 pada 1 September 2026. Harganya tetap $10 dan $50 per juta token, sementara pembacaan cache turun dari $1 menjadi $0,25 per juta token. Anthropic juga melaporkan hasil yang lebih baik pada setiap tolok ukur yang dipublikasikan. Fable 5 masih tersedia dan dijamin hingga setidaknya 9 Juni 2027. Jadi, pertanyaannya bukan apakah Fable 5.1 lebih baik di atas kertas, melainkan apakah peningkatannya sepadan dengan biaya migrasi—dan apakah tiga perubahan yang merusak akan memengaruhi beban kerja Anda.
Perbandingan ini merangkum apa yang tetap sama, apa yang meningkat, apa yang menjadi lebih sulit, dan model mana yang sebaiknya dipilih berdasarkan beban kerja. Sumber utama adalah postingan peluncuran Anthropic, Apa yang baru di Claude Fable 5.1, dan lembar spesifikasi Claude Fable 5.1.
Perbandingan berdampingan
| Spesifikasi | Claude Fable 5.1 | Claude Fable 5 |
|---|---|---|
| ID model | claude-fable-5-1 |
claude-fable-5 |
| Dirilis | 1 September 2026 | 9 Juni 2026; ditangguhkan 12 Juni, kembali 1 Juli |
| Pensiun | Tidak lebih cepat dari 1 September 2027 | Tidak lebih cepat dari 9 Juni 2027 |
| Konteks / keluaran maksimum | 1M / 128K | 1M / 128K |
| Batas pengetahuan | Juni 2026 | Januari 2026 |
| Harga masukan / keluaran | $10 / $50 | $10 / $50 |
| Pembacaan cache | $0,25 per juta | $1,00 per juta |
| Penulisan cache | $12,50 (5 menit), $20 (1 jam) | Sama |
| Batch | $5 / $25 | Sama |
| Tokenizer | Sama, generasi Opus 4.7 | Sama |
| Berpikir | Adaptif, selalu aktif | Adaptif, selalu aktif |
tool_choice paksa |
Mengembalikan 400 | Diterima |
| Blok berpikir dapat dibaca model lama | Tidak | Ya |
| Pemeriksaan pengeditan riwayat | Ya, untuk akun yang dibuat pada atau setelah 31 Agustus 2026 | Tidak |
| Tingkat Prioritas | Tidak didukung | Didukung |
| Upaya per pesan | Ya, beta | Tidak |
| Pesan sistem dengan cakupan giliran | Ya, beta | Tidak |
thinking.display: "updates" |
Ya, beta | Ya, beta |
| Asal konten | Tanda air teks + C2PA pada media | Tanda air teks |
| Penyimpanan data | Wajib 30 hari, Model Tercakup | Sama |
| Kategori penolakan | Lima kategori yang sama | Lima kategori yang sama |
Apa yang tetap sama?
Lebih banyak komponen tetap kompatibel daripada yang mungkin Anda perkirakan:
- Permukaan API
- Jendela konteks 1M dan keluaran maksimum 128K
- Harga per token
- Tokenizer
- Minimum cache 512 token
- Pemikiran adaptif yang selalu aktif
- Nilai default
omitteduntukthinking.display - Larangan prefill dan parameter sampling
- Pesan sistem di tengah percakapan
- Kategori penolakan dan mekanisme fallback
Anthropic menyatakan bahwa prompt Fable 5 yang sudah ada seharusnya bekerja dengan baik di Fable 5.1 tanpa perubahan. Karena itu, panduan batas laju Fable 5, pengamanan, dan ketersediaan cloud masih relevan. Kedua model juga menggunakan kumpulan batas laju yang sama.
Apa yang meningkat?
1. Tolok ukur agen meningkat paling besar
Semua tolok ukur yang dipublikasikan Anthropic bergerak menguntungkan Fable 5.1, tetapi selisihnya tidak seragam.
| Tolok ukur | Fable 5.1 | Fable 5 | Delta |
|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52,6% | 24,7% | +27,9 |
| AutomationBench | 31,4% | 17,1% | +14,3 |
| Terminal-Bench 4.0 | 55,8% | 42,0% | +13,8 |
| GDPval-AA v2 | 1853 | 1723 | +130 Elo |
| OSWorld 2.0, ketat | 41,7% | 36,1% | +5,6 |
| OSWorld 2.0, parsial | 77,9% | 72,9% | +5,0 |
| Ujian Terakhir Kemanusiaan, tanpa alat | 60,9% | 57,8% | +3,1 |
| CursorBench 3.2.0 | 73,4% | 70,5% | +2,9 |
| Ujian Terakhir Kemanusiaan, dengan alat | 65,0% | 63,8% | +1,2 |
Lompatan terbesar muncul pada agen dengan horizon panjang: penelitian ilmiah melalui terminal, otomatisasi alur kerja bisnis, dan pengkodean agen. Peningkatannya jauh lebih kecil pada pengkodean berbasis pengetahuan dan alur kerja bergaya IDE. Semua hasil ini dijalankan oleh vendor dan belum memiliki reproduksi independen. Lihat rincian tolok ukur Fable 5.1 untuk analisis per baris.
2. Pembacaan cache turun menjadi seperempat harga
Menurut halaman harga Anthropic, pembacaan cache turun dari $1 menjadi $0,25 per juta token.
Misalnya, sesi agen yang membaca ulang awalan 150.000 token pada setiap giliran akan membayar:
- Fable 5: $0,15 per giliran
- Fable 5.1: $0,0375 per giliran
Anthropic memperkirakan penghematan sekitar 25% pada beban kerja biasa dan hingga 45% pada beban kerja agen. Rincian harga Fable 5.1 memuat tiga contoh perhitungan lengkap.
3. Lebih sedikit positif palsu dari pengamanan
Anthropic melaporkan bahwa:
- Klasifikator biologi memicu 85% lebih jarang pada permintaan biologi dasar dan medis yang tidak berbahaya.
- Pengamanan siber menghasilkan sekitar 60% lebih sedikit intervensi per sesi Claude Code.
- Fable 5.1 dapat mengidentifikasi kerentanan dalam kode sumber yang sebelumnya ditolak Fable 5.
Pengembangan eksploitasi tetap ditolak. Kategori penolakan tidak berubah, sehingga penanganan penolakan dan fallback Anda tetap dapat digunakan.
4. Lebih banyak ruang untuk mengatur upaya
Anthropic menyatakan bahwa tingkat medium di Fable 5.1 kira-kira sebanding dengan Fable 5 tetapi dengan biaya lebih rendah. Peningkatan kualitas terbesar dibandingkan Fable 5 terlihat pada xhigh dan max.
Secara praktis, Anda dapat:
- Memindahkan beban kerja Fable 5 pada
highke Fable 5.1 padamediumuntuk mempertahankan kualitas dengan lebih sedikit token keluaran. - Tetap menggunakan
highuntuk mendapatkan kualitas yang lebih baik. - Menjalankan ulang evaluasi internal, bukan mengasumsikan setiap tingkat upaya memetakan secara langsung.
5. Batas pengetahuan lebih baru
Fable 5.1 memiliki batas pengetahuan Juni 2026, dibandingkan Januari 2026 pada Fable 5. Selisih lima bulan ini mencakup lebih banyak rilis framework, perubahan API, dan peluncuran model yang dapat dikenali tanpa instruksi tambahan.
6. Tiga fitur harness baru
Fable 5.1 menambahkan:
- Perubahan upaya per pesan tanpa mereset cache.
- Pesan sistem dengan cakupan giliran untuk pengingat per giliran.
- Pembaruan kemajuan yang dapat dibaca di antara panggilan alat.
Fable 5 sudah mendukung fitur terakhir, sedangkan dua fitur pertama baru tersedia di Fable 5.1.
Apa yang menjadi lebih sulit?
tool_choice paksa dihapus
tool_choice: "any" dan tool_choice yang memaksa tool mengembalikan HTTP 400 di Fable 5.1.
Gunakan alternatif berikut:
- Untuk menjamin JSON, gunakan
strict: truedi bawah modeautoatau keluaran terstruktur. - Untuk memaksa panggilan pada giliran tertentu, tambahkan pesan sistem di tengah percakapan yang menjelaskan kewajiban tersebut.
Perubahannya tidak besar, tetapi setiap lokasi pemanggilan tool secara paksa harus diaudit.
Blok berpikir hanya kompatibel satu arah
Fable 5.1 dapat membaca blok berpikir dari Fable 5. Namun, Fable 5 tidak dapat membaca blok berpikir dari Fable 5.1.
Dalam migrasi bertahap, router mungkin mengirim percakapan kembali ke Fable 5. API akan menghapus blok yang tidak kompatibel tanpa menagihnya, lalu Fable 5 akan merencanakan ulang giliran tersebut. Rujuk panduan preserved thinking sebelum menjalankan kedua model secara bersamaan.
Pemeriksaan pengeditan riwayat
Blok berpikir Fable 5.1 hanya berlaku pada percakapan persis yang menghasilkan blok tersebut. Pada akun yang dibuat pada atau setelah 31 Agustus 2026, permintaan berikutnya dapat gagal jika Anda:
- Mengedit giliran sebelumnya.
- Membangun ulang prompt sistem.
- Menukar larik tool.
- Menyuntikkan atau menghapus pengingat per giliran.
- Menyegarkan tanggal dalam prompt sistem.
- Melakukan kompresi di sisi klien sambil mempertahankan giliran terbaru secara verbatim.
Jalankan pemeriksaan pengeditan riwayat tiga langkah dan perbaiki setiap prefix_binding_mismatch sebelum migrasi. Gunakan panduan migrasi Fable 5.1 untuk daftar periksa lengkap.
Tingkat Prioritas tidak tersedia
Fable 5.1 belum mendukung Tingkat Prioritas, sedangkan Fable 5 mendukungnya. Jika jaminan kapasitas perusahaan merupakan kebutuhan utama, tetap gunakan Fable 5 sampai fitur ini tersedia.
Perilaku loop agen berubah
Beberapa perubahan perilaku dapat memengaruhi orkestrasi agen:
- Fable 5.1 mungkin menghasilkan satu panggilan tool per giliran ketika Fable 5 mengelompokkan beberapa panggilan.
- Fable 5.1 menulis lebih sedikit pembaruan kemajuan.
- Pada tingkat upaya
low, Fable 5.1 lebih sering menjawab dari memori daripadaable-5-1?utm_source=dev.to&utm_medium=wanda&utm_content=n8n-post-automation).
Aturan keputusan berdasarkan beban kerja
Tingkatkan sekarang
Pilih Fable 5.1 sekarang jika beban kerja Anda mencakup:
- Pengkodean agen yang berjalan lama.
- Penelitian multi-langkah.
- Pembuatan dokumen dan spreadsheet.
Pada skenario ini, peningkatan benchmark, penghematan pembacaan cache, dan penurunan positif palsu pengamanan paling terasa. Cognition juga menyatakan akan memindahkan lalu lintas Devin ke Fable 5.1 pada hari peluncuran.
Tingkatkan setelah audit harness
Lakukan audit terlebih dahulu jika kode Anda membangun larik messages sendiri dan melakukan lebih dari sekadar menambahkan giliran. Jalankan pemeriksaan pengeditan riwayat, perbaiki semua prefix_binding_mismatch, lalu migrasikan.
Turunkan tingkat upaya ke medium
Jika Fable 5 pada high sudah menyelesaikan pekerjaan rutin dengan baik dan Anda ingin menekan biaya, uji Fable 5.1 pada medium. Bandingkan hasil evaluasi internal; jangan berasumsi bahwa tingkat upaya kedua model sepenuhnya setara.
Tetap gunakan Fable 5
Pertahankan Fable 5 jika:
- Tingkat Prioritas merupakan bagian penting dari kapasitas Anda.
- Beban kerja padat keluaran dan hanya memiliki sedikit awalan yang di-cache.
- Penghematan cache tidak cukup untuk menutup biaya migrasi.
Fable 5 dijamin tersedia hingga setidaknya 9 Juni 2027, sehingga Anda belum memiliki tenggat migrasi yang mendesak. Perhatikan bahwa Bedrock dan Google Cloud dapat menetapkan tanggal pensiun mereka sendiri. Detail umur model tersedia di halaman model Fable 5 Anthropic.
Pertimbangkan Opus 5
Jika Fable 5 sebenarnya sudah lebih mampu daripada kebutuhan Anda, pertimbangkan Opus 5. Panduan Anthropic menyarankan memulai dari Opus 5 dan hanya berpindah ke model yang lebih tinggi jika diperlukan. Lihat perbandingan Fable 5.1 dan Opus 5.
Uji kedua model di Apidog
Cara paling praktis untuk mengambil keputusan adalah membandingkan koleksi permintaan produksi secara berdampingan.
Di Apidog:
- Simpan sepuluh prompt produksi tersulit sebagai permintaan.
- Jadikan model sebagai variabel lingkungan.
- Jalankan koleksi dengan
claude-fable-5. - Jalankan kembali dengan
claude-fable-5-1dan tingkat upaya yang sama. - Bandingkan tiga nilai untuk setiap permintaan:
- Teks keluaran.
-
usage.output_tokens. -
usage.cache_read_input_tokens.
- Tambahkan satu permintaan dengan
tool_choicepaksa untuk memastikan Anda melihat respons 400 sebelum pengguna menemukannya.
Unduh Apidog untuk menyiapkan pengujian, lalu gunakan panduan API Fable 5.1 sebagai referensi badan permintaan.
FAQ
Apakah Claude Fable 5.1 model baru atau pembaruan untuk Fable 5?
Fable 5.1 adalah model baru dengan ID claude-fable-5-1 dan tanggal pensiun sendiri. Model ini menggunakan tokenizer yang sama, harga per token yang sama, dan data pelatihan hingga Juni 2026.
Apakah Fable 5.1 lebih mahal dari Fable 5?
Tidak. Harga masukan dan keluaran tetap $10 dan $50 per juta token. Penulisan cache dan tarif batch juga sama. Pembacaan cache lebih murah: $0,25 per juta token dibandingkan $1.
Apakah kode Fable 5 akan berfungsi di Fable 5.1?
Sebagian besar akan berfungsi. Pengecualian utama adalah tool_choice paksa yang mengembalikan 400 dan kode yang mengedit riwayat percakapan sehingga blok berpikir tidak lagi cocok, khususnya pada akun yang dibuat pada atau setelah 31 Agustus 2026.
Apakah Fable 5 akan dihentikan?
Belum. Anthropic berkomitmen untuk tidak menghentikan Fable 5 sebelum 9 Juni 2027 pada platform yang dioperasikan Anthropic. Bedrock dan Google Cloud menetapkan jadwal mereka sendiri.
Mana yang lebih baik untuk coding, Fable 5.1 atau Fable 5?
Berdasarkan angka Anthropic, Fable 5.1 unggul: 55,8% berbanding 42,0% pada Terminal-Bench 4.0 dan 73,4% berbanding 70,5% pada CursorBench 3.2.0. Selisihnya besar pada coding agen berbasis terminal, tetapi kecil pada coding bergaya IDE. Keduanya merupakan hasil yang dijalankan vendor.
Apakah Fable 5.1 lebih jarang menolak permintaan?
Anthropic melaporkan 85% lebih sedikit positif palsu pada biologi dan sekitar 60% lebih sedikit intervensi siber per sesi Claude Code. Kategori penolakan tetap sama, jadi pertahankan mekanisme penolakan dan fallback yang sudah ada.


Top comments (0)