Anthropic meluncurkan Claude Opus 5 pada 24 Juli 2026. Jawaban jujur untuk pertanyaan “bisakah saya menggunakannya secara gratis?” memiliki dua bagian: melalui aplikasi Claude, Opus 5 tersedia dalam langganan berbayar—default untuk Max dan model berperforma tertinggi untuk Pro. Melalui API, tidak ada akses gratis tanpa batas ke claude-opus-5.
Kabar baiknya, biaya API masih bisa dioptimalkan. Opus 5 berharga $5 per juta token input dan $25 per juta token output, setara Opus 4.8 dan setengah harga Fable 5 ($10 / $50). Artikel ini membahas jalur gratis yang sah, konfigurasi API termurah, dan cara mengukur biaya riil menggunakan Apidog.
Untuk spesifikasi lengkap, lihat apa itu Claude Opus 5, posting peluncuran Opus 5, dan ikhtisar model Claude.
Gratis di aplikasi Claude berarti akses termasuk dalam langganan Anda, dengan batas penggunaan. Gratis melalui API hanya berarti kredit uji coba atau promosi yang akan habis.
Jalur gratis 1: Langganan Claude
Materi peluncuran Anthropic menyebutkan dua tingkat konsumen untuk Opus 5:
- Max — Opus 5 menjadi model default.
- Pro — Opus 5 adalah model dengan kinerja tertinggi yang tersedia dalam paket.
Materi tersebut tidak menyebutkan paket Claude gratis sebagai permukaan Opus 5. Jangan mengasumsikan akses tersedia di paket gratis; periksa pemilih model di akun Anda terlebih dahulu.
Opus 5 juga tersedia di Claude Code, Claude Cowork, dan GitHub Copilot. Jika Anda sudah berlangganan salah satunya, akses Opus 5 mungkin sudah tercakup. Namun, perhatikan konsumsi jatah:
- Thinking aktif secara default.
- Respons cenderung lebih panjang daripada Opus 4.8.
- Model lebih sering mendelegasikan tugas ke subagen.
Lihat cara menggunakan Claude Opus 5 di Claude Code untuk mengontrol penggunaannya, atau cara menggunakan Claude Opus 4.8 secara gratis untuk rute generasi sebelumnya.
Jalur gratis 2: Uji coba API dan kredit cloud
ID model Claude API adalah:
claude-opus-5
API menggunakan model bayar sesuai penggunaan, tetapi Anda dapat mulai tanpa biaya di muka melalui dua jalur berikut:
Kredit akun Anthropic API baru
Akun baru biasanya memiliki kredit awal dalam jumlah kecil. Gunakan untuk memastikan integrasi bekerja dan mengukur token sebelum menambahkan metode pembayaran.Kredit promosi cloud
Opus 5 tersedia melalui Amazon Bedrock sebagaianthropic.claude-opus-5, Claude Platform di AWS, Google Cloud, dan Microsoft Foundry. Akun baru pada platform tersebut sering memiliki kredit promosi.
Gunakan kredit untuk pengujian, bukan lalu lintas produksi. Jalankan prompt nyata Anda dan catat blok usage pada setiap respons. Dengan begitu, Anda dapat menghitung biaya per tugas sebelum mengirim workload ke produksi.
Tarif terkini tersedia di dokumentasi harga Anthropic.
Perhatian: thinking sekarang aktif secara default
Pada Opus 4.8, permintaan tanpa bidang thinking berjalan tanpa thinking. Pada Opus 5, permintaan yang sama menggunakan adaptive thinking.
Token thinking ditagih sebagai token output, yaitu $25 per juta token. Artinya, suite pengujian yang dipindahkan dari Opus 4.8 tanpa perubahan dapat menghabiskan kredit lebih cepat.
Lihat detail migrasi di panduan migrasi dari Opus 4.8 ke Opus 5.
Tidak ada API gratis tanpa batas
Tidak ada tier gratis Claude API yang memberi panggilan claude-opus-5 tanpa batas.
Hindari proxy, kumpulan API key, atau reseller yang menjanjikan akses frontier model gratis. Selain berpotensi melanggar ketentuan Anthropic, skema tersebut dapat mengarahkan prompt Anda melalui infrastruktur yang tidak Anda kontrol.
Setelah kredit uji coba atau promosi habis, pilihannya sederhana:
- bayar per token, atau
- hentikan pemakaian.
Bagian berikutnya berfokus pada cara membayar sesedikit mungkin secara sah.
Jalur berbayar termurah
Tarif dasar Opus 5:
- Input: $5 per juta token
- Output: $25 per juta token
Berikut tuas optimasi yang paling berdampak.
1. Gunakan Batch API untuk diskon 50%
Semua pekerjaan yang tidak membutuhkan respons dalam hitungan detik sebaiknya masuk Batch API.
| Tarif | Input / MTok | Output / MTok |
|---|---|---|
| API standar | $5.00 | $25.00 |
| Batch API | $2.50 | $12.50 |
Batch API berjalan asinkron dan menggunakan model yang sama, sehingga tidak ada perbedaan kualitas. Cocok untuk:
- evaluasi malam hari;
- pemrosesan dokumen massal;
- klasifikasi ulang;
- regression suite;
- content pipeline.
Batch API juga mendukung hingga 300.000 token output per permintaan dengan header beta berikut:
output-300k-2026-03-24
Messages API standar mendukung hingga 128.000 token output.
Kekurangannya adalah latensi. Selain itu, mode cepat tidak dapat digunakan bersama Batch API.
2. Turunkan effort untuk mengurangi biaya thinking
Opus 5 menyediakan output_config.effort. Nilai default-nya adalah high.
{
"output_config": {
"effort": "low"
}
}
effort yang lebih rendah menghasilkan token thinking lebih sedikit. Karena token thinking ditagih sebagai output, parameter ini hampir langsung memengaruhi biaya.
Anthropic menyatakan bahwa low dan medium pada Opus 5 lebih kuat dibandingkan level yang sama pada model Opus sebelumnya. Jangan hanya menyalin konfigurasi dari Opus 4.8—uji ulang pada dataset dan metrik Anda sendiri.
Perhatikan dua hal:
efforttidak memendekkan jawaban yang terlihat.
Parameter ini mengurangi thinking, bukan panjang respons akhir. Jika Anda ingin respons singkat, instruksikan batas panjang secara eksplisit di prompt.Jangan menonaktifkan thinking hanya untuk menghemat biaya.
Menggabungkanthinking: {"type": "disabled"}denganeffortxhighataumaxmenghasilkan error 400.
Panduan Anthropic menyarankan agar thinking tetap aktif dan biaya dikendalikan lewat effort yang lebih rendah. Dengan thinking dinonaktifkan, Opus 5 terkadang dapat menulis panggilan tool sebagai teks biasa atau membocorkan tag XML internal.
Lihat penjelasan seluruh level di parameter effort Claude Opus 5.
3. Aktifkan prompt caching untuk prefiks berulang
Cache hit hanya berharga $0,50 per juta token input, yaitu sepersepuluh harga input standar.
| Operasi cache | Tarif / MTok |
|---|---|
| Cache hit | $0.50 |
| Cache write 5 menit | $6.25 |
| Cache write 1 jam | $10.00 |
Pada Opus 5, prefiks minimum yang dapat di-cache turun menjadi 512 token, dari 1.024 token pada Opus 4.8.
Ini penting untuk aplikasi yang berulang kali mengirim:
- system prompt panjang;
- dokumentasi internal;
- OpenAPI specification;
- basis pengetahuan;
- instruksi agen yang stabil.
Contoh biaya dengan prefiks stabil 40.000 token dan input baru 10.000 token:
| Skenario | Perhitungan | Biaya input |
|---|---|---|
| Tanpa cache | 50.000 × $5 / MTok | $0.25 |
| Cache write | 40.000 × $6.25 / MTok | $0.25 |
| Cache hit berikutnya | 40.000 × $0.50 + 10.000 × $5 / MTok | $0.07 |
Pada contoh ini, cache write hanya menambah sekitar lima sen dibanding input normal untuk prefiks tersebut, lalu setiap panggilan berikutnya jauh lebih murah.
Konfirmasikan cache bekerja dengan memeriksa nilai berikut pada respons:
{
"usage": {
"cache_read_input_tokens": 40000
}
}
Jika cache_read_input_tokens tetap 0, breakpoint cache Anda kemungkinan berada di posisi yang salah.
4. Hindari mode cepat jika biaya adalah prioritas
Mode cepat berharga dua kali tarif normal:
| Mode | Input / MTok | Output / MTok |
|---|---|---|
| Standar | $5.00 | $25.00 |
| Cepat | $10.00 | $50.00 |
Sebagai gantinya, output sekitar 2,5x lebih cepat.
Mode cepat adalah pratinjau penelitian, hanya tersedia pada API pihak pertama, tidak tersedia melalui Bedrock, Google Cloud, atau Microsoft Foundry, dan tidak kompatibel dengan Batch API.
Gunakan hanya untuk pengalaman interaktif yang benar-benar membutuhkan token muncul lebih cepat di layar pengguna.
5. Jangan atur inference_geo tanpa kebutuhan residensi data
Konfigurasi berikut menambahkan pengali 1,1x pada semua kategori token:
{
"inference_geo": "us"
}
Artinya, seluruh tagihan naik 10%.
Gunakan hanya jika Anda memiliki persyaratan residensi data. Jika tidak, biarkan parameter ini tidak diatur.
Ada sedikit penghematan bawaan pada penggunaan tool: overhead system prompt Opus 5 adalah 286 token ketika tool_choice bernilai auto atau none, turun dari 290 pada Opus 4.8 dan jauh di bawah 675 pada Opus 4.7.
Untuk strategi penghematan lintas model, lihat cara memotong tagihan Claude API.
Perbandingan biaya sekilas
| Konfigurasi | Input / MTok | Output / MTok | Terbaik untuk |
|---|---|---|---|
Standar, effort high
|
$5.00 | $25.00 | Default interaktif |
| Batch API | $2.50 | $12.50 | Semua pekerjaan asinkron |
| Cache hit pada prefiks stabil | $0.50 | t/a | Panggilan konteks panjang berulang |
| Mode cepat | $10.00 | $50.00 | Kebutuhan latensi tinggi |
inference_geo: "us" |
1.1x semua kategori | 1.1x semua kategori | Residensi data |
Diskon Batch API berlaku untuk tarif token standar. Verifikasi pada tagihan Anda sendiri bagaimana diskon tersebut berinteraksi dengan token yang di-cache sebelum membuat asumsi penghematan gabungan.
Contoh lebih lengkap tersedia di harga Claude Opus 5.
Menguji konfigurasi murah di Apidog
Setiap optimasi di atas dapat diverifikasi dari respons HTTP. Mulai dengan permintaan dasar berikut:
curl https://api.anthropic.com/v1/messages \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-opus-5",
"max_tokens": 4096,
"output_config": {"effort": "low"},
"messages": [
{
"role": "user",
"content": "Summarize this OpenAPI spec in three sentences."
}
]
}'
Di Apidog, simpan permintaan sebagai POST request dan letakkan API key dalam environment variable, bukan di body request atau file yang dapat ter-commit.
Lakukan pengujian berikut:
Bandingkan
effortsecara berdampingan
Duplikat request dan ujilow,medium, sertahigh. Bandingkanusage.output_tokensuntuk melihat dampak biaya aktual.Konfirmasi cache hit
Kirim prefiks panjang yang sama dua kali. Pada panggilan kedua, pastikancache_read_input_tokenslebih besar dari nol.Deteksi pemotongan
max_tokens
Thinking dan respons akhir berbagi anggaranmax_tokens. Jika Anda menerima:
{
"stop_reason": "max_tokens"
}
Anda mungkin membayar output yang tidak pernah selesai atau tidak digunakan. Tambahkan assertion untuk mendeteksi kondisi ini.
- Periksa streaming dan tool call Baca respons SSE dan payload panggilan tool secara penuh. Ini penting saat agentic loop memakai token lebih banyak dari perkiraan.
Unduh Apidog untuk mencoba workflow tersebut, lalu lihat cara menggunakan Claude Opus 5 API untuk panduan integrasi lengkap.
Apakah Opus 5 memang model yang perlu dioptimalkan?
Kadang-kadang pilihan termurah adalah menggunakan model lain.
Sonnet 5 memiliki tarif perkenalan $2 / $10 per juta token, meningkat menjadi $3 / $15 pada 1 September 2026, dan berbagi jendela konteks 1 juta token yang sama. Jika workload Anda bukan pengodean agen atau penalaran multi-langkah yang kompleks, uji Sonnet 5 sebelum mengoptimalkan tagihan Opus 5.
Baca Claude Opus 5 vs Sonnet 5 untuk memahami kapan premium Opus layak dibayar, atau cara menggunakan Claude Sonnet 5 secara gratis untuk rute gratis Sonnet.
Anthropic mengklaim bahwa Opus 5:
- mencetak lebih dari dua kali skor Frontier-Bench dibanding Opus 4.8;
- berada dalam 0,5% dari Fable 5 pada CursorBench 3.2 dengan setengah harga;
- mengungguli Fable 5 pada OSWorld 2.0 dengan sepertiga biaya.
Angka tersebut adalah benchmark yang diterbitkan vendor dan belum direproduksi secara independen pada 25 Juli 2026. Perlakukan sebagai klaim yang perlu diuji pada workload Anda sendiri.
Opus 5 juga bukan model paling mampu di seluruh jajaran Claude. Fable 5 tetap menjadi model Anthropic paling mampu yang dirilis luas, sementara Opus 5 masih tertinggal dari Mythos 5 untuk eksploitasi keamanan siber dan riset biologi otonom.
Jika workload Anda mendekati batas tersebut, lihat apa itu Claude Fable 5.
Jalur mana yang cocok untuk Anda?
| Tujuan | Jalur | Kelemahan |
|---|---|---|
| Chat, menulis, penelitian | Claude Pro atau Max | Batas terukur; Opus 5 dapat menghabiskan jatah lebih cepat dari 4.8 |
| Pengodean agen | Claude Code pada paket berbayar | Respons panjang dan delegasi subagen mengonsumsi jatah |
| Prototipe integrasi | Uji coba API atau kredit promosi cloud | Saldo habis, lalu bayar per token |
| API produksi termurah | Batch API + caching + effort low
|
Batch menambah latensi; cache memerlukan prefiks stabil |
| API interaktif termurah | Tarif standar + caching + effort sesuai tugas |
Diskon Batch API tidak tersedia |
FAQ
Apakah Claude Opus 5 gratis?
Tidak melalui API. Di aplikasi Claude, Opus 5 termasuk dalam langganan berbayar: default untuk Max dan model berperforma tertinggi untuk Pro. Materi peluncuran tidak menyebut paket gratis sebagai jalur akses Opus 5.
Bisakah saya mendapatkan API Claude Opus 5 secara gratis?
Hanya melalui kredit akun baru atau kredit promosi Amazon Bedrock, Google Cloud, dan Microsoft Foundry. Semua opsi tersebut memiliki saldo terbatas. Tidak ada tier API gratis tanpa batas.
Apa cara sah termurah untuk menjalankan Opus 5 dalam volume besar?
Gunakan Batch API ($2,50 / $12,50), aktifkan prompt caching untuk prefiks stabil di atas 512 token, dan uji effort low atau medium. Hindari mode cepat dan jangan atur inference_geo tanpa kebutuhan residensi data.
Haruskah saya menonaktifkan thinking untuk menghemat token?
Tidak. Menonaktifkan thinking bersama effort xhigh atau max menghasilkan error 400. Rekomendasi Anthropic adalah membiarkan thinking aktif dan menurunkan effort.
Pantau blok usage pada respons untuk mengukur biaya nyata. Menyimpan request di Apidog dan menambahkan assertion pada metrik penggunaan membantu Anda menemukan regresi biaya secara otomatis.
Top comments (0)