Semua model

Claude Opus 5

Model Opus andalan Anthropic, dirilis 24 Juli 2026 — kecerdasan mendekati frontier dengan setengah harga Claude Fable 5, thinking aktif secara default, dan skala effort lengkap dari low sampai max.

1M tokens · Text / Vision / Code · Prompt cache

Claude Opus 5 adalah model Opus andalan Anthropic saat ini, dirilis 24 Juli 2026 sebagai penerus Opus 4.8. Model ini mendekati kecerdasan frontier Claude Fable 5 dengan setengah harga, dan pada beberapa evaluasi coding serta pekerjaan pengetahuan — termasuk Frontier-Bench v0.1 dan GDPval-AA v2 — bahkan mengungguli Fable 5. Harganya tidak berubah dari Opus 4.8: $5 input dan $25 output per 1 juta token, sehingga agen yang sudah berjalan di tingkat Opus bisa langsung dipindahkan.

Ada beberapa perubahan perilaku yang perlu diketahui sebelum beralih. Thinking aktif secara default, sedangkan Opus 4.8 tidak berpikir kecuali diminta; effort mencakup seluruh rentang low sampai max; dan rantai pemikiran mentah tidak pernah dikembalikan. Di VM0 pengali kreditnya ×2, sama seperti Opus 4.8, dan model ini termasuk dalam daftar model bawaan untuk organisasi baru.

Apa itu Claude Opus 5?

Dirilis 24 Juli 2026 · Tingkat andalan Opus dari Anthropic — di bawah Fable 5 pada batas atas absolut, di atasnya pada beberapa evaluasi agentik dan pekerjaan pengetahuan, dengan harga token separuhnya. Pilihan default di VM0 untuk kerja agen yang berat.

Anthropic merilis Claude Opus 5 pada 24 Juli 2026 di Claude API, aplikasi Claude, Amazon Bedrock, Google Cloud, dan Microsoft Foundry; VM0 menambahkannya sebagai model bawaan pada 25 Juli 2026. Model ini menggantikan Opus 4.8 dengan harga identik dan hampir melipatgandakan skor Frontier-Bench v0.1-nya — itulah klaim utamanya: kemampuan jauh lebih tinggi dengan biaya per token yang sama.

Posisinya adalah kuda beban untuk coding agentik dan pekerjaan pengetahuan perusahaan — fitur lintas berkas, refactor besar, eksekusi otonom panjang, dan deliverable dari awal sampai akhir — bukan sebagai batas atas kemampuan absolut. Fable 5 masih memimpin pada set SWE-bench Pro yang lebih sulit dan pada keluasan faktual; Opus 5 unggul pada biaya per tugas yang selesai, angka yang muncul di tagihan begitu trafik agen bertambah.

Dua perilaku API berubah dibandingkan Opus 4.8. Thinking aktif secara default, sehingga permintaan tanpa konfigurasi kini bernalar sebelum menjawab, dan mematikannya hanya diizinkan pada effort high atau di bawahnya. Prompt minimum yang bisa di-cache juga turun menjadi 512 token, sehingga prompt sistem pendek yang sebelumnya tidak bisa di-cache kini bisa. Opus 5 juga hadir dengan pengaman keamanan siber yang diperketat: permintaan pada area terlarang atau berisiko tinggi bisa kembali sebagai penolakan.

Apa yang menonjol dari Claude Opus 5

Fitur arsitektur dan kapabilitas utama.

Opus 5 memiliki jendela konteks 1 juta token — nilai maksimum sekaligus default — dan output hingga 128K token, dengan batas pengetahuan Mei 2026. Thinking aktif secara default dan kedalaman penalaran diatur lewat tingkat effort low, medium, high, xhigh, dan max; rantai pemikiran mentah tidak pernah ditampilkan, hanya ringkasan yang mudah dibaca. Prefill pesan asisten tidak didukung, dan parameter sampling (temperature, top_p, top_k) ditolak — arahkan perilaku lewat prompt. Input mencakup teks, visi resolusi tinggi, dan kode.

Spesifikasi sekilas

KeluargaGenerasi Claude 5
ModalitasTeks, visi, kode
Jendela konteks1 juta token (default sekaligus maksimum)
Output maksimumHingga 128K token
Batas pengetahuanMei 2026
ThinkingAktif secara default; effort low / medium / high / xhigh / max
Prompt cachingDidukung (minimum 512 token)
Harga daftar vendor$5 input / $25 output per 1 juta

Benchmark Claude Opus 5

Skor yang dilaporkan vendor dari materi peluncuran Anthropic. Pelacak pihak ketiga melaporkan angka berbeda untuk benchmark yang sama tergantung dataset, pengaturan effort, dan scaffold agen, jadi perlakukan angka utama sebagai bergantung pada konfigurasi.

Frontier-Bench v0.1terdepan saat peluncuran; di atas Fable 5 (33,7%) dan GPT 5.6 Sol (34,4%)
43,3%
SWE-bench Verifiedsedikit melampaui 95,0% milik Fable 5; set ini mendekati titik jenuh di level frontier
96,0%
SWE-bench Proset coding yang lebih sulit — Fable 5 masih memimpin dengan 80,3%
79,2%
GDPval-AA v2papan peringkat pekerjaan pengetahuan; di atas 1.747 milik Fable 5
1.861 Elo
Humanity's Last Exam (tanpa alat)penalaran tingkat ahli; sedikit di bawah 56,5% milik Fable 5
56,3%

Harga Claude Opus 5

Harga daftar vendor, per 1J token.

Input$5.00
Output$25.00
Cache read$0.50
Cache write$6.25

Bagaimana Claude Opus 5 berperilaku dalam praktik

Perilaku yang diamati dari eksekusi agen produksi.

Biaya per tugas yang selesai

Alasan paling jelas memilih Opus 5 ketimbang Fable 5: hasil yang sebanding pada kerja agentik dengan harga token sekitar separuhnya. Di AutomationBench milik Zapier, tingkat keberhasilannya sekitar 1,5 kali model terbaik berikutnya pada biaya per tugas yang sama, dan bahkan pada effort terendah ia menyelesaikan lebih banyak tugas daripada model mana pun.

Thinking aktif secara default

Berbeda dari Opus 4.8, permintaan yang tidak menyertakan parameter thinking tetap bernalar sebelum menjawab. Perhitungkan itu: max_tokens membatasi thinking dan jawaban sekaligus, sehingga batas yang disetel untuk beban tanpa thinking bisa memotong output. Mematikan thinking hanya diizinkan pada effort high atau di bawahnya.

Effort adalah pengungkit biaya utama

low dan medium luar biasa kuat pada model ini dan sering menyamai hasil model andalan sebelumnya pada pengaturan tertinggi. Mulailah dari highxhigh untuk eksekusi coding dan agentik tersulit — lalu turunkan bertahap dan pertahankan tingkat termurah yang masih diterima evaluasi Anda.

Memverifikasi pekerjaannya sendiri

Opus 5 memeriksa outputnya tanpa diminta, sehingga instruksi verifikasi warisan dari model lama cenderung menghasilkan pengulangan yang mubazir. Model ini juga menulis jawaban lebih panjang secara default; instruksi singkat agar ringkas lebih efektif daripada menurunkan effort.

Tugas agen terbaik untuk Claude Opus 5

Fitur lintas berkas yang tuntas dalam sekali jalan

Berikan spesifikasi lengkap di awal lalu biarkan berjalan. Keunggulan Opus 5 atas Opus 4.8 paling besar pada pekerjaan rekayasa yang sulit dan bertahap — refactor besar, fitur dari awal sampai akhir — dan paling kecil pada suntingan sekali giliran, jadi arahkan ke ujung atas rentang kesulitan Anda.

Agen semalaman yang sanggup Anda biarkan berjalan

Pada eksekusi otonom yang panjang, selisih harga menumpuk. Dengan kualitas mendekati Fable dan biaya token separuhnya, agen triase, migrasi, atau riset malam hari menghabiskan sekitar setengah biaya per tugas yang selesai.

Alur kerja yang harus tuntas, bukan sekadar menjawab

Tugas bertahap dengan alat dan kondisi akhir yang nyata — membuat tiket, memperbarui spreadsheet, merekonsiliasi catatan. Hasil AutomationBench dan OSWorld dari Anthropic menunjuk hal yang sama: model ini menuntaskan tugas dari awal sampai akhir yang ditinggalkan model lain di tengah jalan.

Kapan melewatkan Claude Opus 5

Lewati Opus 5 untuk pekerjaan bervolume tinggi, sensitif latensi, atau sederhana — Sonnet 5 menangani loop agen rutin dengan pengali separuhnya, dan GPT 5.6 Luna lebih murah lagi. Pilih Fable 5 ketika sebuah tugas berada di batas atas rentang kesulitan Anda atau bergantung pada coding sulit ala SWE-bench Pro dan ingatan faktual yang luas. Riset keamanan dan domain berisiko tinggi lainnya dapat memicu pengaman Opus 5 dan menghasilkan penolakan.

Claude Opus 5 vs model lain

Claude Opus 5 vs Claude Fable 5

Fable 5 punya batas atas lebih tinggi; Opus 5 lebih menguntungkan. Opus 5 unggul di Frontier-Bench (43,3% vs 33,7%), GDPval-AA v2, dan SWE-bench Verified, sementara Fable 5 tetap memimpin di SWE-bench Pro dan keluasan faktual. Opus 5 berharga separuhnya ($5/$25 vs $10/$50) dengan pengali VM0 ×2 dibanding ×4 milik Fable 5 — kirim langkah tersulit ke Fable 5 dan sisanya ke sini.

Claude Opus 5 vs Claude Opus 4.8

Harga sama, tingkat sama, kemampuan jelas lebih tinggi: Opus 5 hampir melipatgandakan skor Frontier-Bench Opus 4.8 dan menambah tujuh poin di SWE-bench Verified. Migrasinya berupa penggantian ID model plus penyetelan ulang prompt — thinking kini aktif secara default, jadi periksa lagi max_tokens, dan hapus instruksi semacam “verifikasi pekerjaanmu”, yang sekarang hanya memicu pengulangan mubazir.

Claude Opus 5 vs Claude Sonnet 5

Sonnet 5 (×1) adalah default hemat biaya untuk loop agen rutin; Opus 5 (×2) adalah tempat Anda menaikkan tugas ketika tugas itu tidak lagi selesai dengan andal. Pola yang umum: Opus 5 mengorkestrasi dan Sonnet 5 mengerjakan bagian paralelnya.

Claude Opus 5 vs GPT 5.6 Sol

Keduanya model agentik papan atas. Opus 5 unggul atas Sol di Frontier-Bench (43,3% vs 34,4%); Sol unggul di DeepSWE v1.1 (72,7% vs 68,8%). Di VM0 ini keputusan routing, bukan pengadaan — jalankan agen yang sama pada keduanya lalu bandingkan.

Kesimpulan: haruskah Anda menggunakan Claude Opus 5?

Model andalan default di VM0. Opus 5 cukup dekat dengan batas atas Fable 5 sehingga harga menjadi penentu pada sebagian besar kerja agentik, dan ia menggantikan apa pun yang sudah berjalan di Opus 4.8 tanpa hambatan. Simpan Sonnet 5 untuk loop rutin dan sisakan Fable 5 untuk sedikit tugas yang benar-benar butuh puncak rentang.

Pertanyaan yang sering diajukan

Kapan Claude Opus 5 dirilis?

Anthropic merilis Opus 5 pada 24 Juli 2026 di Claude API dan aplikasi Claude, serta di Amazon Bedrock, Google Cloud, dan Microsoft Foundry. VM0 menambahkannya sebagai model bawaan pada 25 Juli 2026 (ID model claude-opus-5).

Berapa biaya Claude Opus 5?

$5 per 1 juta token input dan $25 per 1 juta token output — tidak berubah dari Opus 4.8 dan tepat separuh dari $10/$50 milik Claude Fable 5. Pembacaan cache $0,50 per 1 juta. Di VM0 pengali kreditnya ×2.

Apakah Claude Opus 5 lebih baik daripada Claude Fable 5?

Pada beberapa evaluasi, ya: Opus 5 unggul atas Fable 5 di Frontier-Bench v0.1, GDPval-AA v2, dan SWE-bench Verified. Fable 5 masih memimpin pada set SWE-bench Pro yang lebih sulit dan pada keluasan faktual, serta tetap menjadi batas atas untuk penalaran tersulit. Untuk sebagian besar kerja agentik, Opus 5 menang pada biaya per tugas yang selesai.

Apakah thinking aktif secara default di Claude Opus 5?

Ya. Permintaan yang tidak menyertakan parameter thinking tetap bernalar sebelum menjawab — berbeda dari Opus 4.8, yang tidak berpikir kecuali diminta. Kedalamannya diatur lewat effort (low sampai max), dan thinking hanya bisa dimatikan pada effort high atau di bawahnya. Rantai pemikiran mentah tidak pernah dikembalikan, hanya ringkasan yang mudah dibaca.

Apa yang berubah saat migrasi dari Opus 4.8?

ID model, lalu penyetelan prompt. Karena thinking aktif secara default, max_tokens kini mencakup penalaran sekaligus jawaban; instruksi verifikasi sebaiknya dihapus alih-alih ditulis ulang, karena Opus 5 memverifikasi dirinya sendiri; dan jawaban lebih panjang secara default, jadi tambahkan instruksi ringkas yang eksplisit bila panjang jawaban penting.

Alternatif

Menggunakan Claude Opus 5 di VM0

Dua cara mengakses Claude Opus 5 di VM0

VM0 mendukung Claude Opus 5 sebagai model Built-in yang ditagih dalam kredit VM0, dan melalui bring-your-own dengan Anthropic API key. Jalur Built-in menggunakan routing VM0 Managed dan pengali kredit yang dijelaskan di bawah; jalur bring-your-own menagih Anda langsung ke vendor hulu dan sepenuhnya melewati konversi kredit VM0.

Rekomendasi VM0

VM0 memposisikan Claude Opus 5 sebagai model agen inti, direkomendasikan bersama Claude Opus 4.7, Claude Opus 4.6, dan Claude Sonnet 4.6 untuk langkah-langkah yang menggerakkan hasil aktual dari sebuah eksekusi agen. Inilah model yang akan kami pilih untuk peran orkestrator, untuk agen yang menyentuh kode, dan untuk langkah apa pun di mana jawaban yang salah berbiaya mahal.

Kredit dan pengali ×2

Setiap model Built-in di VM0 dihargai sebagai kelipatan dari Claude Sonnet 4.6, yang berada di baseline kredit ×1. Claude Opus 5 ditagih pada ×2 kredit. Pengali inilah yang muncul di invoice VM0 Anda; harga daftar vendor di tabel harga di atas adalah yang dikenakan penyedia hulu sebelum VM0 mengonversinya menjadi kredit.

Claude Opus 5 ditagih pada ×2, yang berarti satu langkah di sini berbiaya 2× kredit dari langkah setara pada Sonnet 4.6 (baseline ×1). Ini tier premium di VM0, jadi pola yang hemat biaya adalah menggunakan model yang lebih murah sebagai default dan mengarahkan ke Claude Opus 5 hanya langkah yang benar-benar membutuhkan kedalaman reasoning ekstra.

Tersedia di VM0 sejak July 25, 2026.