Anthropic merilis Claude Opus 5 pada 24 Juli, dengan harga $5 per satu juta token input—setengah dari biaya model pendahulunya, Claude Fable 5—sambil mengungguli Fable 5 pada sebagian besar tolok ukur utama. Opus 5 meraih 43,3% di Frontier-Bench v0,1, evaluasi pengkodean yang berorientasi agen, dibanding 33,7% untuk Fable 5 dan 34,4% untuk OpenAI GPT-5,6 Sol; pada ARC-AGI-3, tolok ukur pemecahan masalah baru, nilainya 30,2% melawan 7,8% GPT-5,6 Sol. Model baru menjadi default di Claude Max dan opsi terkuat di Claude Pro, secara efektif menggantikan Fable 5 sebagai pilihan utama bagi kebanyakan pelanggan setelah gangguan operasional Fable 5 lebih awal musim panas ini.
Jajaran Anthropic terdiri dari empat tier: Haiku cepat dan murah, Sonnet kelas menengah, Opus mesin kerja berat, dan kelas Mythos—diperkenalkan musim semi ini—mencakup Claude Fable 5 untuk publik dan Claude Mythos 5 untuk peneliti keamanan siber serta operator infrastruktur kritis yang divalidasi melalui Project Glasswing.
Claude Opus 5 Mengungguli Fable 5 di Berbagai Tolok Ukur Utama
Pada Frontier-Bench v0,1, yang menguji apakah agen coding AI dapat menyelesaikan tugas rekayasa perangkat lunak dunia nyata end-to-end, Opus 5 mencapai 43,3%. Fable 5 meraih 33,7%, dan GPT-5,6 Sol dari OpenAI mencetak 34,4%.
Margin terlebar muncul di ARC-AGI-3, sebuah pengujian pemecahan masalah yang dibangun di sekitar teka-teki baru yang tidak mungkin dihafal model dari data pelatihan. Opus 5 mencapai 30,2%; GPT-5,6 Sol mencetak 7,8%; Fable 5 sama sekali tidak diuji.
Pada GDPval-AA v2, tolok ukur pekerjaan pengetahuan yang dinilai melalui peringkat Elo untuk mengukur kinerja relatif pada tugas profesional dunia nyata, Opus 5 mencapai 1.861 dibanding 1.747 milik Fable 5 dan 1.736 milik GPT-5,6 Sol.
Fable 5 mengungguli Opus 5 dengan selisih kecil hanya pada evaluasi terkait hukum dan kesehatan, menurut tolok ukur yang dipublikasikan Anthropic.
Anthropic Mematok Harga Opus 5 $5 per Satu Juta Token Input
Opus 5 tersedia melalui API dengan harga $5 per satu juta token input dan $25 per satu juta token output. Mode Fast yang berjalan pada kecepatan sekitar 2,5 kali dari kecepatan default tersedia dengan harga dua kali lipat—$10 per satu juta token input dan $50 per satu juta token output.
Harga tersebut setara dengan Opus 4,8 dan persis setengah dari biaya Fable 5, yang Anthropic posisikan sebagai produk frontier harian untuk pengguna yang membayar.
Fable 5 Dicabut Secara Global Setelah Perintah Kontrol Ekspor
Fable 5 diluncurkan pada 9 Juni, lalu dicabut secara global tiga hari kemudian setelah pemerintah AS mengeluarkan perintah darurat kontrol ekspor yang mengutip kerentanan jailbreak, dan kembali pada 30 Juni. Saat kembali, model tersebut langsung beralih menjadi model berbasis kredit saja, tidak lagi disertakan dalam paket standar.
Opus 5 kini mengisi slot yang tidak bisa dipertahankan Fable 5 sebagai andalan pelanggan.
Platform Pihak Ketiga Memvalidasi Kenaikan Kinerja Opus 5
Lovable, platform pengembang dengan jutaan pengguna, menjalankan Opus 5 dalam evaluasi internalnya. “Ini bukan hanya lebih baik pada tugas coding agenik tersulit kami, naik 22% dibanding Opus 4,7, tapi juga lebih stabil, dengan variasi yang jauh lebih kecil dari satu penayangan ke penayangan berikutnya,” kata Fabian Hedin dalam pernyataan yang dibagikan bersama Anthropic.
Zapier menguji Opus 5 pada AutomationBench, evaluasi yang menilai apakah sebuah model dapat menjalankan workflow bisnis penuh dari awal hingga akhir tanpa bantuan manusia. Model tersebut “mengambil workbook kesehatan akun mentah dan menjalankan rangkaian pencegahan churn lengkap dari ujung ke ujung: menandai akun yang berisiko, memberi peringatan kepada pemilik yang tepat, dan merangkum untuk operasional retensi. Model-model sebelumnya gagal; Opus 5 mencapai 100%.”
Ultima Genomics, perusahaan sekuensing DNA, mengatakan model tersebut “berperilaku lebih seperti ilmuwan yang teliti daripada model mana pun yang pernah kami jalankan. Ia mencoba melakukan uji statistik yang tepat untuk menyingkirkan faktor perancu, memeriksa hasilnya sendiri dengan metode independen, dan tetap berada di jalur saat menjalani analisis multi-langkah yang panjang.”
Rilis tersebut turun satu minggu setelah Moonshot AI, sebuah startup berbasis Beijing yang didukung oleh Alibaba, mengungkap Kimi K3—model open-weight dengan 2,8 triliun parameter yang Moonshot deskripsikan sebagai sistem AI open terbesar di dunia. Tolok ukur independen secara konsisten menempatkan Kimi K3 peringkat ketiga secara keseluruhan, di belakang Fable 5 dan GPT-5,6 Sol, serta mengalahkan dua model tersebut pada area-area tertentu.
FAQ
Tolok ukur apa saja yang diungguli Claude Opus 5 dibanding Fable 5?
Claude Opus 5 meraih 43,3% pada Frontier-Bench v0,1 dibanding 33,7% milik Fable 5, 30,2% pada ARC-AGI-3 (Fable 5 tidak diuji), dan 1.861 pada GDPval-AA v2 dibanding 1.747 milik Fable 5. Fable 5 mengungguli Opus 5 dengan selisih kecil hanya pada evaluasi terkait hukum dan kesehatan.
Berapa biaya Claude Opus 5 dibanding Fable 5?
Claude Opus 5 berharga $5 per satu juta token input dan $25 per satu juta token output melalui API—tepat setengah dari biaya tersirat Fable 5. Mode Fast tersedia dengan harga $10 per satu juta token input dan $50 per satu juta token output.
Mengapa Claude Fable 5 dicabut dari ketersediaan global?
Fable 5 diluncurkan pada 9 Juni dan dicabut secara global tiga hari kemudian setelah pemerintah AS menerbitkan perintah darurat kontrol ekspor yang mengutip kerentanan jailbreak. Ia kembali pada 30 Juni sebagai model berbasis kredit saja, tidak lagi disertakan dalam paket standar.