← semua berita

Claude Opus 5 tetap seharga lama tapi skornya nyaris dua kali lipat

AI · · · sumber (anthropic.com)

Anthropic merilis Claude Opus 5 dengan harga persis sama seperti model yang digantikannya: $5 per juta input token dan $25 per juta output token. Yang menarik bukan harganya, melainkan apa yang Anda dapat dengan uang itu. Di Frontier-Bench v0.1, model baru ini lebih dari dua kali lipat skor Opus 4.8. Di CursorBench 3.2, jaraknya cuma 0,5 persen dari Fable 5 tapi biayanya separuh. Pada OSWorld 2.0, uji yang mengukur agent mengoperasikan komputer sungguhan, Opus 5 mengungguli Fable 5 dengan ongkos sekitar sepertiganya.

Fokus utamanya adalah kerja agentic yang bisa memeriksa diri sendiri. Menurut Anthropic, Opus 5 lebih andal memverifikasi output-nya dan mengoreksi langkah, bukan berhenti di jawaban pertama yang kelihatan masuk akal. Di titik itulah agent run yang panjang biasanya berantakan. Salah satu contoh dalam pengumuman menyebut model menulis sendiri computer vision pipeline ketika ia tak bisa membaca persyaratan tugas secara langsung, alih-alih menyerah. Peningkatannya juga menembus kerja ilmiah, dengan catatan khusus di bidang kimia dan analisis protein, plus pembuatan gambar dan diagram yang lebih baik. Mode Fast berjalan sekitar 2,5 kali lebih cepat dengan tarif dua kali lipat, jadi Anda bisa menukar biaya dengan waktu saat sebuah tugas menunggu jawaban model.

Kenapa ini penting

Kalau Anda menjalankan coding agent atau loop otomatisasi panjang, poin pentingnya adalah biaya per tugas yang selesai turun sementara harga per token tetap. Sebelum berkomitmen ke model frontier yang lebih mahal, ada baiknya menguji ulang Opus 5 pada beban kerja Anda sendiri, karena harga separuh dengan performa nyaris setara mengubah perhitungan soal model mana yang jadi pilihan default.

AnthropicClaudeModelsAgents