← semua berita

Grok 4.6 tandingi model teratas dengan biaya per tugas lebih murah

AI · · · sumber (artificialanalysis.ai)

xAI merilis Grok 4.6 sekitar sebulan setelah 4.5, dan yang menarik bukan angka skornya, melainkan cara model ini mencapainya. Dalam pengujian independen Artificial Analysis, Grok 4.6 meraih 61 pada Intelligence Index, setara GPT-5.6 Sol dan sedikit di bawah Claude Opus 5 (63) serta Fable 5 (62). Sebagai pembaruan, angka itu biasa saja. Yang membedakan adalah efisiensinya: pada tugas agent berdurasi panjang, Grok 4.6 rata-rata selesai dalam sekitar 53 giliran dan 0,5 miliar token input, dibanding sekitar 103 giliran dan 2,0 miliar token untuk Claude Opus 5. Lebih sedikit giliran dan token berarti biaya per tugas lebih rendah, dan angka terukurnya $0,84, sama dengan Kimi K3.

Harganya $2 per juta token input dan $6 per juta token output, dengan input dari cache $0,5. Context window tetap 500 ribu token, tidak berubah dari 4.5. Pada benchmark tugas, posisinya kompetitif tapi tidak dominan: 88,4% di Terminal-Bench v2.1, setara para pemimpin, dan Elo GDPval-AA 1753, hanya kalah dari Opus 5.

Polanya patut diperhatikan: sebuah model bisa mencapai posisi terdepan soal harga dengan bersikap ringkas dan tegas dalam loop agent, tanpa harus menjuarai satu benchmark.

Kenapa ini penting

Kalau Anda menjalankan agent dalam skala besar, jumlah token per tugas adalah tagihan Anda. Model yang mencapai kualitas serupa dengan separuh giliran dan seperempat token input bisa memangkas biaya secara tajam, jadi uji Grok 4.6 pada beban kerja Anda sendiri sebelum menganggap model berskor tertinggi otomatis paling murah dijalankan.

xAIModelsAgents