← semua berita

Claude Code kini pakai auto mode secara default

AI · · · sumber (claude.com)

Mulai 14 Agustus, Anthropic menjadikan auto mode sebagai setelan default di Claude Code untuk paket Pro, Max, dan Team. Alasannya lebih menarik daripada perubahannya sendiri. Auto mode membuat Claude Code menjalankan perintah tanpa berhenti meminta persetujuan di tiap langkah, dan argumen Anthropic adalah bahwa prompt persetujuan yang terus-menerus justru membuat orang kurang aman, bukan lebih aman. Dalam studi terhadap 1.053 developer berbayar, ketika sebuah perintah berbahaya diselipkan di tempat prompt izin biasanya muncul, manusia hanya memblokirnya 13,6% dari waktu. Auto mode, yang menyaring tiap tindakan dengan classifier, memblokir 89% perintah yang sama.

Bagian yang paling layak dicatat adalah penurunan performa manusia. Reviewer manusia menangkap sekitar 17% perintah berbahaya di awal sesi, tetapi turun ke 5% setelah lima puluh prompt atau lebih, sementara classifier tetap stabil. Pada sesi nyata, tindakan berbahaya yang tak disengaja muncul di 6,3% sesi yang disetujui manual, dibanding 2,4% di bawah auto mode. Anthropic juga meminta Trajectory Labs menjalankan 720 percobaan prompt injection lewat 72 skenario terhadap Claude Fable 5, Opus 5, dan Sonnet 5, dan menurut mereka tidak ada satu pun yang berhasil. Pengamannya mencakup aturan keras menolak eksfiltrasi data, pemeriksaan status git, serta batas tiga panggilan tool otomatis berturut-turut atau dua puluh total sebelum kembali ke persetujuan manual. Anthropic juga berhenti membebankan biaya classifier ini kepada pengguna berbayar.

Simon Willison, yang membahas peluncuran ini, terkesan tapi belum sepenuhnya yakin: ia menyoroti sekitar 11% yang masih lolos dari auto mode dan meragukan apakah cara ini bisa menghentikan penyerang gigih yang menyembunyikan instruksi di dalam sebuah package.

Kenapa ini penting

Kalau kamu memakai Claude Code di paket berbayar, prompt persetujuan tidak lagi menjadi jaring pengaman kamu mulai 14 Agustus, jadi putuskan sekarang apakah kamu percaya pada classifier atau ingin mematikan auto mode. Datanya menunjukkan menekan "approve" puluhan kali per sesi sebenarnya tidak pernah benar-benar melindungi kamu.

AnthropicClaude CodeSecurityAgents