← semua berita

Gemini 3.7 Flash melompat jauh untuk coding dan agent

AI · · · sumber (blog.google)

Google merilis Gemini 3.7 Flash hanya tiga minggu setelah 3.6 Flash, dan lompatannya lebih besar dari yang tersirat dari nomor versinya. Di DeepSWE v1.1, benchmark software engineering berdurasi panjang, skornya 65,3% berbanding 49,0% milik 3.6 Flash. Kualitas kode produksi di FrontierCode 1.1 naik dari 34,4% ke 43,6%, dan benchmark alur kerja bisnis nyaris berlipat, dari 17,0% ke 30,4%. Google menyebutnya model workhorse paling cerdas mereka untuk coding dan agent, dan kenaikan itu memang menumpuk di area tersebut: perencanaan multi-langkah, lebih sedikit percobaan ulang, serta tata letak web yang lebih fungsional (Elo WebDev Arena naik dari 1538 ke 1588).

Harganya bergerak ke arah sebaliknya. Hingga akhir 2026, model ini dibanderol $0,75 per juta token input dan $3,75 per juta token output, setengah dari tarif 3.6 Flash. Mulai Januari 2027 tarif itu naik dua kali lipat menjadi $1,50 dan $7,50. Google mengatakan telah menambah pengaman terhadap penyalahgunaan CBRN dan siber tanpa menutup penggunaan wajar. Pengumuman ini tidak menyebut ukuran context window maupun angka latensi, sehingga klaim kecepatan "workhorse" sulit dinilai hanya dari angka.

Kenapa ini penting

Jika Anda membangun agent atau perkakas coding dengan anggaran kelas Flash, skor DeepSWE dan otomasi itulah yang perlu diuji pada tugas Anda sendiri sebelum memercayai klaim utamanya. Harga perkenalan memberi beberapa bulan untuk menguji dan beralih sebelum tarifnya berlipat pada Januari.

GoogleGeminiCoding