← semua berita

DeepSeek rilis V4-Flash, bidik kerja agent dengan harga murah

AI · · · sumber (huggingface.co)

DeepSeek merilis DeepSeek-V4-Flash-0731, model 304 miliar parameter yang diarahkan untuk kerja agentic dan dibanderol agresif. Menurut hitungan Simon Willison, harganya sekitar $0,14 per juta token input dan $0,27 per juta token output, atau kira-kira $0,028 untuk satu task tipikal pada benchmark Artificial Analysis, dengan skor sekitar 50 pada intelligence index mereka. Angka itu menempatkannya di atas MiniMax M3, pesaing berukuran 428 miliar parameter, dengan compute aktif yang jauh lebih kecil.

Model card DeepSeek membuka dengan benchmark agentic: 82,7 di Terminal Bench 2.1, 76,7 di Cybergym, dan 68,7 di DSBench-FullStack, di antara yang lain. Perusahaan menyebut rilis ini mengungguli preview V4-Pro mereka sendiri yang lebih besar, meski jumlah parameter aktifnya jauh lebih sedikit. Model ini hadir dengan lisensi MIT, memakai speculative decoding untuk inference lebih cepat, dan menyediakan kontrol reasoning_effort dengan level low, high, dan max. DeepSeek menyarankan output hingga 384K token pada level tinggi, yang mengarah ke agent run panjang, bukan balasan chat pendek.

Kenapa ini penting

Kalau kamu membangun agent dan menilai model dari biaya per task yang selesai, bukan dari ukuran parameter, V4-Flash adalah opsi murah berlisensi MIT yang layak diuji lewat eval milikmu sendiri sebelum memilih model closed yang lebih mahal.

Open ModelsDeepSeekAgents