← semua berita

Qwen3.8 rilis model open-weight 2,4 triliun parameter dengan 95 miliar aktif

AI · · · sumber (huggingface.co)

Tim Qwen merilis Qwen3.8, model mixture-of-experts dengan total 2,4 triliun parameter tapi hanya 95 miliar yang aktif per token. Justru di situ intinya: Anda mendapat kapasitas model raksasa dengan biaya komputasi yang lebih dekat ke model 95 miliar. Arsitekturnya hibrida, 92 lapisan yang menyelingi blok Gated DeltaNet dan gated attention sebelum masuk ke MoE, dengan 512 expert dan 11 aktif per token (10 routed plus satu shared).

Context window mencapai 262.144 token secara native dan bisa diperluas hingga sekitar 1 juta token. Model card melaporkan 80,7% pada QwenSWEBench dan 92,6% pada GPQA Diamond, membuatnya sejajar dengan Claude Opus 4.8 dan GPT-5.6 Sol pada tugas-tugas itu. Ada dua hal baru dalam pelatihannya: multi-token prediction, dan kontrol reasoning_effort yang memungkinkan Anda mengatur tingkat berpikir ke low, medium, atau xhigh. Model ini selalu berpikir sebelum menjawab dan tidak menyediakan mode tanpa reasoning.

Bobotnya tersedia di Hugging Face dengan lisensi "qwen3.8-max", jadi baca dulu ketentuannya sebelum penggunaan komersial, jangan berasumsi lisensinya sepermisif model Qwen terdahulu.

Kenapa ini penting

Model open-weight sebesar ini memberi tim opsi kelas frontier yang bisa mereka hosting sendiri, tapi desain sparse dan lisensi khususnya mengubah perhitungan: siapkan memori untuk menampung 2,4 triliun parameter meski komputasi per token hanya setara 95 miliar, dan periksa ketentuan lisensinya sebelum membangun di atasnya.

QwenOpen WeightsModels