Claude memperkuat hasil terbukti soal hipotesis Riemann
Anthropic menyebut sebuah versi riset Claude yang belum dirilis memperbaiki hasil lama yang berkaitan dengan hipotesis Riemann. Bekerja lewat Claude Code, model itu menaikkan batas bawah yang sudah terbukti untuk proporsi nol non-trivial fungsi zeta Riemann yang berada di garis kritis, dari 41,6% ke 67,2%. Model ini tidak memecahkan hipotesisnya, soal berusia seabad dengan hadiah satu juta dolar. Yang dilakukannya adalah memperluas apa yang sudah bisa dibuktikan, dengan bertumpu pada karya terbaru Baluyot, Goldston, Suriajaya, dan Turnage-Butterbaugh serta hasil lebih awal dari Bombieri.
Penjelasan Anthropic cukup rinci soal prosesnya. Claude memakai 31 juta token keluaran dalam dua sesi, mengoordinasikan sekitar 60 subagent selama kira-kira satu setengah hari, menjalankan 2.400 perintah shell dan ratusan skrip Python, serta membuat dan menguji 650 pendekatan sebelum menyaringnya. Model juga memvalidasi hasil secara numerik terhadap nol zeta yang sudah diketahui dan mencari counterexample. Dua matematikawan Anthropic memeriksa pekerjaan itu, dan Claude menghasilkan bukti yang bisa diverifikasi secara formal dalam bahasa Lean, yang ditinjau oleh matematikawan Brian Conrey dan Dan Goldston.
Yang membedakan ini dari sekadar demo adalah lapisan verifikasinya. Bukti Lean bisa dicek mesin, dan peninjauan oleh matematikawan senior memberi hasilnya bobot yang biasanya tidak dimiliki keluaran model.
Kenapa ini penting
Bagi yang bekerja di matematika atau bidang lain yang padat pembuktian, ini pola kerja konkret yang bisa ditiru: jalankan banyak percobaan dengan agen, lalu formalkan hasilnya di Lean supaya bisa diperiksa secara independen. Bagian Lean itulah yang perlu dibaca lebih dulu sebelum mempercayai bukti apa pun yang diberikan model.