Ejen AI Claude telah meningkatkan kadar pengesahan sifar Riemann-zeta yang terletak pada garis kritikal daripada 41.6% kepada 67.2%. Lonjakan ini tidak membuktikan hipotesis Riemann, tetapi ia menunjukkan bahawa aliran kerja dipacu AI berskala besar boleh menghasilkan keputusan yang boleh disemak secara matematik.

Mengapa hipotesis Riemann penting

Hipotesis tersebut menegaskan bahawa setiap sifar bukan trivial bagi fungsi zeta Riemann mempunyai bahagian nyata tepat ½. Sifar-sifar tersebut mengawal taburan nombor perdana, jadi mengesahkan konjektur tersebut akan memperkukuh hubungan antara corak perdana dan analisis kompleks. Setakat ini, hanya sebahagian kecil daripada sifar tersebut telah terbukti terletak pada "garis kritikal". Meningkatkan pecahan tersebut merupakan penanda aras standard bagi kemajuan.

Bagaimana Anthropic mencapai 67.2%

Anthropic menjalankan Claude Code, model berfokuskan kodnya, melalui dua sesi penyelidikan intensif. Sesi kedua mengerahkan 60 sub-ejen yang menyelaraskan lebih daripada 2,400 arahan shell dan menjana ratusan skrip Python. Secara keseluruhan, proses tersebut menghasilkan kira-kira 31 juta token output—kira-kira saiz sebuah novel pendek.

Pakar matematik dalam pasukan tersebut telah mengaudit kertas kerja yang terhasil dan mengeluarkan formalisasi Lean 4, sebuah bahasa pembuktian yang disemak oleh mesin, supaya orang lain boleh mengesahkan setiap langkah. Kerja tersebut menggunakan versi penyelidikan Claude yang dalaman dan belum dikeluarkan, dan pengesahan bergantung pada semakan dalaman serta ulasan pakar yang ringkas berbanding semakan rakan sejawat yang formal.

Apa yang sebenarnya dinyatakan oleh keputusan tersebut

Kertas kerja baharu ini meningkatkan had bawah sifar yang terbukti pada garis kritikal daripada 41.6% kepada 67.2%. Angka tersebut adalah had bawah: banyak lagi sifar mungkin terletak pada garis tersebut tetapi analisis tersebut tidak menangkapnya.

Yang paling penting, keputusan tersebut tidak mendekatkan hipotesis itu sendiri kepada pembuktian penuh. Hipotesis tersebut memerlukan semua sifar bukan trivial berada pada garis tersebut; had bawah 67.2% meninggalkan lebih daripada sepertiga sifar yang tidak dapat dijelaskan.

Had pendekatan AI

Kenyataan Anthropic sendiri menjelaskan bahawa mereka tidak menjangkakan aliran kerja semasa akan menyelesaikan hipotesis tersebut dalam masa terdekat. Manusia masih perlu menyemak output model untuk mencari jurang logik, dan proses pengesahan dalaman kekurangan ketegasan semakan rakan sejawat komuniti. Versi penyelidikan Claude tidak tersedia secara umum, jadi replikasi bebas adalah terhad.

Apa yang seterusnya

Pengeluaran formalisasi Lean 4 menjemput komuniti matematik yang lebih luas untuk mengaudit pembuktian tersebut.

Kesimpulan

Ejen Claude milik Anthropic telah menunjukkan bahawa AI boleh mempercepatkan pengesahan pernyataan matematik yang kompleks, memberikan peningkatan ketara dalam had bawah yang diketahui bagi sifar Riemann-zeta. Kejayaan ini adalah bukti konsep untuk aliran kerja ejen-penyelidikan yang besar, bukannya penyelesaian kepada masalah hadiah milenium itu sendiri.