Agenci AI Claude podnieśli zweryfikowany odsetek zer funkcji dzeta Riemanna leżących na linii krytycznej z 41,6% do 67,2%. Ten skok nie dowodzi hipotezy Riemanna, ale pokazuje, że wielkoskalowe procesy oparte na AI mogą generować matematycznie sprawdzalne wyniki.
Dlaczego hipoteza Riemanna jest ważna
Hipoteza ta zakłada, że każda nietrywialna zero funkcji dzeta Riemanna ma część rzeczywistą równą dokładnie ½. Zera te kontrolują rozkład liczb pierwszych, więc potwierdzenie tej hipotezy zacieśniłoby związek między wzorcami liczb pierwszych a analizą zespoloną. Do tej pory udowodniono, że na „linii krytycznej” znajduje się jedynie ułamek zer. Zwiększenie tego odsetka jest standardowym miernikiem postępu.
Jak Anthropic osiągnął 67,2%
Anthropic przeprowadził Claude Code, swój model skoncentrowany na kodzie, przez dwie intensywne sesje badawcze. Podczas drugiej sesji wdrożono 60 podagentów, którzy koordynowali działania za pomocą ponad 2400 poleceń powłoki (shell) i wygenerowali setki skryptów Python. Łącznie proces ten wygenerował około 31 milionów tokenów wyjściowych — co odpowiada objętości krótkiej powieści.
Matematycy z zespołu przeprowadzili audyt powstałej pracy i udostępnili formalizację w Lean 4 — język do sprawdzania dowodów przez maszyny — aby inni mogli zweryfikować każdy krok. W pracy wykorzystano wewnętrzną, nieopublikowaną wersję badawczą Claude, a weryfikacja opierała się na wewnętrznych kontrolach i krótkich recenzjach eksperckich, a nie na formalnym procesie recenzji naukowej (peer review).
Co tak naprawdę oznacza ten wynik
Nowa praca podnosi udowodnioną dolną granicę zer na linii krytycznej z 41,6% do 67,2%. Liczba ta jest dolną granicą: na linii może znajdować się znacznie więcej zer, których analiza nie uchwyciła.
Co kluczowe, wynik ten nie przybliża samej hipotezy do pełnego dowodu. Hipoteza wymaga, aby wszystkie nietrywialne zera znajdowały się na linii; dolna granica na poziomie 67,2% pozostawia ponad jedną trzecią zer niewyjaśnionych.
Ograniczenia podejścia opartego na AI
W oświadczeniach Anthropic wyraźnie zaznaczono, że nie oczekują oni szybkiego rozstrzygnięcia hipotezy za pomocą obecnego przepływu pracy. Ludzie wciąż muszą sprawdzać wyniki modelu pod kątem luk logicznych, a wewnętrzny proces weryfikacji nie posiada rygoru społecznej recenzji naukowej. Wersja badawcza Claude nie jest publicznie dostępna, co ogranicza możliwość niezależnej replikacji.
Co dalej
Udostępnienie formalizacji w Lean 4 zaprasza szerszą społeczność matematyczną do przeprowadzenia audytu dowodu.
Podsumowanie
Agenci Claude od Anthropic udowodnili, że AI może przyspieszyć weryfikację złożonych twierdzeń matematycznych, przynosząc znaczną poprawę w znanej dolnej granicy zer funkcji dzeta Riemanna. Ten przełom jest dowodem koncepcji (proof-of-concept) dla wielkoskalowych procesów badawczych opartych na agentach, a nie rozwiązaniem samego problemu milenijnego.
