סוכני Claude AI העלו את שיעור אפסירי Riemann-zeta המאומתים הנמצאים על הקו הקריטי מ-41.6% ל-67.2%. הזינוק הזה לא מוכיח את השערת רימן, אך הוא מראה שזרימות עבודה (workflows) מבוססות AI בקנה מידה גדול יכולות להפיק תוצאה הניתנת לבדיקה מתמטית.
למה השערת רימן חשובה
ההשערה קובעת כי לכל אפסרי (zero) לא-טריוויאלי של פונקציית זטא של רימן יש חלק ממשי של בדיוק ½. אפסרים אלו שולטים בהתפלגות המספרים הראשוניים, כך שאישור ההשערה יחזק את הקשר בין תבניות של מספרים ראשוניים לבין אנליזה מרוכבת. עד כה, הוכח כי רק חלק מהאפסרים נמצאים על ה"קו הקריטי". העלאת החלק הזה היא מדד סטנדרטי להתקדמות.
איך Anthropic הגיעה ל-67.2%
Anthropic הריצה את Claude Code, המודל שלה המתמקד בקוד, לאורך שני מפגשי מחקר אינטנסיביים. במפגש השני הופעלו 60 סוכני-משנה שתיאמו ביניהם באמצעות יותר מ-2,400 פקודות shell ויצרו מאות סקריפטים ב-Python. בסך הכל, התהליך הפיק כ-31 מיליון טוקנים של פלט — בערך בגודלו של רומן קצר.
מתמטיקאים בצוות ביצעו ביקורת (audit) למאמר שנוצר ושחררו פורמליזציה ב-Lean 4, שפה להוכחות הניתנות לבדיקה על ידי מכונה, כדי שאחרים יוכלו לאמת כל שלב. העבודה השתמשה בגרסת מחקר פנימית ולא שפורסמה של Claude, והאימות התבסס על בדיקות פנימיות וסקירות מומחים קצרות במקום על ביקורת עמיתים (peer review) פורמלית.
מה התוצאה באמת אומרת
המאמר החדש מעלה את החסם התחתון המוכח של האפסרים על הקו הקריטי מ-41.6% ל-67.2%. המספר הזה הוא חסם תחתון: ייתכן שרבים יותר אפסרים נמצאים על הקו, אך הניתוח לא תפס אותם.
באופן מכריע, התוצאה לא מקרבת את ההשערה עצמה להוכחה מלאה. ההשערה דורשת שכל האפסרים הלא-טריוויאליים יהיו על הקו; חסם תחתון של 67.2% משאיר יותר משליש מהאפסרים ללא הסבר.
מגבלות גישת ה-AI
ההצהרות של Anthropic עצמה מבהירות שהן אינן מצפות שזרימת העבודה הנוכחית תפתור את ההשערה בקרוב. בני אדם עדיין צריכים לבחון את פלט המודל כדי למצוא פערים לוגיים, ותהליך האימות הפנימי חסר את הקפדנות של ביקורת עמיתים קהילתית. גרסת המחקר של Claude אינה זמינה לציבור, ולכן היכולת לשחזר את התוצאות באופן עצמאי מוגבלת.
מה הלאה
שחרור הפורמליזציה ב-Lean 4 מזמין את הקהילה המתמטית הרחבה לבצע ביקורת על ההוכחה.
שורה תחתונה
סוכני Claude של Anthropic הוכיחו ש-AI יכול להאיץ את האימות של טענות מתמטיות מורכבות, תוך מתן שיפור משמעותי בחוסם התחתון הידוע עבור אפסירי Riemann-zeta. הפריצת דרך היא הוכחת היתכנות (proof-of-concept) לזרימות עבודה של סוכני מחקר רחבים, ולא פתרון לבעיית פרס המילניום עצמה.
