Claude של Anthropic מפיק את ההוכחה הראשונה שנבדקה במחשב למשפט האחרון של פרמה

Anthropic הכריזה שבחודש שעבר Claude השלים את ההוכחה הפורמלית והמאומתת-מחשב הראשונה של המשפט האחרון של פרמה, אחת הבעיות המפורסמות ביותר במתמטיקה. פורמליזציה — המרת חשיבה מתמטית לצורה ש-proof assistants כמו Lean יכולים לאמת מכנית — ידועה כעתירת עבודה; בדיקת נכונותה של הוכחה מרכזית עשויה לקחת למומחים אנושיים שנים. Anthropic מדווחת ש-Claude עבד באופן עצמאי במשך 11 ימים, ייצר כ-13 מיליון שורות של קוד Lean ואימת כ-29,500 משפטים ביניים, בעקבות מסלול מפושט המבוסס על ההוכחה פורצת הדרך של Andrew Wiles.
המשמעות אינה כל כך ב'גילוי' מתמטיקה חדשה — אסטרטגיית ההוכחה ידועה — אלא בהדגמה של חשיבה עצמאית מתמשכת ולטווח ארוך עם oracle נכונות חיצוני וקשיח. מכיוון ש-Lean בודק מכנית כל שלב, התוצאה ניתנת לאימות באופן ש'חשיבה' חופשית של LLM אינה: או שההוכחה מתקמפלת או שלא. זה הופך אותה לאות אמין להתקדמות במשימות agent רב-יומיות שבהן שגיאות מצטברות, בדיוק המשטר שחברות ה-AI המובילות מתחרות לכבוש.
ההכרזה (11,881 לייקים, 1,562 ריטוויטים על הפוסט של Anthropic) נחתה בתוך שבוע תחרותי עמוס ושימשה כנרטיב-נגד של Anthropic להשקת GPT-6 Astra של OpenAI. ספקנים יציינו שההוכחה עקבה אחר מפת דרכים אנושית קיימת במקום למצוא תוצאות חדשות, ושפורמליזציה של משפטים שכבר הוכחו היא תחום מוגבל. עדיין, עבור קהילת השיטות הפורמליות זו הדגמה פורצת דרך, והיא רומזת לשימושים בטווח הקרוב באימות תוכנה, פרוטוקולים קריפטוגרפיים ומערכות קריטיות לבטיחות, שבהן ערבויות הניתנות לבדיקה על ידי מכונה חשובות יותר משטף גולמי.