גוגל דיפמיינד הציגה את AlphaProof Nexus — מערכת AI שפתרה תשע בעיות פתוחות מרשימת ארדש (Erdős), שתיים מהן היו ללא פתרון במשך 56 שנה, וגם הוכיחה 44...
גוגל דיפמיינד הציגה את AlphaProof Nexus — מערכת AI שפתרה תשע בעיות פתוחות מרשימת ארדש (Erdős), שתיים מהן היו ללא פתרון במשך 56 שנה, וגם הוכיחה 44 השערות נוספות מתוך מאגר הרצפים המתמטי OEIS. מדובר בפריצת דרך שפורסמה בארקיב ב-21 במאי 2026, יום אחרי הודעה מתחרה של OpenAI על הישג דומה בתחום.
הרעיון המרכזי: המערכת משלבת מודל שפה גדול (מבוסס Gemini) שמציע אסטרטגיות הוכחה יצירתיות, יחד עם Lean — עוזר הוכחות פורמלי שבודק כל צעד לוגי באופן קפדני, כדי למנוע הזיות. הלולאה החוזרת של הצעה-בדיקה-תיקון ("agentic loop") ממשיכה עד שההוכחה עוברת אימות מלא או שהמערכת מוותרת. כך פותרת AlphaProof Nexus את בעיית האמינות שמטרידה מודלי שפה בתחומים שדורשים דיוק מוחלט.
מעבר לערך התיאורטי, יש כאן גם זווית כלכלית מפתיעה: כל פתרון עלה בממוצע רק כמה מאות דולרים בעלויות חישוב. אם AI יכול לתרום עבודה מתמטית מקורית — לא רק לאמת הוכחות אנושיות אלא לגלות חדשות — הפוטנציאל לשימוש בתחומים כמו גילוי תרופות, מדעי החומרים ואימות תוכנה פורמלי הופך מוחשי הרבה יותר.
ההודעה של דיפמיינד לא נולדה בוואקום. יום קודם לכן, ב-20 במאי 2026, הכריזה OpenAI שמודל פנימי שלה הפריך את השערת המרחק היחידני (unit distance conjecture) של ארדש — בעיה בת כ-80 שנה בגאומטריה קומבינטורית — כשהמודל ייצר את רעיון ההוכחה המקורי וצוות מתמטיקאים אנושי אימת, ליטש ופרסם אותו. זו הפעם הראשונה שבה AI פתר באופן עצמאי בעיה פתוחה מרכזית בתחום מתמטי ספציפי, בגישה שלא הופיעה בספרות הקיימת.
ההבדל בין שתי הגישות הוא בדיוק העניין. OpenAI הסתמכה על היגיון בשפה טבעית עם אימות אנושי בסוף התהליך, בעוד גוגל דיפמיינד בחרה במסלול שבו כל שלב מאומת אוטומטית על ידי Lean עוד לפני שהוכחה נחשבת גמורה — כלומר בלי תלות בבדיקה אנושית שעלולה לפספס טעות עדינה. שני המסלולים מגיעים למטרה דומה, אבל השאלה איזו גישה תתרחב טוב יותר לבעיות מורכבות עוד יותר היא בדיוק מה שיקבע לאן יתפתח התחום בשנה הקרובה.
מעבר לרשימת ארדש, ל-AlphaProof Nexus יש גם הישגים פחות מדוברים אך לא פחות משמעותיים: המערכת הכריעה שאלה פתוחה בת 15 שנה בגאומטריה אלגברית, ושיפרה חסם התכנסות בתחום האופטימיזציה הקמורה על ידי גילוי לוח זמנים אלגוריתמי חדש שאף אחד לא זיהה קודם. אלו לא תרגילי אימות של ידע קיים, אלא תוצרים מתמטיים מקוריים בתחומים שבהם בדרך כלל נדרשות שנים של עבודה אנושית ייעודית.
הקוד הפורמלי המלא של ההוכחות, יחד עם גרסאות בשפה טבעית של חלקן, פורסם בריפוזיטורי פתוח בין 20 ל-22 במאי 2026 — כך שכל מתמטיקאי יכול לבדוק את ההוכחות בעצמו דרך Lean, לא רק לקבל את המילה של גוגל. השקיפות הזו היא לא פרט טכני שולי: היא זו שהופכת את ההישג מהצהרת שיווק לתוצאה שניתנת לשחזור ולביקורת מדעית אמיתית, ובכך מבדילה את הגל הנוכחי של AI מתמטי מהבטחות סרק שליוו כלים קודמים בתחום.