יום רביעי, 7 באוקטובר 2026 מתעדכן אוטומטית כל שעה
→ חזרה למהדורה

OpenAI מפרסמת תוצאות של מודל פנימי בבעיות מתמטיות פתוחות, יחד עם הוכחות ב-Lean

OpenAI פרסמה תוצאות חדשות בבעיות פתוחות במתמטיקה. את התוצאות השיג מודל frontier פנימי שהחברה לא שחררה לציבור. לצד ההודעה החברה העלתה ל-GitHub הוכחות פורמליות בשפת Lean ופרטים על המחקר, כך שכל אחד יכול לבדוק את התוצאות בעצמו.

OpenAI פרסמה תוצאות חדשות בבעיות פתוחות במתמטיקה, כלומר שאלות שעד כה לא נמצא להן פתרון. לפי החברה, את התוצאות השיג מודל frontier פנימי, מודל מתקדם שעדיין לא שוחרר לציבור. לצד ההודעה החברה העלתה מאגר ב-GitHub ובו הוכחות פורמליות (formalizations) שנכתבו בשפת Lean, ופרטים נוספים על המחקר.

מה בדיוק פורסם

בהודעה הרשמית מתוארים שני רכיבים. הראשון הוא התוצאות המתמטיות עצמן. השני הוא הצורה שבה הן מוגשות: הוכחות שתורגמו ל-Lean ופורסמו בגלוי, יחד עם פרטי מחקר. בתקציר ההודעה לא מפורט כמה בעיות נפתרו, ובאילו תחומים במתמטיקה מדובר.

Lean היא שפת תכנות וגם "עוזר הוכחות" (proof assistant). מתמטיקאים כותבים בה הוכחה צעד אחר צעד, והמחשב בודק מכנית שכל צעד נובע מקודמו. הוכחה שעוברת את הבדיקה של Lean תקפה, בתנאי שהטענה עצמה נוסחה נכון. מאז שנות ה-2010 Lean הפכה לכלי מרכזי בקהילה המתמטית שעוסקת בפורמליזציה.

למה ההוכחות ב-Lean חשובות

כשמודל שפה (LLM) מציג פתרון לבעיה מתמטית, השאלה הראשונה היא אם אפשר לסמוך עליו. מודלים כאלה נוטים לייצר טקסט משכנע, וההוכחה עלולה להכיל שגיאה עדינה שמומחה אנושי יצטרך שעות או ימים כדי לאתר.

ההחלטה לצרף הוכחות ב-Lean היא ככל הנראה מענה ישיר לבעיה הזו. במקום לבקש מהקהילה לסמוך על החברה, OpenAI מאפשרת לכל אחד להוריד את הקוד ולהריץ את הבדיקה בעצמו. המשמעות היא שהוויכוח עובר מהשאלה "האם ההוכחה נכונה" לשאלות שקשה יותר לבדוק אוטומטית: האם הטענה תורגמה נכון לשפה הפורמלית, וכמה משמעותיות הבעיות שנפתרו מבחינה מתמטית.

מה עוד לא ידוע

ההודעה מתייחסת ל"מודל frontier פנימי", ובחומרים שבידינו לא מצוינים שמו, מועד השחרור הצפוי שלו או דרך העבודה שלו. כמו כן לא ברור מהם אם הוכחות ה-Lean נכתבו על ידי המודל עצמו או בשיתוף חוקרים אנושיים, וכמה מעורבות אנושית נדרשה בדרך לפתרון. אלה פרטים שישפיעו על האופן שבו הקהילה המתמטית תעריך את ההישג.

ההודעה עוררה דיון ב-Hacker News. התגובות שם אינן מקור לעובדות, אבל סביר להניח שבימים הקרובים מתמטיקאים יבדקו את ההוכחות לעומק.

המשמעות

מתמטיקה נחשבת כבר כמה שנים למבחן מרכזי ליכולת "החשיבה" של מודלי AI, משום שבתחום הזה קל יחסית להבחין בין תשובה נכונה לשגויה. המהלך של OpenAI מסמן ככל הנראה שינוי בשיטת ההצגה: במקום ציונים במבחנים סטנדרטיים, החברה מציגה תוצאות בבעיות שעדיין לא נפתרו, בפורמט שמאפשר אימות עצמאי.

אם המתמטיקאים יאשרו את התוצאות ויקבעו שהן משמעותיות, זה עשוי לחזק את הטענה שמודלי שפה יכולים לתרום למחקר מתמטי מקורי ולא רק לפתור תרגילים מוכרים. עד שזה יקרה, ההערכה הזהירה היא שהערך המיידי של הפרסום הוא בשקיפות שלו: הוכחות שכל אחד יכול לבדוק.

💬 יש לכם הערה על הכתבה?
פרסומת

→ לכל הכתבות