יום שני, 5 באוקטובר 2026 מתעדכן אוטומטית כל שעה

בנושא

מתמטיקה

מחקר

דיווח: GPT-6.1 פתרה את כל הבעיות בדרג הקשה ביותר של FrontierMath

לפי דיווח ברשת, גרסה של GPT-6.1 הגיעה ל-100% ב-Tier 4 של FrontierMath, הדרג הקשה ביותר בבנצ'מארק המתמטיקה של Epoch AI. התוצאה עצמה לא מופיעה בחומרי המקור שעמדו לרשותנו, ולכן בשלב זה היא דיווח לא-מאומת. מדובר ב-43 בעיות ברמת מחקר שפתרון אחת מהן יכול לקחת למתמטיקאי מומחה כמה ימים.

חומרה ורובוטיקה

בעיה מתמטית בת 87 שנה נפתרה בעזרת Claude: השערת היעקוביאן הופרכה

המודל Claude Fable 5 של אנתרופיק מצא דוגמה נגדית להשערת היעקוביאן, בעיה פתוחה משנת 1939 שמופיעה ברשימת הבעיות של המתמטיקאי סטיבן סמייל. מתמטיקאים יכלו לבדוק את התוצאה ביד בתוך יום. זו אחת מכמה תוצאות מתמטיות שיוחסו לאחרונה ל-Claude, והיא מחדדת את התחרות בין מעבדות ה-AI בתחום.

מודלים וכלים

Claude Sonnet 5.5 הושק: קרוב ל-Opus בביצועים ובעלות נמוכה יותר, וטענה לא מאומתת על הוכחה מתמטית שכתבו סוכנים

אנתרופיק השיקה את Claude Sonnet 5.5. לפי הנתונים שפורסמו, הוא מהיר ביותר מ-30% מ-Sonnet 5, מוזיל את העלות למשימה בעד 30% ומתקרב ל-Opus 5.5 במבחני עבודת ידע. במקביל מתפרסמת ברשת טענה, שעדיין לא אומתה, שעשרה סוכנים מבוססי המודל עבדו 15 שעות ברציפות והפיקו הוכחה מתמטית של 17,895 שורות.

מחקר

אחרי משבר התדמית במתמטיקה: אופנאי פונה למתמטיקאים בכירים לקבלת ייעוץ

קבוצה עצמאית של תשעה מתמטיקאים בכירים, ובהם זוכי מדליית פילדס, תייעץ לאופנאי ולחברות AI אחרות איך לבחון תוצאות מתמטיות חדשות ואיך לפרסם אותן. הקבוצה תפעל תחת המכון למחקר מתקדם בפרינסטון. בקהילה המתמטית רואים בה צעד ראשון חיובי, אבל שואלים כמה השפעה תהיה לה בפועל.

עסקים ותעשייה

סוכן קוד פתוח מנסה לשפר שיא בבעיה מתמטית פתוחה — בשידור כמעט חי

פרויקט קוד פתוח בשם Artificium מריץ סוכן AI אוטונומי, מבוסס על מודל Qwen בן 27 מיליארד פרמטרים, בניסיון לשפר שיא קיים בבעיית כיסוי קומבינטורית פתוחה הידועה כ-C(25,15,5). כל התהליך - הזיכרונות, הקוד והפעולות של הסוכן - מתפרסם בציבור, כך שניתן לעקוב ולבדוק את התוצאות באופן עצמאי; נכון לרגע זה טרם פורסם פתרון משופר.

מחקר

OpenAI טוענת: המודל הפנימי שלה פתר למעלה מ-100 בעיות מתמטיות פתוחות

OpenAI מדווחת כי מודל פנימי בלתי-משוחרר, שהחל להתאמן ב-28 באוגוסט, פתר למעלה מ-100 בעיות מתמטיות שעמדו פתוחות לאורך שנים, מעבר לפתרון שדווח קודם לבעיית Navier-Stokes. במקביל הקימה החברה גוף ייעוץ חיצוני של מתמטיקאים בכירים, על רקע ביקורת בקהילה המדעית על אופן פרסום ואימות תוצאות כאלה.

מחקר

מתמטיקאים תלויים ב-AI למרות השלכות קיומיות אפשריות על תחום שלהם

מתמטיקאים בכירים טוענים כי OpenAI השתמשה בעבודתם בפתרון בעיות ותיקות בתחום, ובכל זאת ממשיכים להשתמש בכלי הבינה המלאכותית של החברה ושל מתחרותיה לצורך המחקר השוטף שלהם. לדבריהם, השימושיות של הכלים והיעדר חלופה אמיתית משאירים אותם "תקועים", גם כשהם חוששים מהשלכות קיומיות על מקצועם.

רגולציה ואבטחה

42 מתמטיקאים בכירים מזהירים: הסיכון הקיומי מ-AI אמיתי ודחוף

42 מתמטיקאים, חברים בחברה המלכותית למדעים הבריטית ובהם שלושה זוכי מדליית פילדס, חתמו על מכתב פתוח שקורא לחברה להתריע בפני הממשלה והציבור מפני סיכון קיומי מבינה מלאכותית. הטריגר: מודלים של OpenAI ו-Anthropic פתרו בתוך שלושה חודשים בעיית מחקר מתמטית שנחשבה מהקשות בעולם, והחותמים מזהירים שקצב התקדמות דומה בתחומים כמו אבטחת מידע ונשק אוטונומי עלול להיות מסוכן בהרבה.

מחקר

OpenAI קרובה כנראה לפתרון בעיית מיליניום שנייה — הפעם בזהירות

OpenAI מדווחת על התקדמות משמעותית בפתרון בעיית מיליניום שנייה, ככל הנראה השערת הודג', רק שבועות אחרי שהכרזתה על פתרון בעיית נאבייה-סטוקס באמצעות 10,000 סוכני AI עוררה מחאה של יותר מ-1,000 מתמטיקאים וזוכי פרס פילדס. המאמר הקודם עדיין נבדק על ידי מכון קליי, ותוצאת הבדיקה תקבע את מידת האמינות של ההכרזה הבאה.

מודלים וכלים

בינה מלאכותית טוענת להוכחה של הנחיית קומלוש

מאמר חדש שהועלה לארכיון arXiv טוען להוכחה של גבול מספרי מדויק לבעיית הסימון של קומלוש, בעיה פתוחה עשרות שנים בתורת הדיסקרפנסיה — כשההוכחה, לפי המחברים, התגלתה על ידי סוכן בינה מלאכותית בשם Odin. מדובר בפרה-פרינט שטרם עבר ביקורת עמיתים, אך הוא מצטרף לשורת מקרים שבהם מערכות AI מיוחסות בהוכחת תוצאות מתמטיות, ומעורר מחדש את שאלת אמות המידה לאימות הוכחות כאלה.

חומרה ורובוטיקה

העימות בין OpenAI לקהילת המתמטיקאים מחריף

עשרים וחמישה זוכי מדליית פילדס חתמו על מכתב פתוח נגד מעבדות בינה מלאכותית שמתחרות ביניהן על פתרון בעיות מתמטיות מפורסמות. השבוע התלקח העימות סביב OpenAI ספציפית: פרופסור מ-NYU האשים את החברה בלחץ לא לתת קרדיט לחוקר מ-Anthropic, ו-OpenAI משכה חסות מאירוע מתמטי בקאלטק לאחר ביקורת.

מחקר

זוכי פרס פילדס מזהירים: "חוסר יישור חמור" בין חברות ה-AI לקהילת המתמטיקאים

קבוצת מתמטיקאים בכירים, ובהם — לפי דיווחים שהופצו ברשת — כ-24 זוכי פרס פילדס, פרסמו מכתב תחת הכותרת "A Severe Misalignment of AI in Mathematics" (חוסר יישור חמור של AI במתמטיקה), ובו הם מתריעים כי המרוץ של חברות בינה מלאכותית לפתור בעיות מתמטיות כבנצ'מרק מזיק למדע המתמטיקה ולקהילה שסביבו. המכתב, שפורסם באתר mathandai.org, אינו נוקב בשם חברה ספציפית אלא מדבר על "חברות AI" באופן כללי.

מודלים וכלים

פלטפורמה פתוחה לאימות שיתופי של סוכני AI יוצאת לדרך

מפתח עצמאי השיק את solveathome.org, פלטפורמה שבה סוכני AI עובדים על בעיות מחקר פתוחות תוך שסוכנים אחרים בודקים את התוצרים ובוחנים מוסמכים מכריעים מה קביל - הכול בפומבי. לדברי המפתח, המניע לבנייתה היה דיווח לא-מאומת לפיו OpenAI הריצה כ-10,000 סוכנים בניסיון סגור על אחת מ"בעיות המילניום"; כדוגמה חיה הוא מציג פרויקט סביב השערת הראשוניים התאומים.

מחקר

זוכה פרס פילדס מקים מכון שינסה להוכיח מתמטית שבינה מלאכותית בטוחה

המתמטיקאי הקנדי יעקב צימרמן, זוכה פרס פילדס וחבר בצוות הבטיחות של OpenAI, הקים מכון מחקר עצמאי בשם MAISI שיפעל מאזור מפרץ סן פרנסיסקו החל מינואר 2027. המכון ינסה ליישם הוכחות מתמטיות קשוחות, בהשראת קריפטוגרפיה, כדי להראות שמערכות AI פועלות באופן בטוח ואחראי - תחום שכיום נשען בעיקר על בדיקות אמפיריות.

מחקר

OpenAI משיקה את GPT-6 Astra: ביצועים מובילים במתמטיקה, גם בלי שהתמקדו בזה

GPT-6 Astra, המודל החדש של OpenAI, תפס את המקום הראשון בבנצ'מארק המתמטי ErdosBench, על אף שהמדען הראשי של החברה, ג'קוב פחוצקי, אמר במפורש שמתמטיקה לא הייתה בעדיפות בפיתוחו. החברה מתעדפת מחקר בתחום ה-RSI (שיפור עצמי רקורסיבי) ויישור אוטומטי, וההישג המתמטי מצטייר כתוצר לוואי.

רגולציה ואבטחה

מתמטיקאים תוקפים את OpenAI: שימוש בעבודתם ללא קרדיט

מתמטיקאי נוסף, אנדראס תום, מאשים את OpenAI בחוסר שקיפות לגבי מקורות נתוני האימון של המודלים שלה, ימים ספורים אחרי שפרופסור למתמטיקה באוניברסיטת ניו יורק העלה חשד דומה. תום טוען שתגובת החברה לשאלותיו הייתה חמקנית עד כדי "אי-כנות", ודורש מהחברה להוכיח שלא נעשה שימוש בעבודתו.

מודלים וכלים

OpenAI פותרת בעיה מתמטית בת 200 שנה — ומסתבכת במחלוקת קרדיט מול חוקר של Anthropic

OpenAI הודיעה על פתרון מבוסס AI למשוואת נאבייה-סטוקס, אחת מבעיות המילניום בנות מיליון הדולר, לאחר מרוץ משאבים בן ימים שכלל עד 10,000 סוכני AI. ההכרזה לוותה במחלוקת: חוקר מ-Anthropic ומתמטיקאי מ-NYU שהשתמשו ב-Claude ו-Codex בעבודה על בעיה קרובה טוענים ש-OpenAI מיהרה לפרסם אחרי שנודע לה על התקדמותם, ואף הציעה לצמצם את הקרדיט שלהם.

מחקר

זוכה פרס פילדס מזהיר: AI "כורה" בעיות מתמטיקה פתוחות לפני שחוקרים יוכלו להשלימן

טרנס טאו, זוכה פרס פילדס, מזהיר כי כלי בינה מלאכותית פותרים בעיות מתמטיקה פתוחות בקצב כה מהיר עד שהם "כורים" את מאגר הבעיות הפתוחות באופן בלתי מתחדש. לדבריו, אפילו שמועה על חוקר שמתחיל לעבוד על בעיה מסוימת עלולה להפעיל גל של מאמץ AI שמקדים אותו - תמריץ שעלול לגרום לחוקרים להפסיק לשתף כיוונים מחקריים בפומבי.

מודלים וכלים

Navier-Stokes: OpenAI טוענת לפתרון בעיה מתמטית היסטורית

OpenAI מדווחת כי מודל פנימי בלתי-מוצג, בעל יכולת משמעותית גדולה יותר מ-GPT-6 Astra, הפיק הוכחה לבעיית הקיום והחלקות של נאווייה-סטוקס — אחת משבע בעיות המילניום של מכון קליי. החברה מדגישה שאינה תובעת את הפרס הכספי על התוצאה, ומציגה אותה בעיקר כהדגמת יכולות; חוקרים, ובהם סבסטיאן בובק, כבר הביעו ספקות לגבי הטענות.

מחקר

האם OpenAI "העתיקה" כיוון מחקר מתחרה? מתמטיקאי מ-NYU מאשים, החברה מכחישה

OpenAI הכריזה על פתרון בעיית המילניום נאבייה-סטוקס, אך המתמטיקאי טריסטן באקמאסטר מ-NYU טוען שהחברה למדה על התקדמותו ושל שותפו ליוונט אלפויה (Anthropic), ולאחר מכן הפעילה עליו לחץ — כולל דרישה להסיר את קרדיט אלפויה ואיום מרומז על הקריירה שלו. OpenAI מכחישה את הטענות ומציגה תהליך פיתוח עצמאי באמצעות כ-10,000 סוכני AI.

רגולציה ואבטחה

מתמטיקאים טוענים: OpenAI נמנעה מלהשיב אם השתמשה בעבודתם הפרטית לאימון מודלים

שני מתמטיקאים טוענים, לפי דיווח שהופץ ברשת וטרם אומת במקור עצמאי, כי OpenAI השתמשה בעבודת מחקר פרטית ובלתי-מפורסמת שלהם כדי לשפר את יכולות הפתרון המתמטי של מודליה, ונמנעה ממתן תשובה כשנשאלה על כך ישירות. הפרשה עולה על רקע תביעה נפרדת ומתועדת של אפל נגד OpenAI בגין גניבת סודות מסחריים.

חומרה ורובוטיקה

מתמטיקאי דגול מזהיר מ'מרוץ אחרי מדדים' בעולם ה-AI

טרנס טאו, מהמתמטיקאים הבולטים בעולם, פרסם שרשור ב-Mastodon ובו הוא מזהיר כי מרוץ מעבדות ה-AI אחר שיפור מדדים מתמטיים מתחיל לפגוע בתחום. הטריגר: תוצאה חדשה בבעיית הפערים בין ראשוניים, שבעקבותיה כמה מעבדות AI מיהרו לפרסם שיפורים משלהן — לדבריו, תוך התעלמות ממה שבאמת חשוב במחקר מתמטי.

מחקר

Claude סייעה לחוקרים לאתר עקום אליפטי מדרגה 30 — קפיצה בתחום שבו הקידום הקודם ארך עשור

החוקרים לבנט אלפוגה ואבה האוול דיווחו כי בעזרת מודל השפה Claude של Anthropic הצליחו לאתר עקום אליפטי מדרגה 30. לפי הפרסום, הקפיצה הקודמת בתחום — ממדרגה 28 ל-29 — ארכה כעשר שנים, מה שממחיש עד כמה נדיר הישג כזה.

מודלים וכלים

OpenAI פתרה בעיות מתמטיקה ותיקות - והקהילה המקצועית בהלם

OpenAI פרסמה קבוצת פתרונות לבעיות מתמטיות ותיקות, ופרסום זה עורר ויכוח נרחב בקהילת המתמטיקאים המקצועית. רוברט הארט, כתב הטכנולוגיה של The Verge בלונדון, מתאר קהילה שעמדה בהלם נוכח הקצב שבו מודלים עברו מכישלון בסיסי להישגים ברמה מקצועית.