יום שישי, 2 באוקטובר 2026 מתעדכן אוטומטית כל שעה
→ חזרה למהדורה

מחקר: מומחי AI מובילים העריכו בחסר את קצב ההתקדמות, ובחלק מהמדדים טעו בשנים

לפי דוח ביניים של Forecasting Research Institute, חוקרים בכירים, כלכלנים ו"סופר-חזאים" העריכו בחסר את קצב ההתקדמות של AI במבחני יכולת ובמדדים עסקיים. מדליית זהב באולימפיאדה הבינלאומית במתמטיקה הושגה חמש שנים לפני החציון של תחזית המומחים. מנגד, בתחומים כמו סיוע במעבדות ביולוגיות, וככל הנראה גם מכוניות אוטונומיות, התחזיות היו דווקא אופטימיות מדי.

חוקרי AI מהאוניברסיטאות המובילות, כלכלנים ותיקים ומומחי מדיניות העריכו בחסר, ובאופן עקבי, את קצב ההתקדמות של הבינה המלאכותית. כך עולה מדוח ביניים של Forecasting Research Institute (FRI). הפער בולט במיוחד במבחני יכולת (benchmarks) ובחלק ממדדי האימוץ. בחלק מהמקרים התחזיות פספסו בחמש שנים ויותר.

מי ניבא, ומה

FRI אוסף תחזיות על התקדמות AI מאז אמצע 2022, במסגרת כמה מחקרים ופרויקטים. בסבב הראשון של פאנל LEAP (Longitudinal Expert AI Panel) השתתפו 339 מומחים: 76 מדעני מחשב, 76 מומחים מהתעשייה, 68 כלכלנים ו-119 מומחים למדיניות AI. בין מדעני המחשב היו 30 פרופסורים ממוסדות שמדורגים ב-20 המובילים, ו-10 מתוך 200 החוקרים המצוטטים ביותר בתחום. לצדם השתתפו "סופר-חזאים" (superforecasters): אנשים שאינם מומחי תחום, אבל יש להם רקורד מוכח של תחזיות מדויקות.

אבני הדרך הגיעו מוקדם מהצפוי

הפער הגדול ביותר נמדד במתמטיקה. ביולי 2025 הגיעה AI לרמת מדליית זהב באולימפיאדה הבינלאומית במתמטיקה. זה קרה חמש שנים לפני החציון של תחזית המומחים, ועשר שנים לפני החציון של הסופר-חזאים. התחזיות האלה נאספו ב-2022, עוד לפני השקת ChatGPT, אבל לפי FRI הדפוס נשמר גם אחר כך. לתוצאות שהתממשו בפועל במבחני היכולת ייחסו המומחים הסתברות ממוצעת של 24.6% בלבד, והסופר-חזאים 9.7%. למדליית הזהב באולימפיאדה הם ייחסו 8.6% ו-2.3% בהתאמה.

גם בווירולוגיה המצב דומה. לפי החציון, המומחים צפו ש-AI תשתווה לצוות וירולוגים מוביל במבחן Virology Capabilities Test עד 2030, והסופר-חזאים צפו זאת עד 2034. לפי FRI, זה קרה ככל הנראה כבר באפריל 2025. המשיבים קשרו את אבן הדרך הזו לסיכון ביולוגי גבוה יותר, אבל לא תועדה עלייה בנזק בפועל. במבחן בתחום אבטחת הסייבר נמצאה הערכת חסר דומה.

ייתכן גם ש-AI פתרה את אחת מבעיות פרס המילניום במתמטיקה, אם כי עדיין לא ברור אם הפתרון עומד בקריטריונים. בסקר מאוגוסט–ספטמבר 2025 העריכו המומחים את הסיכוי לפתרון כזה עד סוף 2027 ב-10% בלבד (חציון), והסופר-חזאים ב-5.4%.

הכסף זרם מהר יותר

גם התחזיות הכלכליות היו שמרניות מדי. חציון תחזית המומחים להכנסה השנתית החוזרת (ARR) הגבוהה ביותר של חברת AI כלשהי בסוף 2026 עמד על 20 מיליארד דולר. הכלכלנים העריכו 16 מיליארד והסופר-חזאים 25 מיליארד. FRI מצביע על כ-100 מיליארד דולר אצל אנתרופיק בספטמבר 2026, נתון שלדבריו ככל הנראה כבר הושג. כבר ביולי 2026 דווח על 65 מיליארד דולר, הרבה מעל ההערכה הגבוהה ביותר של כל אחת מהקבוצות.

לא כל התחזיות היו נמוכות מדי

בחלק מהתחומים דווקא הייתה הערכת יתר. מומחי ביו-ביטחון צפו ש-22.5% מהמשתתפים ישלימו משימות מעבדה ביולוגיות בעזרת מודל שפה. וירולוגים צפו 40%, וסופר-חזאים 16.2%. בניסוי מבוקר הצליחו בפועל רק 5.2% מהמשתמשים במודל שפה ובאינטרנט, לעומת 6.6% מאלה שהשתמשו באינטרנט בלבד. כלומר, למודל לא הייתה השפעה מדידה, אם כי הניסוי היה קטן.

ייתכן שגם במכוניות אוטונומיות המומחים היו אופטימיים מדי. חציון התחזית שלהם לנתח הנסיעות האוטונומיות מכלל הנסיעות בשירותי הזמנת נסיעות (ride-hailing) בארה"ב ב-2027 הוא 7.3%, ואילו תחזית שהפיק LLM מעמידה אותו על 2.5%. לדברי FRI, עוד מוקדם לשפוט תחזיות על צמיחה כלכלית, תעסוקה ונזקי AI משמעותיים.

המומחים מעדכנים כלפי מעלה

בינתיים הנשאלים כבר מתקנים את הערכותיהם. בקרב מי שהשלימו את שני הסקרים, ההסתברות הממוצעת שיוחסה לכך ש-AI תהיה "טכנולוגיית המאה", בדומה לחשמל, עלתה בתוך תשעה חודשים מ-31% ל-36% אצל המומחים, ומ-28% ל-35% אצל הסופר-חזאים.

FRI מתכוון להדגיש מעתה תת-קבוצה של משיבים שצופים התקדמות מהירה מאוד עד 2040, ולפרסם תחזיות LLM שמתעדכנות באופן שוטף לצד התחזיות האנושיות. לפי ForecastBench, יש מודלים שכבר משתווים לסופר-חזאים בסוגים מסוימים של שאלות.

למה זה חשוב

ככל הנראה, המשמעות היא שגם הקולות הזהירים והמבוססים ביותר בתחום עלולים לפגר אחרי המציאות, לפחות ביכולות שנמדדות במבחנים. מקבלי החלטות, רגולטורים ומשקיעים נשענים על הערכות כאלה כדי להיערך, ולכן הערכת חסר עקבית יכולה להשאיר אותם מאחור. עם זאת, הממצאים מראים גם שיכולת במבחן אינה הופכת אוטומטית להשפעה בעולם האמיתי. הפער בין השניים עשוי להיות השאלה המרכזית של השנים הקרובות.

💬 יש לכם הערה על הכתבה?
פרסומת

→ לכל הכתבות