יום שבת, 22 באוגוסט 2026 מתעדכן אוטומטית כל שעה

כל מה שחם בעולם הבינה המלאכותית · בעברית

📚 בית הספר ל-AI ✈️ הצטרפו לערוץ הטלגרם

מחקר חדש: מודלים של AI חוזים פעולות אנושיות לא נכון כי הם מתעלמים ממה שאנשים חושבים

מחקר חדש טוען ש'מודלי עולם' מבוססי AI כמו Sora, Genie 3, JEPA ו-Marble מדגמנים רק את השכבה הפיזית של סצנה - עצמים, מיקום ותנועה - ומתעלמים ממה שהאנשים בתוכה מאמינים, רוצים או תופסים כראוי מבחינה חברתית, ולכן חוזים לעיתים פעולות שגויות. החוקרים מציעים מסגרת בשם Mental World Modeling שמוסיפה משתנים נפשיים לדוגמנות, לצד יישום התייחסות בשם MENTIS ומבחן הערכה חדש בשם Menti-Bench.

מאמר חדש טוען שהדור הנוכחי של "מודלי עולם" - מערכות AI שאמורות לחזות כיצד סצנה משתנה בעקבות פעולה, ונחשבות לבסיס חסר עבור סוכני AI אוטונומיים - מתעלם ממרכיב מרכזי אחד: מה קורה בראשם של האנשים המעורבים בסצנה. לפי החוקרים, מודלים קיימים כמו Sora, Genie 3, JEPA ו-Marble מדגמנים רק את השכבה הפיזית של העולם - עצמים, מיקומם, תנועה והסתרה - בעוד שמה שאנשים בתוך הסצנה מאמינים, רוצים, או תופסים כראוי מבחינה חברתית, אינו מיוצג במודל כלל. לגבי רובוטים בתחום השירות, עוזרים רפואיים, או סוכני AI שפועלים לצד בני אדם, ככל הנראה מדובר בפער משמעותי, שכן מצבים נפשיים נסתרים הם שמניעים ברובם התנהגות אנושית.

דוגמת הכוס

החוקרים ממחישים את הפער בדוגמה פשוטה: אם הכוס של מישהו מוזזת לתוך ארון בזמן שהוא לא מסתכל, הסצנה עצמה נראית תקינה מבחינת מודל פיזי טהור. אבל מודל כזה עדיין יחזה את הפעולה הבאה בצורה שגויה - כי רק מודל שעוקב גם אחרי מה שהאדם מאמין לגבי מיקום הכוס יכול להסביר מה הוא באמת יעשה בהמשך.

המסגרת: Mental World Modeling

המסגרת שהחוקרים מציעים, שנקראת Mental World Modeling (MWM) ופורסמה ב-GitHub, מרחיבה את מודלי העולם הקלאסיים במשתנים נפשיים: אמונות, קשב, מטרות, כוונות, רגשות, נורמות וקשרים חברתיים. הסוכן שנמצא בתוך הסצנה רואה רק תצוגה חלקית מנקודת מבטו שלו, בעוד שמודל העולם עצמו מחזיק את המצב המלא. כל פעולה מתפצלת לפי המסגרת לשני רכיבים: "נשא פיזי", כמו דיבור, הצבעה או אחיזה, ו"מטען נפשי", כמו ניחום, הטעיה או דחייה. אותה תנועה בדיוק - למשל, החלקת כוס על פני שולחן - יכולה להיות התנצלות, הטעיה, או מחווה של אכפתיות; רק המודל שמחזיק את המשתנים הנפשיים מבחין בין האפשרויות. החוקרים מדגישים שהם אינם טוענים לדמות תודעה: המצבים הנפשיים במסגרת הם השערות הנגזרות מהתנהגות והקשר, לא מדידות ישירות, ומערכות שנבנות על בסיס המסגרת אמורות לייצג אי-ודאות ולשמור על השערות שקופות.

MENTIS ומבחן ההערכה Menti-Bench

כדי לבחון את התיאוריה בנו החוקרים את MENTIS, צנרת (pipeline) מודולרית שאינה דורשת אימון נוסף, ומורכבת משישה שלבים: ניתוח הסצנה ורינדור נקודת המבט האישית; פיצול אפשרויות הפעולה לרכיבים פיזיים ונפשיים; סימולציה מקבילה של המצבים המתקבלים; דירוג כל ענף לפי שלושה קריטריונים - סבירות פיזית, עקביות נפשית והתאמה חברתית; ולבסוף קבלת החלטה דטרמיניסטית. כל שלב בתהליך מייצר תוצאת ביניים הניתנת לקריאה על ידי מכונה, כך שניתן לאתר שגיאות ולשייך אותן לשלב ספציפי.

לצורך ההערכה בנו החוקרים גם את Menti-Bench, מערך נתונים של 448 סצנות החלטה: 320 תיאורים טקסטואליים, 100 סיפורים מבוססי תמונות, ו-28 קטעי וידאו עם קול. בכל סצנה שש אפשרויות תגובה ופתרון ייחוס שנוצר על ידי בני אדם, המתעד לא רק את הפעולה הנכונה אלא גם את המצבים הנפשיים והפיזיים שביסודה. ב-78 אחוז מהסצנות מעורבות לפחות שתי דמויות.

לבחינת הביצועים בפועל בדק הצוות שמונה מודלי שפה - חמישה של OpenAI, ובהם GPT-5.6-Sol ו-GPT-4.1, ושלושה של Anthropic: Claude Fable 5, Claude Opus 4.8 ו-Claude Haiku 4.5 - כשמדד הדיוק המרכזי הוא ציון F1, המשלב בין דיוק (precision) לכיסוי (recall) של הפעולה שנבחרה. תוצאות ההשוואה המדויקות בין המודלים לא פורטו במקור הזמין. המשמעות הרחבה יותר של המחקר, ככל הנראה, היא שהוספת שכבת דוגמנות נפשית עשויה לשפר את היכולת של מערכות AI להבין ולחזות התנהגות אנושית מורכבת - יכולת קריטית לכל סוכן שאמור לפעול לצד בני אדם בעולם האמיתי.

פרסומת

→ לכל הכתבות