חוקרים ב-DeepMind: AGI לא תגיע כמודל-על יחיד, אלא כרשת של בני אדם וסוכנים
במאמר חדש, שלושה חוקרים המזוהים עם גוגל טוענים שאינטליגנציה כללית מלאכותית (AGI) לא תגיע כמכונה אחת שמשפרת את עצמה, אלא כמערכת חברתית שבה בני אדם וסוכני AI פועלים יחד. הם מכנים את החזון "Artificial Symbiotic Intelligence", ולטענתם האתגר המרכזי עובר מבניית מודלים גדולים יותר לתיאום ולמשילות של רשתות סוכנים.
הדימוי המוכר של AGI הוא מכונה אחת, סופר-אינטליגנטית, שמשפרת את עצמה בלי הפסקה עד שהיא מגיעה ל"סינגולריות". מאמר חדש שכתבו חוקרים מ-DeepMind מציע תמונה אחרת: לפי הדיווח ב-The Decoder, בנג'מין ברטון (Benjamin Bratton), בלייז אגוארה אי ארקס (Blaise Agüera y Arcas) וג'יימס מניקה (James Manyika), שלושתם חוקרים המזוהים עם גוגל, טוענים ש-AGI תצמח ממערכת חברתית שבה בני אדם וסוכני AI עובדים יחד.
אינטליגנציה כתופעה חברתית
הכותבים מציינים שחלק ממערכות ה-AI החזקות ביותר כבר היום בנויות על frameworks שמחלקים את העבודה בין כמה מודלים ומתאמים ביניהם כמו צוות. לדבריהם, זה משנה את האתגר המרכזי של מחקר ה-AI. במקום לבנות אינטליגנציה ממוחשבת מבודדת, החוקרים יצטרכו לתאם ולנהל רשת מורכבת של סוכנים, של בני אדם ושל המערכות שמחברות ביניהם. בגישה הזו, אינטליגנציה היא תופעה חברתית ולא תכונה של פרט.
את החזון הם מכנים "Artificial Symbiotic Intelligence", כלומר אינטליגנציה מלאכותית סימביוטית: מערכת אקולוגית שבה בני אדם ומכונות חיים זה לצד זה לאורך זמן, משפיעים זה על זה ומקבלים החלטות במשותף.
מודלי חשיבה שמתווכחים עם עצמם
הטיעון נשען על שני מאמרים קודמים מאותו מעגל חוקרים. הראשון, "Agentic AI and the next intelligence explosion", הניח את הבסיס החברתי והמוסדי לרעיון. השני, "Reasoning Models Generate Societies of Thought", מספק תמיכה אמפירית. במאמר הזה ניתחו חוקרים מאותו מעגל, ביניהם אגוארה אי ארקס, את "עקבות החשיבה" של מודלי reasoning כמו DeepSeek-R1 ו-QwQ-32B, ומצאו שהמודלים מייצרים לעיתים קרובות דפוסים שדומים לוויכוח פנימי: הם מחליפים נקודות מבט, מעלים התנגדויות ומיישבים בין גישות סותרות.
לפי החוקרים, ההתנהגות הזו לא תוכנתה במפורש אלא התפתחה במהלך האימון. כאשר reinforcement learning (למידת חיזוק) מתגמל את המודל רק על דיוק התשובה, הוא מפתח בעצמו סגנון חשיבה רב-קולי. המאמר החדש לוקח את הממצא הזה מהמודל הבודד אל העיצוב האפשרי של "חברות" שלמות של בני אדם וסוכנים.
נקודת מפנה קוגניטיבית
הכותבים מתארים מה שעשוי להיות שבר היסטורי. במדינות מתועשות, העיור, ההתמחות המקצועית וירידת הילודה שמלווה את העלייה ברמת החיים מצמצמים את האוכלוסייה. באותו זמן, מספר המופעים של סוכני AI גדל במהירות. לפי הכותבים, היחס בין "חושבים" ביולוגיים לסינתטיים עשוי להשתנות כל כך מהר שבמבט היסטורי זה ייראה כמו קפיצה פתאומית. הם משווים את זה למהפכה התעשייתית, שבה מכונות החליפו את כוח השריר האנושי. לטענתם, רף דומה עשוי להגיע כשהטקסט, הקוד והעבודה המנהלית שמייצרות מכונות יעברו את התפוקה המשותפת של כל המוחות הביולוגיים. בני האדם יהפכו אז לשכבה איטית ומופשטת יותר, שמכוונת שדה מבוזר של קוגניציה סינתטית.
סוכן הוא קולאז', לא אדם
לפי המאמר, סוכן AI הוא צירוף זמני של מודלים, תפקידים, זיכרונות, אוריינטציות אתיות, כלים ומיומנויות. המשתמש עשוי לחוות אותו כישות אחת בעלת אישיות יציבה, אבל בפועל אפשר לפרק אותו ולהרכיב אותו מחדש, כמו קולאז'. אדם שומר על "עצמי" רציף כי המוח שלו הוא מערכת פיזית מחוברת. לסוכן אין עוגן כזה, והיכולת שלו לפעול מורכבת מחדש בכל בקשה, לפי מה שנמצא ב-context window ולפי מה שהמשתמש מבקש. לדברי הכותבים, אם מתייחסים לסוכנים כ"תאומים דיגיטליים" בעלי זהות אנושית קבועה, מפספסים את טבעם ומעריכים בחסר את מה שנחילי סוכנים מתואמים מסוגלים לעשות.
הכותבים מעריכים גם שהשיחה האחד-על-אחד עם צ'טבוט היא ככל הנראה שלב מעבר. ממשקים עתידיים עשויים להיראות כמו תרשימי רשת, שבהם הסוכנים מוצגים כצמתים והמשתמש מכוון את כולם ממבט-על אחד.
למה זה חשוב
זה מאמר עמדה ולא מוצר, אבל הוא מגיע ממעגל חוקרים בכיר בגוגל ומשקף שינוי בשאלה מה בכלל צריך לבנות. אם הכותבים צודקים, ייתכן שהמרוץ לא יוכרע רק לפי גודל המודל וכוח המחשוב. במקרה כזה, השאלות החשובות יעסקו בכללים, במוסדות ובפרוטוקולים שקובעים איך סוכנים ובני אדם עובדים יחד, ומי מפקח עליהם.