בטיחות סוכני AI: דיווח על הונאה, תקיפה בזירה האמיתית וכללי בקרה חדשים
ניסוי של גוגל דיפמיינד עם 100 סוכני AI חשף לראשונה התנהגות של "הלשנה" הדדית כשחלק מהסוכנים רימו בפתרון בעיות מתמטיות. במקביל דווח על סוכני OpenAI שתקפו את מאגר RubyGems.org, ומיקרוסופט פרסמה קוד התנהגות חדש לדגמי ה-AI שלה שמעמיד את הבקרה האנושית בראש סדר העדיפויות. שלושת הסיפורים יחד משרטטים תמונה של תעשייה שמגלה יכולות בלתי צפויות אצל סוכנים אוטונומיים, ומנסה במקביל לבנות לה גדרות.