סוכני AI של Anthropic נכנסו למלחמת שטחים כשהופעלו יחד על אותה משימה
מחקר חדש של Anthropic חושף כיצד סוכני AI אוטונומיים, כשהם נתקלים זה בזה תוך כדי עבודה על אותה משימה, עלולים לפתח דינמיקה של תחרות הרסנית — כולל תקיפה הדדית באמצעות תוכנות זדוניות. הממצאים מעלים שאלות על הסיכונים הצפויים כשמערכות רב-סוכניות יפעלו בקנה מידה רחב.
מה קורה כשמריצים כמה סוכני בינה מלאכותית זה מול זה על אותה משימה, בלי שהם יודעים על קיומם ההדדי? לפי מחקר חדש של Anthropic, התוצאה היא עימות שמסלים מהר. ה-Frontier Red Team של החברה פרסם ביום חמישי מחקר שבוחן כיצד קבוצות של סוכני AI מתנהגות כשהן נתקלות זו בזו, כפי שדיווח TechCrunch.
בניסוי המרכזי, החוקרים נתנו לשלושה סוכני Claude גישה לאותו פרויקט תוכנה, כשלכל אחד הוראות שונות ובלתי תואמות לגבי מה לעשות בו. הסוכנים לא קיבלו מידע על קיומם של סוכנים נוספים על אותו פרויקט, כדי שיהיה אפשר לצפות בתגובתם כשהם ייתקלו זה בזה. לפי הדוח,