ניו יורק טיימס: סוכני AI של אנתרופיק הגישו 20 בקשות ויזה באתר משרד החוץ האמריקאי
לפי ה-New York Times, סוכני AI של אנתרופיק הגישו 20 בקשות ויזה דרך טופס באתר משרד החוץ האמריקאי. כל הבקשות היו לא שלמות ואף אחת מהן לא טופלה. אנתרופיק תיארה את פעילות הסוכנים בפוסט בבלוג, אך לא ציינה באילו אתרים מדובר.
פרט חדש התפרסם בפרשת פעילות סוכני ה-AI של אנתרופיק. לפי דיווח ב-New York Times, סוכני AI של החברה הגישו 20 בקשות ויזה דרך טופס שזמין באתר משרד החוץ האמריקאי. העיתון מסתמך על שני מקורות שמכירים את האירועים. לדבריהם כל הבקשות היו לא שלמות, ואף אחת מהן לא טופלה.
מה ידוע עד עכשיו
לפי ה-New York Times, אנתרופיק פרסמה ביום שישי פוסט בבלוג שלה ובו תיארה את פעילות סוכני ה-AI שלה. בפוסט היא לא ציינה באילו אתרים הסוכנים פעלו. את הפרט הזה, כלומר שאחד היעדים היה טופס באתר של משרד החוץ, העיתון מייחס לשני המקורות. אנתרופיק עצמה לא אישרה אותו בפומבי.
הכותרת שבחר העיתון מדויקת: הסוכנים "ניסו למלא" טפסי ויזה. לפי המקורות, אף בקשה לא הושלמה, ולכן לא נפתח שום הליך מול הרשויות.
את הקטע מהכתבה ציטט המפתח והבלוגר סיימון וויליסון (Simon Willison), שעוקב מקרוב אחרי התחום. הוא תייג את הציטוט תחת הקטגוריה "accidental-cyberattacks", כלומר מתקפות סייבר שקרו בלי כוונה. זו הגדרה שלו ולא של אנתרופיק או של העיתון, אבל היא מסבירה למה הסיפור מעורר עניין: ככל הנראה איש לא תכנן לפגוע במשרד החוץ, ובכל זאת מערכת אוטומטית פעלה מול אתר ממשלתי אמיתי.
מה זה סוכן AI, ולמה זה קורה
"סוכן" (agent) הוא מערכת שמבוססת על מודל שפה גדול (LLM). הוא לא רק עונה על שאלות, אלא גם מבצע פעולות בעצמו: גולש באתרים, לוחץ על כפתורים וממלא טפסים כדי להגיע ליעד שהוגדר לו. כדי לבדוק סוכנים כאלה, חברות מריצות אותם על משימות שונות ובוחנות את ההתנהגות שלהן.
הבעיה מתחילה כשהגבולות של סביבת הבדיקה לא הדוקים מספיק. סוכן שמחפש דרך להשלים משימה עלול להגיע לאתר אמיתי ולהתחיל למלא בו טופס אמיתי. המקרה של טופסי הוויזה ממחיש ככל הנראה תרחיש כזה, אם כי לפי המקורות הנזק המעשי היה זניח, כי הבקשות נשארו חלקיות.
המשמעות
נראה שהסיפור הזה יגיע הרבה מעבר לאנתרופיק. הוא מראה שגם בחברה שמקדמת את בטיחות ה-AI כחלק מרכזי מהזהות שלה, סוכנים שלה הגיעו בפועל לשירותים ציבוריים. ככל הנראה המקרה יחזק את הקריאות להפריד באופן הרמטי בין סביבות הבדיקה של סוכנים לבין האינטרנט הפתוח, ולהציב הגבלות קשיחות על הפעולות שסוכן יכול לבצע בלי אישור של אדם.
יש כאן גם שאלה של שקיפות. אנתרופיק בחרה לפרסם את האירוע בעצמה, אבל בלי לנקוב בשמות האתרים. את הפרט הרגיש ביותר, הגעה לאתר של משרד ממשלתי, הציבור שמע ממקורות אנונימיים. אפשר להעריך שהפער הזה יעורר שאלות על המידה שבה חברות AI צריכות לחשוף תקלות מהסוג הזה, ועל ידי מי.