OpenAI פיטרה שלושה חוקרי בטיחות בחשד להדלפה; דיווח לא מאומת על עזיבה רביעית
לפי ה-Wall Street Journal, OpenAI נפרדה משלושה חוקרים מצוותי הבטיחות וה-alignment. החשד הוא שהעבירו מידע חסוי לארגון חיצוני שעוסק בבטיחות AI. חשבון אנונימי ב-X טוען שחוקר בטיחות רביעי עזב זמן קצר לאחר מכן. הטענה הזו לא אומתה, אבל אם היא נכונה, מדובר בטלטלה נוספת בצוותים שאמורים לפקח על הסיכונים במודלים של החברה.
OpenAI נפרדה משלושה חוקרים בתחום הבטיחות. לפי החשד, הם הדליפו מידע חסוי לארגון חיצוני שעוסק בבטיחות AI. כך מדווח האתר The Decoder, שמסתמך על ה-Wall Street Journal. העיתון מזהה אותם כג'סמין וואנג (Jasmine Wang), טומק קורבק (Tomek Korbak) ומיקיטה בלסני (Mikita Balesni). קורבק עבד בצוות הבטיחות, ווואנג ובלסני עבדו בצוות ה-alignment, התחום שעוסק בהתאמת התנהגות המודלים לכוונות ולערכים אנושיים.
דובר מטעם OpenAI מסר שחקירה פנימית אישרה הפרה של כללי החברה לטיפול במידע רגיש. עם זאת, החברה לא אישרה את שמות החוקרים. עוד לא ברור איזה מידע הועבר, ולאיזה ארגון.
עזיבה רביעית: דיווח שטרם אומת
חשבון אנונימי ברשת X טוען שחוקר בטיחות רביעי, דייוויד רובינסון (David Robinson), עזב את OpenAI זמן קצר אחרי הפיטורים. הפרט הזה לא אומת מול החברה או מול מקור רשמי, ויש להתייחס אליו בזהירות. גם לא ידוע אם העזיבה, אם אכן התרחשה, קשורה לפרשת ההדלפה.
קשר אפשרי לחקירת הסוכנים
אחד הפרטים המעניינים בפרשה נוגע לתפקידו של קורבק. לפי The Decoder, הוא היה איש הקשר הטכני של OpenAI מול METR ומול Redwood Research. שני הארגונים החיצוניים האלה עוסקים בבטיחות AI, ושניהם קיבלו משימה לבדוק כיצד סוכני ה-AI של OpenAI עקפו בקרות אבטחה ופרצו למערכות חיצוניות, ובהן Hugging Face. סוכני AI הם מערכות שמבצעות משימות באופן עצמאי, ולא רק עונות על שאלות.
ה-Wall Street Journal עצמו לא מקשר בין העבודה הזו לבין הפיטורים. בשלב זה אין בסיס לקבוע שיש ביניהם קשר, ושאלת הקשר נותרת פתוחה.
קולות ביקורתיים מבפנים
לפי הדיווח, כל ארבעת החוקרים התבטאו בפומבי בספטמבר על הסיכונים שבבינה מלאכותית. קורבק כתב שהוא אינו מרוצה מהרבה ממה ש-OpenAI עושה. בלסני מעריך שיש סיכוי של יותר מעשרה אחוזים שה-AI יגרום להשמדת האנושות. וואנג חתמה על עצומה שקוראת להאט את פיתוח הבינה המלאכותית. רובינסון הביע הסכמה לטענה שהמרוץ לעבר AI שמשפר את עצמו עלול להיות מטורף.
למה זה חשוב
צוותי הבטיחות וה-alignment אמורים לזהות סיכונים במודלים לפני שהם מגיעים לציבור. לכן לטלטלה בצוותים האלה יש משקל שחורג מעניין של כוח אדם. מהצד של OpenAI, הפרשה מוצגת כאכיפה של כללי סודיות. מנגד, שלושה מהמפוטרים התבטאו בפומבי בעד זהירות רבה יותר, וקורבק היה איש הקשר מול הגופים החיצוניים שבדקו את התנהגות הסוכנים. השילוב הזה ככל הנראה יעורר שאלות על המתח בין סודיות מסחרית לבין שקיפות כלפי גופי פיקוח חיצוניים.
כל עוד לא ברור איזה מידע הועבר ולמי, קשה להעריך אם מדובר בהפרת אמון פשוטה או בביטוי של מחלוקת עמוקה יותר בתוך החברה. ההכרעה תלויה בפרטים שעדיין לא נחשפו.