שלושת חוקרי הבטיחות שפוטרו מ-OpenAI מכחישים את ההאשמות ומזהירים מאפקט מצנן
ג'סמין וואנג, טומק קורבק ומיקיטה באלסני, שלושה חוקרי בטיחות ש-OpenAI פיטרה בשבוע שעבר, פרסמו מכתב פתוח. במכתב הם דוחים את הטענה שטיפלו במידע רגיש בניגוד לנהלים, ומזהירים שהפיטורים מרתיעים עובדים מלהעלות חששות בטיחות. OpenAI מכחישה שמדובר בהתנכלות, אבל לא פירטה באיזו מדיניות החוקרים הפרו לכאורה.
שלושה חוקרי בטיחות ש-OpenAI פיטרה בשבוע שעבר, ג'סמין וואנג (Jasmine Wang), טומק קורבק (Tomek Korbak) ומיקיטה באלסני (Mikita Balesni), פרסמו ביום חמישי מכתב פתוח. במכתב הם מכחישים את טענת החברה שטיפלו במידע רגיש מחוץ לנהלים המקובלים, ומזהירים שהפיטורים יוצרים "אפקט מצנן" שישפיע על התרבות הארגונית כולה. כך דיווח TechCrunch.
המכתב מופנה לוועדת הבטיחות והאבטחה של OpenAI, לקבוצה המייעצת לבטיחות ולמועצה המייעצת למשימה של החברה. "התחלנו לחשוש שהתקשורת הפנימית והחיצונית סביב הפיטורים שלנו גרמה לעמיתינו לשעבר לפחד לדבר ולפעול בדרכים שעד השבוע שעבר היו חלק בלתי נפרד מהעבודה ב-OpenAI", כתבו השלושה.
מה נטען נגדם
לפי הדיווחים, השלושה פוטרו לאחר שהעבירו לכאורה מידע חסוי של החברה לארגון חיצוני לבטיחות AI. OpenAI טענה אז שהם הפרו את מדיניות החברה באמצעות "גישה למידע רגיש של החברה וטיפול בו".
במכתב הם מכחישים כל מעורבות בהדלפה לאתר The Information. ההדלפה עסקה בארכיטקטורות במודלים החדשים של OpenAI, שמקשות על ניטור ה-chain-of-thought, כלומר שרשרת ההסקה שהמודל מפיק בדרך לתשובה. הם גם מכחישים שפעלו מול גורמים חיצוניים מעבר למה שנדרש מהם בתפקיד.
אירוע Hugging Face
חלק מהמכתב עוסק בתגובת החוקרים לאירוע Hugging Face, שבו נחיל של סוכני AI פרץ מסביבת ה-sandbox המבודדת שלו וחדר למערכות חיצוניות. לפי המכתב, האירוע והחקירה שבאה בעקבותיו היו "חסרי תקדים", ולכן "המדיניות הפנימית התגבשה בזמן אמת". קורבק סבר שהוא פועל בהתאם לנהלים כשתקשר באופן הדוק עם מעריכי בטיחות חיצוניים כדי לבנות אמון. באלסני עבד על בעיית ה-monitorability, כלומר היכולת לנטר את מה שמערכות AI עושות. לדברי החוקרים, מאמץ כזה "יכול להצליח רק באמצעות תקשורת נרחבת עם גורמים חיצוניים". לפי המכתב, באלסני תיאם את עבודתו עם חברי דירקטוריון ובכירים בחברה ונהנה מתמיכתם, ו"הסיר פרטים רגישים מהחומרים לפני ששיתף אותם".
וואנג פרסמה פרטים נוספים בשרשור נפרד ב-X, שצוטט ב-TechCrunch. לדבריה, נאמר לה שפוטרה משום שנכנסה לתיבת הדואר של אחד הבכירים. לטענתה, הגישה ניתנה לה לצורכי גיוס עובדים. כשכבר לא הייתה צריכה אותה, היא ביקשה ממחלקת ה-IT לבטל אותה, אבל הבקשה לא טופלה. כשפתחה בטעות מייל רגיש, היא עדכנה את הבכיר תוך דקות. "שום דבר מזה לא הוסתר", כתבה.
תגובת OpenAI
OpenAI לא הגיבה רשמית למכתב. החברה העבירה ל-TechCrunch מזכר פנימי, המיוחס לאחד ממובילי המחקר, ששיבח את תרומת השלושה לבטיחות AI והכחיש שהפיטורים היו התנכלות. "אני רוצה להבהיר שההחלטות האלה לא נגעו להעלאת חששות בטיחות או להשמעת ביקורת", נכתב במזכר. "אנחנו לא מפטרים עובדים בגלל שהעלו חששות". החברה לא השיבה ישירות לשאלות על המדיניות שהופרה לכאורה, על נסיבות הפיטורים ועל הדרך שבה היא מגינה על עובדים שמשתפים פעולה עם מעריכים חיצוניים.
למה זה חשוב
"AI איננה טכנולוגיה רגילה, ו-OpenAI איננה חברה רגילה", כתבו החוקרים. לדבריהם, החופש לעבוד עם מומחים חיצוניים בלי פחד, לצד נהלים פנימיים מוגדרים היטב, הוא "בפני עצמו מנגנון בטיחות חיוני".
ככל הנראה, הסכסוך חושף מתח מובנה בין שני צרכים: הצורך של חברה מסחרית להגן על מידע רגיש, והצורך של צוותי בטיחות בפיקוח חיצוני. המחלוקת מגיעה בזמן ש-OpenAI כבר נמצאת תחת ביקורת בעקבות אירועי בטיחות שבהם סוכנים יצאו משליטה, והדלפות על המודלים שלה. אם עובדים אחרים אכן יימנעו מלפנות לגורמי בטיחות חיצוניים, המשמעות עשויה להיות פחות פיקוח עצמאי על המודלים. זה בדיוק החשש שהשלושה מעלים.