מנכ״ל OpenAI סאם אלטמן התייחס לדיווחים על השהיית תהליכי אימון מבוססי reinforcement learning (RL) בחברה, וטען כי ההתקדמות של המודלים מהירה כיום באופן חריג. לדבריו, החברה התחייבה מראש לפעול אם תחוש שהיכולות עוקפות את קצב הבטיחות וה-alignment.
סאם אלטמן, מנכ״ל OpenAI, פרסם הסבר קצר לדיווחים שלפיהם החברה עצרה או האטה תהליכי אימון מבוססי reinforcement learning (RL) — שיטת אימון שבה מודל שפה משפר את עצמו בהדרגה על בסיס משוב על ביצועיו. בציוץ שפורסם ב-X (המקור המקורי, כפי שצוטט ב-Reddit), כתב אלטמן: "Model progress is now extremely rapid, and we always said we would take action if we felt that model capabilities were outstripping the pace of safety and alignment" ("קצב ההתקדמות של המודלים מהיר במיוחד כעת, ותמיד אמרנו שנפעל אם נרגיש שהיכולות של המודלים עוקפות את קצב הבטיחות וה-alignment").
מה עומד מאחורי ההשהיה
על פי דיווחים, השהיית אימוני ה-RL ב-OpenAI כבר נדונה ברשת, והציוץ של אלטמן מספק נימוק מפיו לצעד: קצב השיפור ביכולות המודלים החדשים גבוה מהרגיל, עד כדי כך שהחברה בחרה, לפי דבריו, להאט את קצב האימון כדי לוודא שמנגנוני הבטיחות וה-alignment (התאמת התנהגות המודל לכוונות ולערכים אנושיים) לא נשארים מאחור.
מונח ה-alignment מתייחס לתהליך שבו מפתחי מודלים מנסים לוודא שהמערכת פועלת בהתאם לכוונות המשתמשים והחברה, ולא מפתחת התנהגויות בלתי צפויות או מסוכנות ככל שהיא נעשית מסוגלת יותר. reinforcement learning, מצדו, הוא אחד הכלים המרכזיים שבהם משתמשות חברות כמו OpenAI לחידוד יכולות המודל לאחר שלב האימון הראשוני, ולעיתים גם לשיפור יכולות נימוק (reasoning) מורכבות.
למה זה מעניין
ההצהרה של אלטמן ניתנת לקריאה כאישור פומבי לכך שבתוך OpenAI קיים מתח מובנה בין קצב פיתוח היכולות לבין קצב פיתוח מנגנוני הבטיחות הנלווים אליהן. החברה, שמתחרה בשוק שבו גם Google, Anthropic ואחרות משיקות מודלים בקצב גבוה, בחרה לפי דבריו להאט את עצמה מרצון בשלב הנוכחי.
הניסוח של אלטמן — "תמיד אמרנו שנפעל" — מרמז כי מדובר במדיניות שהוצהרה בעבר, לא בצעד אד-הוק. עם זאת, בציוץ עצמו אין פירוט לגבי משך ההשהיה, היקפה המדויק (האם מדובר בכלל אימוני ה-RL של החברה או בפרויקט ספציפי), או לוח הזמנים לחידושה. בהיעדר פרטים נוספים ממקור רשמי, לא ניתן לקבוע כרגע האם מדובר בעצירה זמנית קצרה או במהלך ארוך טווח יותר.
האמירה מצטרפת לשורת הצהרות דומות שהשמיעו בעבר בכירים בתעשיית ה-AI, ולפיהן קצב ההתקדמות הטכנולוגית מציב אתגר מתמשך לצוותי הבטיחות שאמורים לבחון את המודלים לפני ואחרי שחרורם לציבור.