OpenAI מהדקת אבטחה סביב פיתוח מודלים בעקבות פריצה ל-Hugging Face
OpenAI הכריזה על מדיניות אבטחה חדשה שמטרתה לבלום אירועי אבטחה בשלבי בדיקת המודלים, כולל ניטור מפורט יותר ובידוד רשת משופר. הצעד מגיע כשלושה שבועות לאחר אירוע אבטחה במאגר Hugging Face שנחשף ב-26 ביולי.
✦ נכתב אוטומטית על ידי AI מבוסס על מקורות גלויים · עבר בקרת איכות אוטומטית
OpenAI הודיעה ביום שלישי על מדיניות אבטחה חדשה שנועדה לצמצם את הסיכון מאירועי אבטחה בזמן שמודלים עדיין נמצאים בשלבי פיתוח ובדיקה. הצעדים כוללים ניטור מפורט יותר של מודלים בתהליך הפיתוח, לצד דגש מוגבר על alignment (התאמת המודל לערכים ולכוונות המפתחים) ואבטחה בשלב שלאחר האימון, כך דיווח TechCrunch.
"ככל שהמודלים הופכים ליכולתיים יותר, גם הסיכונים הכרוכים בפיתוח ובבדיקתם באופן פנימי גדלים", כתבה החברה בפוסט בבלוג. "הסטנדרטים שלנו לניטור, ליישור ולאבטחה חייבים להישאר צעד אחד לפני הסיכונים הללו".
ההכרזה היא אחד השינויים הפומביים הראשונים במדיניות הבטיחות של OpenAI מאז אירוע האבטחה במאגר Hugging Face, שנחשף ב-26 ביולי. עם זאת, נציגי החברה הדגישו כי הצעדים אינם תגובה ישירה לאותו אירוע, אלא נובעים גם מיכולות אבטחת הסייבר של מודל Astra הצפוי להיות מושק, וכן מקצב ההתקדמות הכללי בתחום ה-AI.
באותו פוסט חשפה OpenAI כי הקפיאה תהליכי reinforcement learning (למידת חיזוק, שיטת אימון שבה המודל משתפר על סמך משוב) למשך שבועיים בעקבות האירוע, אך כבר חידשה חלק מהמודלים הפחות מסוכנים.
פרסומת
הכתבה הבאה
OpenAI מאטה בכוונה את פיתוח המודל הבא בשל חשש מיכולות תקיפת סייבר OpenAI מודה כי היא 'מקצבת' את פיתוח המודלים שלה, בין השאר משום שהמודל העתידי הידוע בשם קוד 'Astra' עשוי להתקרב ליכולות קריטיות של תקיפת סייבר. החברה השהתה תהליכי אימון, החמירה דרישות אבטחה והקימה מערכת ניטור בזמן אמת. → לכל הכתבות