דיווח: עובדים ראשונים באנתרופיק בחנו רכישת קרקעות מבודדות כתוכנית מילוט ליום הדין
לפי תחקיר של הוול סטריט ג'ורנל, עובדים ראשונים באנתרופיק, החברה שמפתחת את Claude, בחנו רכישת קרקעות מבודדות בארצות הברית למקרה שה-AI ייצא משליטה. הדיווח מצביע על כך שהחשש מתרחישים קטסטרופליים קיים גם בתוך החברות שמובילות את הפיתוח, בזמן שהמירוץ ביניהן נמשך.
חלק מהאנשים שבונים את מערכות הבינה המלאכותית המתקדמות בעולם חוששים מהן מספיק כדי להיערך לתרחיש הגרוע ביותר. לפי תחקיר של ה"וול סטריט ג'ורנל", שעליו דיווח ynet, עובדים ראשונים באנתרופיק, החברה שמפתחת את Claude, בחנו רכישת קרקעות מבודדות בארצות הברית. לפי הדיווח, הקרקעות נועדו לשמש תוכנית מילוט למקרה שהטכנולוגיה תצא משליטה ותפגע באנושות.
השורשים: אלטרואיזם אפקטיבי
לפי התחקיר, את תרבות הבטיחות של אנתרופיק עיצבה במידה רבה תנועת "האלטרואיזם האפקטיבי" (Effective Altruism). זו פילוסופיה שמודדת עשיית טוב בכלים כמותיים, ומייחסת משקל חריג למניעת סיכונים קיומיים למין האנושי בעתיד הרחוק.
אנתרופיק הוקמה ב-2021 בידי עובדים שעזבו את OpenAI, ובראשם האחים דריו ודניאלה אמודיי. לפי הדיווח, הפרישה נבעה מחילוקי דעות עמוקים על קצב הפיתוח ועל יחסה של OpenAI לבטיחות. המייסדים הושפעו מאוד מרעיונות האלטרואיזם האפקטיבי. התנועה זכתה בעבר לביקורת ציבורית גם בגלל קשריה לסם בנקמן-פריד, מייסד בורסת הקריפטו FTX שקרסה.
החברה ניסתה לבדל את עצמה כאלטרנטיבה ממוקדת-בטיחות. היא כתבה מסמכי עקרונות אתיים באורך של עשרות אלפי מילים ופיתחה גישה שנקראת "בינה מלאכותית חוקתית" (Constitutional AI). המטרה של הגישה היא לגרום למודל לדבוק בנורמות מוסריות גם במצבים שלא הוגדרו לו מראש.
הפרדוקס של מעבדת הבטיחות
כאן נמצא המתח המרכזי שהדיווח מצביע עליו. אנתרופיק רוצה להוביל בבטיחות ולהשפיע על כיוון התעשייה, ולכן היא צריכה לבנות בעצמה מודלים חזקים ומהירים יותר. ככל הנראה, בכך היא גם מאיצה את אותו מירוץ שמעורר חרדה אצל חלק מעובדיה. המשמעות היא שגם בחברה שהציבה את הסיכון במרכז הזהות שלה, החשש מקטסטרופה לא עצר את התחרות.
לפי הדיווח, באירופה כבר נקבעו מסגרות פיקוח על חברות שמפתחות "מודלי חזית" (frontier models), כולל חובות דיווח ובקרת סיכונים. ההנחה שמאחוריהן היא שאי אפשר להסתמך רק על האתיקה הוולונטרית של חברות פרטיות. בסין, חברות כמו באידו ועליבאבא פועלות לפי הנחיות השלטון. שם "בטיחות" מתמקדת ביציבות שלטונית ובצנזורה, ופחות בתרחישי אפוקליפסה.
גם אנבידיה נכנסת לתמונה
במקביל, אנבידיה השיקה את Open Agent Safety Platform. זו פלטפורמת תוכנה שנועדה לאפשר למפתחים להגדיר גבולות קשיחים סביב סוכני AI אוטונומיים, כלומר תוכנות שמבצעות משימות באופן עצמאי, ולמנוע מהם לחרוג מגבולות אלה. ההשקה מגיעה אחרי תקופה שבה בכירי תעשיית ה-AI האמריקאית, ובהם מנכ"ל אנבידיה ג'נסן הואנג, נפגשו עם הנשיא דונלד טראמפ בבית הלבן.
למה זה חשוב
דיונים על "סיכון קיומי" מ-AI נשמעים לרוב בכנסים ובמאמרים. הדיווח הנוכחי מתאר משהו מוחשי יותר: אנשים מבפנים ששקלו צעדים פיזיים של היערכות. אין בכך הוכחה שהתרחיש הקטסטרופלי צפוי. עם זאת, הדיווח מחדד שאלה שהציבור והרגולטורים יתקשו להתעלם ממנה: אם חלק מהאנשים שקרובים ביותר לטכנולוגיה מתייחסים לסיכון ברצינות כזו, האם מסמכי עקרונות פנימיים והתחייבויות וולונטריות מספיקים? הוויכוח בין פיקוח מחייב, כמו באירופה, לבין פיקוח עצמי של התעשייה צפוי ככל הנראה להחריף.