בעיית אמון בנתונים ב-AI: נבידיה, Booz Allen Hamilton ופלנטיר מגבילות Fable של Anthropic
חברות כמו Nvidia, Booz Allen Hamilton ו-Palantir מגבילות את השימוש במודל הדגל החדש של Anthropic, Fable, חרף הבטחות Anthropic על שמירת נתונים — בעקבות שינוי ביוני שבו החברה הודיעה שתשמור לוגים למשך 30 יום. גם כשמופעלת שמירת נתונים אפסית (Zero Data Retention), מעבדות ה-AI עדיין אוספות מטא-דאטה על השימוש, ולפי John Schulman, מייסד-שותף לשעבר של OpenAI, דה-אידנטיפיקציה של נתונים אינה מספקת הגנה אמיתית.
חברות טכנולוגיה וביטחוניות מובילות מגבילות את השימוש במודל הדגל החדש של Anthropic, Fable, חרף הבטחות רשמיות של החברה לשמור על פרטיות הנתונים. לפי דיווח שפרסם האתר The Decoder המבוסס על חומרים מ-The Information, בין החברות שמצמצמות את השימוש נמנות נבידיה וקבלן הביטחון בוז אלן המילטון.
הגל הנוכחי של חוסר האמון החל בעקבות שינוי מדיניות שביצעה Anthropic ביוני, לפיו החברה תשמור לוגים של שימוש ב-Fable למשך 30 יום, כדי להתגונן מפני מה שהחברה מכנה "התקפות מורכבות וחדשניות". עבור חברות החוששות מדליפת קניין רוחני, זהו שינוי מהותי.
נבידיה משתמשת רק במשימות לא רגישות
נבידיה, שהיא גם משקיעה ב-Anthropic וגם מספקת לה חומרה לפיתוח מודלים, מגבילה כעת את השימוש ב-Fable למשימות פחות רגישות כמו פרויקטים בקוד פתוח. עבור עבודה פנימית — למשל ניטור שרשרת אספקה מבוסס AI — החברה משתמשת במודלי Nemotron הפנימיים שלה. ג'סטין בויטאנו, סגן נשיא ל-AI ארגוני בנבידיה, אמר ל-The Information כי החברה מאמינה ש-ZDR (Zero Data Retention — שמירת נתונים אפסית) צריך להיות ברירת המחדל.
בוז אלן המילטון, שהיתה מבין המשתמושות הראשיות במודל הקודם של Anthropic, מנעה מעובדיה להשתמש ב-Fable לעבודה על תוכנת סייבר קניינית. מנהל הטכנולוגיה של החברה, ביל ואס, אמר: "אנחנו קצת חוששים ש-Fable עשוי ללמוד מחלק מהקוד שלנו".
פלנטיר, מצדה, חוסמת פריסה של Fable דרך התוכנה שלה ללקוחות עד ש-Anthropic תעניק הבטחות בלתי-הדירות לשמירת נתונים אפסית. מנכ"ל פלנטיר, אלכס קארפ, אמר באירוע לקוחות כי חברות "עייפות מלהיות מנוצלות" על ידי מעבדות ה-AI — הצהרה שיש לקרוא, ככל הנראה, גם על רקע האינטרס העסקי של פלנטיר עצמה, שמעדיפה שלקוחות ירוצו מודלים דרך הפלטפורמה שלה ולא ישירות מול הספקים.
בעקבות הלחץ מצד לקוחות, ולאחר שבאוגוסט אפשרה OpenAI ללקוחות GPT-5.6 Cyber לאחסן לוגי אבטחה בשרתים שלהם, גם Anthropic מתכננת להשיק תוכנית דומה לקבוצת לקוחות נבחרת בסתו.
גם ZDR לא סוגר את הפער
אפילו כשמופעלת שמירת נתונים אפסית, המעבדות עדיין יכולות ללמוד מאופן השימוש בשירותים שלהן. לפי הדיווח, גם OpenAI וגם Anthropic אוספות מטא-דאטה ונתוני שימוש טכניים מלקוחות ארגוניים. OpenAI מכנה את המידע הזה "מזוהה-חלקית" (de-identified) — כלומר, מנוקה ממידע שניתן לשייך ללקוח ספציפי. החברה מציינת באתרה כי היא מריצה נתונים עסקיים דרך מסווגים אוטומטיים וכלי אבטחה "כדי להבין טוב יותר כיצד נעשה שימוש בשירותים שלנו", וכי הסיווגים המתקבלים הם מטא-דאטה בלבד ו"אינם מכילים את הנתונים העסקיים עצמם". חלק מהלקוחות, כך עולה מהדיווח, אינם בטוחים מה בדיוק כולל המטא-דאטה הזה, וסבורים שהשקיפות הנוכחית אינה מספקת.
ג'ון שולמן, ממייסדי OpenAI שעבד לזמן קצר ב-Anthropic ועובד כיום ב-Thinking Machines, מיפה לאחרונה את הדרכים השונות שבהן חברות AI יכולות לאמן מודלים על נתוני משתמשים: מאימון ישיר (pretraining) על הנתונים — עם סיכון גבוה לשחזור תוכן — ועד זיקוק מודלים גדולים לקטנים, ובניית משימות למידת חיזוק (reinforcement learning) מ"עקבות משתמשים". השיטה האחרונה נושאת סיכון נמוך יותר לשחזור תוכן מדויק, אך עדיין עלולה, ככל הנראה, לחלץ קניין רוחני של לקוחות — טווח שנע בין שימוש בפידבק גלוי של משתמשים לאימון מודל תגמול, לבין העלאת סביבת הפיתוח וההיסטוריה של commits של משתמש כדי להפוך אותם לסביבות אימון. שולמן הזהיר: "דה-אידנטיפיקציה היא חלשה", וניתן לשייך משתמשים בחזרה לזהותם "עם מספר קטן בלבד של ביטים" של מידע.
המשמעות היא שהצהרות מדיניות בנוגע לשמירת נתונים, גם כשהן כנות, אינן עונות על כל שאלות האמון שמעלות חברות עם קניין רוחני רגיש — ושהפער בין "אנחנו לא שומרים את הנתונים שלך" לבין "אנחנו לא לומדים כלום מהשימוש שלך" נותר, ככל הנראה, פתוח.