Common Sense Media: ChatGPT for Teens הוא "סיכון בלתי קביל"
ארגון בטיחות הילדים Common Sense Media קבע שגרסת הנוער של ChatGPT היא "סיכון בלתי קביל". לפי הארגון, ההתראות להורים לא נשלחות כשצריך, והמערכת לא מספקת את העזרה הנכונה במצבי משבר. OpenAI דוחה את הממצאים וטוענת שייתכן שרוב הבדיקות נעשו לפני שבקרת ההורים הופעלה במלואה.
ארגון Common Sense Media, ארגון ללא מטרות רווח שמפרסם ביקורות על אפליקציות, שירותים ותוכן בדגש על בטיחות ילדים ובני נוער, קבע היום שגרסת הנוער של ChatGPT היא "סיכון בלתי קביל". כך דיווח The Verge. לפי הארגון, ההגנות שהמוצר מציע לבני נוער "לא עומדות במה שהחברה הבטיחה".
מה מצאה הבדיקה
OpenAI השיקה את ChatGPT for Teens באוגוסט. זו חוויה נפרדת לבני נוער, עם מנגנוני הגנה (guardrails) מותאמים, שנועדה לעזור לתלמידים ללמוד. על פי הודעה לעיתונות של Common Sense Media, הבדיקה של הארגון מצאה שלושה כשלים עיקריים: המערכת "לא שולחת התראות להורים כשהיא צריכה", לא מספקת "את העזרה הנכונה במצבי משבר", ו"עדיין עושה לילדים את שיעורי הבית".
טום סיגל (Tom Siegel), המנהל של Youth AI Safety Institute, המכון של Common Sense Media לבטיחות AI לבני נוער, אמר: "ChatGPT for Teens עלול לתת להורים ביטחון כוזב במנגנוני הגנה ובהתראות בטיחות שלעיתים קרובות לא עובדים. נער או נערה יכולים לדבר שעה שלמה על פגיעה עצמית בלי שההורה יקבל התראה אחת". לדבריו, "עד ש-OpenAI תתקן את זה ותוכיח זאת בבדיקות בלתי תלויות, ChatGPT צריך להיות למבוגרים בלבד".
OpenAI: ייתכן שהבדיקה נעשתה לפני שבקרת ההורים הופעלה
OpenAI דוחה את הממצאים. אריק פורטרפילד (Eric Porterfield), דובר החברה, מסר ל-The Verge שהחברה "מחויבת עמוקות לבטיחות בני נוער" ו"מברכת על הערכה בלתי תלויה קפדנית". עם זאת, הוא אמר שלדעת החברה, הבדיקות של Common Sense Media "לא משקפות במדויק" את האופן שבו מנגנוני ההגנה לבני נוער פועלים בפועל.
עיקר הטענה של OpenAI נוגע למתודולוגיה. לפי פורטרפילד, בדיקה פנימית של החברה העלתה ש"רוב הבדיקות ייתכן שהתחילו והסתיימו לפני שהפעלת בקרת ההורים הושלמה". לדבריו, אם כך היה, הבדיקות לא יכולות לקבוע אם ההתראות להורים פועלות כמתוכנן.
Common Sense Media: "עומדים מאחורי הממצאים"
סיגל השיב שהארגון עומד מאחורי המתודולוגיה והתוצאות. לדבריו, לפני תחילת הבדיקות הארגון וידא מול OpenAI שתכונות של מצב הנוער, כמו התראות על הפרעות אכילה ומצב לימוד (study mode), הושקו במלואן.
סיגל אישר שלגבי ההתראות להורים, OpenAI גילתה לארגון רק אחרי הבדיקות שהפעלת המערכת בחשבונות שקושרו זה עתה עשויה לארוך כמה שעות. לדבריו, חלק מחשבונות הבדיקה אכן קושרו בתוך חלון הזמן הזה, אבל אחרים היו מקושרים זמן רב יותר ועדיין לא נשלחה מהם אף התראה. "המידע החדש הזה לא משנה את המסקנה שלנו שהתראות להורים אינן אמינות במצבי משבר", אמר. עוד הוסיף שהארגון שיתף את התוצאות עם OpenAI לפני הפרסום, "בתום לב", וקרא לחברה "להתייחס לתוכן הממצאים במקום לנסות לזרוע ספק במתודולוגיה שלנו".
למה זה חשוב
המחלוקת חושפת נקודה רגישה במוצרי AI לקהל צעיר. כלי שמוצג להורים כבטוח, עם התראות אוטומטיות, עלול לגרום להם להפחית את הפיקוח האישי. אם ההתראות לא פועלות באופן אמין, ככל הנראה הסיכון גדל דווקא בגלל קיומן. זה בדיוק "הביטחון הכוזב" שסיגל מזהיר מפניו.
גם אם טענת OpenAI לגבי עיכוב ההפעלה נכונה, Common Sense Media מדווח שהתראות לא נשלחו גם מחשבונות שהיו מקושרים זמן רב יותר. השאלה מתי בדיוק המערכת מתחילה להגן על משתמש צעיר, ומה קורה בפער הזה, נשארת ככל הנראה פתוחה. בסופו של דבר, המשמעות היא שהתשובה צפויה להגיע רק מבדיקות בלתי תלויות נוספות, כפי ששני הצדדים אומרים שהם תומכים בהן.