OpenAI: מאות עובדי חוזה קוראים את שיחות ה-ChatGPT שלך - וזה קורה כברירת מחדל
לפי חקירה של 404 Media, OpenAI מעסיקה מאות עובדי חוזה שקוראים שיחות אמיתיות של משתמשי ChatGPT כדי לדרג ולשפר את תשובות המודל, כאשר לפי אחד המעריכים משתמשים רבים כלל לא מודעים לכך. ההגדרה שמאפשרת את הקריאה האנושית מופעלת כברירת מחדל, וכיבוי שלה דורש פעולה יזומה ואינו חל רטרואקטיבית. הנוהג אינו ייחודי ל-OpenAI - גם Anthropic וגוגל משתמשות במעריכים אנושיים לבדיקת שיחות.
לפי חקירה של האתר 404 Media, המבוססת על מסמכים פנימיים שדלפו ושיחות עם גורמים נוספים, OpenAI מעסיקה מאות עובדי חוזה שקוראים שיחות אמיתיות של משתמשי ChatGPT כחלק מתהליך שיפור הצ'אטבוט. הפרטים דווחו בthe-decoder.com, המצטט את חקירת 404 Media.
העובדים מדרגים את תשובות ChatGPT בסולם של אחד עד שבע, ותפקידם המוצהר הוא לצמצם חנופה יתרה (flattery) והתנהגות "אנושית מדי" בפלט של המודל. אחד המעריכים סיפר ל-404 Media שלדעתו המשתמשים אינם יודעים שבני אדם קוראים את השיחות שלהם. הטענה מתחזקת מתוך התוכן שנבדק בפועל: חלק מהשיחות שהגיעו לעיון כללו בקשות מפורשות של משתמשים מ-ChatGPT לשמור את התוכן חסוי. השיחות המגיעות למעריכים אנונימיות, אך עדיין עלולות להכיל מידע אישי רגיש. OpenAI משתמשת במסנן פרטיות לצורך כך, אך מודה שהוא עלול לטעות.
המעריכים מגויסים דרך חברת הגיוס Crossing Hurdles ומקבלים שכר דרך חברת האימון Mercor. מעריך אחד, המבוסס בצפון אמריקה, מסר שהוא מרוויח למעלה מ-50 דולר לשעה.
למשתמשים יש אפשרות לכבות את ההגדרה "Improve the model for everyone" (שיפור המודל עבור כולם), המופעלת כברירת מחדל, כדי למנוע שימוש בשיחותיהם לאימון המודל - ומכאן גם את החשיפה לעיון אנושי. אלא שההגדרה חלה רק על שיחות חדשות; שיחות שכבר התקיימו אינן מוגנות רטרואקטיבית. OpenAI מציעה גם מצב "temporary chat" שלפי החברה אינו משמש לאימון המודל.
כשעיתונאי 404 Media שאלו את OpenAI היכן בדיוק משתמשים מקבלים גילוי מפורש על קריאה אנושית, החברה לא הגיבה בתחילה. בדף שאלות ותשובות (FAQ) החברה אכן מציינת שגורמים מורשים וספקי שירות עשויים לצפות בנתוני משתמשים כדי לשפר את ביצועי המודל, וממליצה שלא להזין מידע רגיש. אלא שההודעה הזו מופיעה באתר החברה לפחות מאז 2023, ורק השתנתה במעט לאורך השנים.
404 Media טוענת שהגילוי הזה קבור מדי ומעורפל מדי כדי שמשתמשים יבינו בפועל את היקף הקריאה האנושית המתבצעת. גם הניסוח "שיפור המודל עבור כולם" נשמע יותר כמו תרומה קהילתית ידידותית מאשר הסכמה לכך שבני אדם יקראו את השיחות. ככל הנראה מדובר בניסוח מעורפל במתכוון: אילו OpenAI הייתה מבקשת הסכמה מפורשת וברורה יותר, שיעור המשתמשים שהיו בוחרים לצאת מהתכנית עשוי היה להיות גבוה משמעותית - בעוד שמשוב אנושי מסוג זה נחשב מרכיב מרכזי בתהליך שיפור המודלים עבור חברות בינה מלאכותית.
הנוהג הזה אינו ייחודי ל-OpenAI. Anthropic אישרה ל-404 Media שהיא משתמשת במעריכים אנושיים לבדיקת תשובות של Claude ולשיפור מודלים עתידיים, כאשר הדבר חל על משתמשים שהפעילו את ההגדרה "Help improve our AI models" בהגדרות הפרטיות שלהם. בשונה מ-OpenAI, Anthropic מציינת שהיא מסירה פרטי חשבון כמו כתובות אימייל מהשיחות לפני שהן מגיעות לעיון אנושי. גם גוגל משתמשת במעריכים אנושיים, ומציינת בג'מיני שבני אדם עשויים לעיין בשיחות שמורות.