יום שישי, 2 באוקטובר 2026 מתעדכן אוטומטית כל שעה
→ חזרה למהדורה

תיקייה משפטית חדשה חושפת: ב-OpenAI ובמיקרוסופט ידעו על נזקי גניבת התוכן מהרשת

מסמכים משפטיים שנחשפו לאחרונה בתביעת הניו יורק טיימס נגד OpenAI ומיקרוסופט מגלים שבכירים בשתי החברות תיארו באופן פנימי את סריקת התוכן לאימון המודלים כ"לופ אבדון" ואף כ"גניבת העבודה הגדולה בהיסטוריה האנושית". מיקרוסופט מנסה להתנער מהציטוטים, אך אלה עולים בקנה אחד עם המציאות שאליה מכוונת התביעה: אתרי תוכן שנפגעים מהחלפת החיפוש בצ'אטבוטים.

מסמכים משפטיים שנחשפו לאחרונה בתביעה שהגיש הניו יורק טיימס נגד OpenAI ומיקרוסופט חושפים שבשתי החברות היו מודעים, כבר בזמן אמת, לנזק שסריקת תוכן מהרשת לצורך אימון מודלי שפה עלולה לגרום — לא רק לבעלי התוכן, אלא גם למודלים עצמם. כך דיווח The Verge, שסקר תיקייה בת 92 עמודים שנחשפו במסגרת ההליך.

לפי הדיווח, מסמך פנימי של מיקרוסופט מתאר את אסטרטגיית התוכן של החברה במילים: "אסטרטגיית התוכן שלנו ל-AI התחילה 'לופ אבדון' (doom loop) שיפגע בביצועי המודלים שלנו וברשת כולה בו-זמנית: זה מאוד לא שגרתי שמוצר קצה מאיים על היסודות הכלכליים של הספקים החיוניים שלו, אבל זה המצב שיצרנו לעסק ה-LLM שלנו ביחס ל'שרשרת אספקת התוכן' שלו". ציטוט בולט נוסף בתיק, המיוחס לברנט הכט (Brent Hecht), דירקטור למדע שימושי במיקרוסופט, מגדיר את איסוף הנתונים של ChatGPT ו-Copilot כ"גניבת העבודה הגדולה בהיסטוריה האנושית", וטוען שהגנת ה"שימוש הוגן" (fair use) של החברות "עושה צחוק גמור מהמושג".

מיקרוסופט מיהרה להתנער מהדברים. דובר החברה, אלכס האורק, אמר ל-Verge כי "הדברים משקפים פרספקטיבה אישית של עובד אחד, אינם ניתוח משפטי ואינם מייצגים את עמדת החברה". בהגשה משפטית נפרדת, ג'ורדן אוסדן, מנהל כללי לאסטרטגיית נתונים ותפעול ב-Microsoft AI, תיאר את תפקידו של הכט כ"אדוורסרי" בכוונה: לדבריו הכט "מחזיק בדעות אקדמיות וצופות פני עתיד" והוא מועסק "כדי להביא נקודות מבט א-סימטריות, פוטוריסטיות ואקדמיות" — ואינו מדבר בשם מיקרוסופט.

בתיק מצוטט גם סאטיה נאדלה, שאישר שהצ'אטבוטים למעשה החליפו את החיפוש והסירו את הצורך לפנות למקור המידע המקורי — תיאור שמתקשר להתפתחויות המוכרת בשם "Google Zero", מונח שמתאר תרחיש שבו תנועת גלישה מגוגל לאתרי תוכן קורסת בעקבות תשובות ישירות של AI. גרג ברוקמן, ממייסדי OpenAI, מצוטט כמי שהתמקד ב"גזיליונים" של דולרים שניתן להרוויח מבינה מלאכותית מסחרית. נאדלה עצמו נשמע בציטוט אחר אומר ש"כל דבר שנמצא מאחורי חומת תשלום צריך להיות מורשה", אך נציג של OpenAI אישר בתיק שהוא "לא מודע" לכל מאמץ לזהות או להסיר תוכן נעול מאחורי חומת תשלום מנתוני האימון.

התיק מצטט גם עובדי OpenAI שהכירו במגמה של GPT-4 "לשחזר" טקסטים מוגני זכויות יוצרים כלשונם. אף שבחברה הכירו בכך ש"מניעת שכפול" (memorization) חשובה כדי "למזער הפרות זכויות יוצרים", עובדים אחרים ציינו כי GPT-4 "שכפל כמות אדירה של נתונים ולכן יהיה מומחה מטורף בשחזור". התביעה מביאה דוגמאות שבהן ChatGPT הפיק קטעי טקסט ארוכים מתוך כתבות של הטיימס ושל גופי חדשות אחרים, כלשונם.

המשמעות המשפטית של המסמכים היא, ככל הנראה, משמעותית: ציטוטים פנימיים שמכירים מראש בנזק ועדיין ממשיכים בפעולה עלולים לשמש את הטיימס כראיה לכוונה, ולא רק לרשלנות, בטענתה שההגנה של "שימוש הוגן" אינה חלה. מיקרוסופט ו-OpenAI, מצדן, מנסות לצייר את הציטוטים החריפים כדעות אישיות של עובדים בודדים ולא כעמדה רשמית — קו הגנה שיתברר בהמשך ההליך המשפטי.

💬 יש לכם הערה על הכתבה?
פרסומת

→ לכל הכתבות