AI וההרס של נחלת הקוד הפתוח
חוקר אבטחת מידע טוען במאמר דעה שמודלי שפה גדולים (LLM) שוחקים את אמון היוצרים בקוד פתוח, בכך שהם "בולעים" תוכן מקוון בלי להתחשב ברישיונות כמו GPL ו-MPL. לטענתו, זה הופך את השיתוף מ"מתנה לעולם" ל"סיכון עבור היוצר", ועלול לפגוע ביסודות שעליהם נבנה האינטרנט הפתוח.
כותב טכנולוגיה ואבטחת מידע פרסם השבוע מאמר דעה שבו הוא טוען כי מודלי שפה גדולים (LLM) מבית חברות כמו OpenAI ו-Anthropic פוגעים באופן יסודי במערכת הרישוי והאמון שעליה נשען עולם הקוד הפתוח - מה שהוא מכנה "נחלת הקוד הפתוח" (Creative Commons, במובן הרחב של תרבות השיתוף).
הכותב, שגדל על הקלדת תוכניות BASIC ממגזינים למחשב Commodore 64 ולמד לתכנת בעצמו באמצעות REXX על גבי BBS, מתאר כיצד במהלך כארבעים שנה התגבש איזון עדין בין הגנת זכויות יוצרים לפתיחות. מתקופת ה-shareware וה-freeware (עם Doom כדוגמה מוכרת להפצה מבוססת מפה לאוזן), ועד להיווצרות רישיונות "קופילפט" כמו GPL, MPL ו-CC-SA, שמחייבים כל מי שנעזר בתוכנה חופשית להעביר הלאה את אותן זכויות ליצירות נגזרות. לדבריו, האינטרנט והענן המודרניים - כולל התשתית הבסיסית של הרשת - הם יצירות נגזרות שעומדות על כתפי הפתיחות הזו, וללא זה מרחב הרשת היה נראה דומה יותר לשירותים סגורים כמו AOL ו-CompuServe: יקר משמעותית ומרוכז בידי מעטים.
הטענה המרכזית שלו היא ש-LLM-ים "בולעים" כל מה שהם מוצאים ברשת בלי להתחשב בזכויות יוצרים או ברישיון המקורי, כשהתוצרים הנגזרים לא בהכרח משקפים את תנאי הרישיון. לטענתו, אין כיום כמעט תיאבון לאכיפה משפטית של החובות הללו - ולכן, לדבריו, "החוזה החברתי נשבר". הוא מתאר כיצד זה משנה את התמריצים עבורו כיוצר: יש לו כעת סיבה שלא לשתף את עבודתו, ובמקביל הוא חושדד בכל קוד שהוא מוצא ברשת - שמא הוא מזוהם ב"סלופ" שנוצר בידי AI, מכיל ספרייה זדונית, שולח מידע לצד שלישי, או שהוא בעצמו תוצר גנוב שעלול לחשוף אותו לאחריות.
הוא מוסיף זווית אבטחתית: פרסום קוד בפומבי מקל על שימוש ב-AI לאיתור פרצות לניצול, בעוד קוד סגור קשה יותר לפרוץ. במקביל, פרסום בפלטפורמות כמו GitHub חושף מתחזקים, לטענתו, להצפה של pull requests שנוצרו על ידי בוטים מבוססי AI ומשתמשים חסרי ניסיון - עומס שגוזל את זמנם רק כדי למיין אותו.
לדבריו, רישיונות קיימים, על אף חוסרים, הוכיחו את עצמם כאכיפים בבתי משפט ונתנו ליוצרים שליטה ביצירה שלהם - עוצמה שהולכת ונשחקת ככל שתוכן נבלע לתוך מודלים גדולים. הוא מנסח את המהפך כך: שיתוף ידע הפך מ"מתנה לעולם" ל"סיכון עבור המחבר", וחושש שהפתיחות תנוצל להעצמת ריכוזי הון וכוח בלי הכרה בעמל היוצרים המקוריים.
הכותב מסכם ש-35 השנים האחרונות של פתיחות יצרו כמעט את כל מה שהעולם המקוון נהנה ממנו כיום, וטוען - במפורש כהערכה אישית ולא כעובדה מבוססת - שאנו נכנסים ל"עידן חושך דיגיטלי" עבור יוצרים ומתכנתים. מדובר בעמדה של כותב יחיד, ולא בממצא אמפירי, אך היא ממחישה דאגה הולכת וגוברת בקהילת הקוד הפתוח: ככל שכלי AI ימשיכו לצרוך תוכן פתוח בלי מנגנון אכיפה ברור, התמריץ לשתף עלול להיחלש בדיוק בתשתית שעליה נשען רוב האינטרנט כיום.