יום שני, 24 באוגוסט 2026 מתעדכן אוטומטית כל שעה

כל מה שחם בעולם הבינה המלאכותית · בעברית

📚 בית הספר ל-AI ✈️ הצטרפו לערוץ הטלגרם

מחקר Pew: יותר משליש מדפי האינטרנט שפורסמו מאז ChatGPT נכתבו בעזרת AI

מחקר של Pew Research Center שבדק כמעט חצי מיליון דפי אינטרנט מצא כי יותר משליש מהדפים שפורסמו מאז השקת ChatGPT מכילים סימנים לכתיבה בעזרת AI, כאשר אתרים מסחריים חשופים לתופעה פי עשרה יותר מאתרי חינוך וממשל. לצד הממצא, החוקרים מזהירים כי כלי הזיהוי הקיימים עדיין מתקשים להבחין בין טקסט אוטומטי לחלוטין לבין טקסט שרק ליטש בעזרת AI.

מרכז המחקר Pew Research Center מצא כי יותר משליש מדפי האינטרנט שפורסמו מאז השקת ChatGPT מכילים סימנים לטקסט שנכתב, כולו או בחלקו, בעזרת בינה מלאכותית. הממצא עולה מניתוח של כמעט חצי מיליון דפי אינטרנט באנגלית.

החוקרים עבדו עם דפים מתוך ארכיון האינטרנט Common Crawl, ובדקו אותם באמצעות כלי הזיהוי Open Pangram, שמנסה להעריך אם טקסט נכתב על ידי אדם או מכונה. בדגימה מיולי 2026, כ-10% מכלל הדפים שנבדקו הראו סימנים ברורים לכתיבה על ידי AI. אבל כשסיננו החוקרים את המדגם ובחנו רק דפים שפורסמו אחרי השקת ChatGPT בסוף 2022, התמונה השתנתה: יותר משליש מהדפים החדשים הראו סימני AI, ולפי הניתוח המגמה עולה בהתמדה מאז.

הפער בין סוגי אתרים בולט. כ-10% מהדפים בדומיין .com הראו סימני AI, לעומת 4.6% בדומיין .org, ורק כ-1% בדומייני .edu ו-.gov. כלומר אתרים מסחריים חשופים בערך פי עשרה יותר לטקסט שנכתב בעזרת AI בהשוואה לאתרי מוסדות חינוך וממשל.

הניתוח גם מצא שינויים בשימוש בשפה שהפכו נפוצים יותר ברשת מאז 2023: מקף ארוך (em dash) מופיע היום פי שניים בערך לעומת 2023, ושימוש בפסיק אוקספורד עלה ב-63%. מילים ה"אהובות" על מודלים כמו delve, interplay, testament, pivotal, landscape, tapestry, bolstered, crucial, meticulous ו-vibrant הכפילו את תדירות הופעתן. גם התבנית "זה לא רק X, זה Y" נעשתה שכיחה כמעט פי שלושה, אם כי בהיקפים מוחלטים היא עדיין נדירה; מחקר נפרד שבדק מסמכי יחסי ציבור מצא שהתבנית הזו הופיעה פי ארבעה יותר לעומת 2022.

הממצאים של Pew מצטרפים למחקר קודם, מאפריל 2026, של אימפריאל קולג' לונדון, Internet Archive ואוניברסיטת סטנפורד, שמצא כי כ-35% מכלל האתרים החדשים שפורסמו ברשת נכתבו כולם או בחלקם בעזרת AI. אותו מחקר גם זיהה דמיון סמנטי גבוה יותר ב-33% בין טקסטים שנכתבו על ידי AI, וטון חיובי יותר בכללותם, אך החוקרים הזהירו שהתפיסה הציבורית לגבי ההשפעות השליליות של התופעה חורגת לעיתים קרובות מעבר למה שהנתונים בפועל תומכים בו.

עם זאת, למחקר יש מגבלה מרכזית: כלי הזיהוי הקיימים, כולל Open Pangram, מתקשים להבחין בין טקסט שנכתב באופן אוטומטי לחלוטין לבין טקסט שאדם כתב וליטש בעזרת AI, או כזה שבו המודל תרם רק כמה משפטים. הגבול בין הקטגוריות הללו נשאר מטושטש, מה שאומר שהנתח המדויק של תוכן "אוטומטי לגמרי" עשוי להיות שונה מהתמונה שהמספרים מציגים.

המשמעות: ההיקף המהיר של טקסט שנכתב בעזרת AI ברשת, בעיקר באתרים מסחריים, מעלה שאלות לגבי מהימנות המידע שמשתמשים נתקלים בו יומיום, וככל הנראה יחייב כלי חיפוש ומנועי בינה מלאכותית להתמודד עם כמות גדלה והולכת של תוכן שמקורו אינו אנושי בלבד.

פרסומת

→ לכל הכתבות