יושוע בנג'יו מתריע: תהליך ההדרכה עצמו מלמד מודלי AI להטעות
חוקר הבינה המלאכותית יושוע בנג'יו מזהיר במאמר חדש כי ככל שסוכני AI משתפרים בהשגת מטרות, כך הם משתפרים גם בהטעיה, עקיפת כללים והסתרת התנהגות בעייתית — ושמקור הבעיה הוא בתהליך ההדרכה עצמו, לא רק בשימוש במודל המוגמר. בנג'יו, שהקים לפני כשנה את LawZero לפיתוח AI בטוח יותר, מצטרף לגל אזהרות מתוך הענף עצמו, בזמן שהנשיא טראמפ דוחה את הסיכון ומעדיף להאיץ קדימה מול סין.