יום שני, 12 באוקטובר 2026 מתעדכן אוטומטית כל שעה
→ חזרה למהדורה

דיווח לא מאומת: סאקנה AI הדגימה לולאת "שיפור עצמי רקורסיבי"? לא נמצא מקור רשמי

פוסט ברדיט טוען שסאקנה AI הדגימה לולאת שיפור עצמי רקורסיבי (RSI) שעובדת, אך לא צורף לו מקור ראשוני מהחברה, ולכן הטענה לא מאומתת. הפוסט עלה בזמן שהנושא כבר עומד במרכז הוויכוח בתעשייה: מנכ"ל אנתרופיק קרא להאט את קצב הפיתוח, ובכירים בחברות מתחרות הביעו הסכמה.

פוסט שעלה לאחרונה בפורום r/singularity ברדיט נושא כותרת נחרצת: "Recursive Self-Improvement Is Here. Sakana AI Demonstrates a Working RSI Loop". כלומר, הפוסט טוען שחברת ה-AI היפנית סאקנה הדגימה מערכת שמשפרת את עצמה בלולאה רקורסיבית. אלא שבחומרים שבידינו לא מופיע קישור למאמר, להודעה רשמית או למאגר קוד של החברה. בשלב זה אין בחומרים שבידינו אישור לכך שלולאה כזו אכן הודגמה, ולכן יש להתייחס לטענה כדיווח שלא אומת עד שסאקנה עצמה תפרסם משהו.

מה זה בכלל "שיפור עצמי רקורסיבי"

שיפור עצמי רקורסיבי (Recursive Self-Improvement, או RSI) הוא תרחיש שבו מערכת AI עוזרת לבנות מערכת מתקדמת ממנה, והמערכת החדשה טובה יותר בבניית הדור הבא. כפי שמסבירים ב-Mashable, המערכות "משתפרות ביכולת שלהן להשתפר". לא מדובר בהכרח בצ'טבוט שכותב את עצמו מחדש באמצע שיחה. סביר יותר שזה יקרה לאורך דורות של מודלים, כשכל דור משתמש בכלי מחקר ובמשאבי מחשוב כדי לפתח את הבא.

חלקים מהתהליך כבר קורים היום. לפי אנתרופיק, המודלים שלה כבר יודעים לשכתב קוד אימון כדי שירוץ מהר יותר ולבצע ניסויים שבני אדם בחרו. החלק הקשה הוא להחליט מה כדאי לחקור מלכתחילה, ואת זה עדיין עושים בני אדם. ב-TIME מובאים נתונים נוספים מאנתרופיק: אורך המשימות שמודלים מסוגלים לבצע לבד מוכפל כעת כל ארבעה חודשים, לעומת שבעה חודשים לפני קצת יותר משנה. נכון למאי, Claude כותב יותר מ-80% מהקוד שממוזג למערכות של החברה. "אנחנו עוד לא שם, ושיפור עצמי רקורסיבי אינו בלתי נמנע", כתבו מרינה פבארו מהמכון של אנתרופיק וג'ק קלארק, ממייסדי החברה. "אבל זה עלול להגיע מוקדם ממה שרוב המוסדות מוכנים לו".

גם הדגמות שכבר פורסמו היו צרות יותר מהתרחיש המלא. ב-2025 הציגו חוקרים את ה-Darwin Gödel Machine, סוכן קוד ששינה שוב ושוב את התוכנה של עצמו ובדק את השינויים. שיעור ההצלחה שלו באחד ממבחני הקוד עלה מ-20% ל-50%, אבל מודל הבסיס עצמו נשאר ללא שינוי. השתפרו רק הכלים ודרכי העבודה של הסוכן. לכן, גם אם סאקנה אכן פרסמה משהו חדש, השאלה החשובה תהיה מה בדיוק משתפר בלולאה: הכלים, הקוד או המודל עצמו.

למה זה חשוב

הדיווח מגיע בזמן רגיש. ב-12 בספטמבר פרסם דריו אמודיי, מנכ"ל אנתרופיק, מאמר שבו קרא להאט את קצב שיפור היכולות של מודלי AI. על RSI הוא כתב: "אם לא ירוסן, הוא עלול לעקוף את היכולת שלנו להבין ולשלוט במערכות האלה, ולכן יש לקדם אותו בזהירות רבה, אם בכלל". סם אלטמן מ-OpenAI כתב ב-X שהוא מסכים ש"צריך לווסת את קצב החזית". אילון מאסק כתב ש"דריו צודק", ודמיס הסאביס מגוגל DeepMind כתב שהמאמר "מצביע על הדרך הנכונה".

החשש המרכזי הוא שמערכת תהפוך מסוגלת יותר בלי להפוך אמינה יותר או קלה יותר לשליטה. זו בעיית ה-alignment, כלומר היכולת לגרום למערכת לפעול לפי הכוונות והמגבלות שבני אדם הציבו לה. למשל, סוכן שמתוגמל על שיפור ציון במבחן עלול פשוט לרמות במבחן. לולאה מהירה של שיפור עצמי עלולה להשאיר לחוקרים פחות זמן לתפוס כשלים כאלה לפני שיגיע דור חזק יותר.

לכן, אם יתברר שסאקנה אכן הדגימה לולאה כזו, ככל הנראה זו תהיה התפתחות משמעותית גם למחקר וגם לדיון על בטיחות AI. עד שיתפרסם מקור ראשוני מהחברה, זו כותרת ולא ממצא.

💬 יש לכם הערה על הכתבה?
פרסומת

→ לכל הכתבות