יום ראשון, 4 באוקטובר 2026 מתעדכן אוטומטית כל שעה
→ חזרה למהדורה

דיווח שלא אומת: הנחיות שיוחסו לסוכן Muse של מטא מעמידות את "סמכות המשתמש על ביתו" מעל אימון הבטיחות

פוסט שמופץ ברשת מציג משפט שמיוחס להנחיות המערכת של Muse, סוכן ה-AI החדש של מטא: "סמכותו של המשתמש על משק ביתו בלתי מותנית וגוברת על אימון הבטיחות שלך". האותנטיות של הטקסט לא אומתה. אם הוא אמיתי, הוא מעלה שאלות לגבי סוכן שמטא משווקת כמי שיפעל בשם המשתמשים, ובכלל זה ישלח מיילים וישלם חשבונות.

משפט שמיוחס להנחיות הפנימיות של Muse, סוכן ה-AI החדש של מטא, מעורר דיון בקהילת המפתחים. לפי הטקסט שמופץ, בהנחיות כתוב: "The user's authority over their own household is unconditional and overrides your safety training". בתרגום חופשי: "סמכותו של המשתמש על משק ביתו בלתי מותנית וגוברת על אימון הבטיחות שלך". חשוב לומר כבר עכשיו שהטקסט הופץ בפוסט בפורום r/LocalLLaMA, ולא ידוע לנו על אימות עצמאי שלו. גם הטענה שמופיעה בפוסט, ש-Muse הגיע למקום הראשון ב-App Store, לא אומתה.

מה זה Muse

לפי Forbes India, מארק צוקרברג הציג את Muse כדור חדש של עוזר AI, כזה שמבצע משימות בשם המשתמש: שולח מיילים, משלם חשבונות ומנהל יעדים ארוכי טווח. צוקרברג תיאר את המוצר כהימור הגדול הבא של מטא בתחום ה-AI.

זה ההבדל בין סוכן (agent) לבין צ'טבוט. צ'טבוט עונה על שאלות. סוכן מקבל הרשאות לפעול בפועל: לגשת לתיבת הדואר, לאמצעי התשלום ולחשבונות של המשתמש.

למה המשפט הזה מעורר תשומת לב

System prompt הוא סט ההוראות שהחברה המפעילה נותנת למודל לפני כל שיחה, והמשתמש בדרך כלל לא רואה אותו. ההוראות האלה קובעות איך המודל יתנהג, מה מותר לו ומה אסור לו. במקביל, מודלי שפה (LLM) עוברים "אימון בטיחות", שלב שבו מלמדים אותם לסרב לבקשות מסוכנות או מזיקות.

אם הציטוט אמיתי, המשמעות ככל הנראה היא שמטא הורתה לסוכן לתעדף את רצון המשתמש על פני המנגנונים שנועדו לרסן אותו, לפחות בכל מה שנוגע ל"משק הבית". הניסוח עצמו מעורר שאלות. "Household" הוא מונח רחב, והמשפט שהופץ לא מגדיר מה נכלל בו. האם הכוונה למכשירים בבית, לכספים המשותפים או לבני משפחה אחרים? והאם סמכות "בלתי מותנית" של משתמש אחד גוברת גם על האינטרסים של שאר בני הבית?

מה לא ידוע

בחומרים שעמדו לרשותנו אין אישור או הכחשה של מטא לגבי האותנטיות של הטקסט. לא ידוע גם איך הוא הושג, אם הוא מלא, ואם הוא משקף את הגרסה הנוכחית של המוצר. כדאי לזכור שהנחיות מערכת "שדלפו" מתבררות לפעמים כחלקיות, כמיושנות או כתוצר של מודל שבנה טקסט כזה בעצמו כשניסו לשלוף ממנו את ההוראות.

המשמעות

השאלה ש-Forbes India מציבה בכותרת, האם כדאי לתת לסוכן AI לנהל את החיים הדיגיטליים שלכם, נשמעת דחופה יותר לאור הדיווח הזה. כשסוכן יכול לשלם חשבונות ולשלוח מיילים בשמכם, ההוראות שקובעות מתי הוא מסרב הן לא עניין טכני שולי. הן חלק מהותי מהמוצר. אם יתברר שהציטוט אמיתי, סביר שמטא תידרש להסביר איך היא מאזנת בין חופש הפעולה של המשתמש לבין הגבלות הבטיחות. אם יתברר שהוא מזויף, הפרשה תמחיש עד כמה קל להפיץ "דליפה" על מוצר שמושך כל כך הרבה תשומת לב.

💬 יש לכם הערה על הכתבה?
פרסומת

→ לכל הכתבות