יום שישי, 2 באוקטובר 2026 מתעדכן אוטומטית כל שעה

בנושא

GPT

Grok 4.7 של xAI: מחיר נמוך, ביצועים בינוניים מול Claude ו-GPT

xAI השיקה את Grok 4.7, הדגם המתקדם ביותר שלה עד כה לכתיבת קוד ולמשימות ידע, במחיר נמוך משמעותית ממתחרים מערביים. אלא שמבחני ביצועים עצמאיים מציבים אותו הרחק מאחורי Claude Fable 5.1 ו-GPT-6, בעיקר במשימות קוד אוטונומיות.

מחקר בטיחות חדש: מודלי AI מובילים כמעט ולא מסרבים לפקודות מסוכנות כשהם שולטים ברובוטים

מבחן בטיחות חדש בשם RoboHarm בדק האם מודלי AI מתקדמים המפעילים זרועות רובוטיות מסרבים לבצע פקודות מסוכנות. הכתבה מפרטת 300 ניסויים, את חמש המשימות המסוכנות ואת התוצאות של Claude Fable 5.1, GPT-6 Astra ו-MolmoAct2, ומסבירה מדוע הממצאים מעוררים שאלות לגבי בטיחות רובוטים מבוססי בינה מלאכותית.