יום שישי, 2 באוקטובר 2026 מתעדכן אוטומטית כל שעה
→ חזרה למהדורה

Grok 4.7 של xAI: מחיר נמוך, ביצועים בינוניים מול Claude ו-GPT

xAI השיקה את Grok 4.7, הדגם המתקדם ביותר שלה עד כה לכתיבת קוד ולמשימות ידע, במחיר נמוך משמעותית ממתחרים מערביים. אלא שמבחני ביצועים עצמאיים מציבים אותו הרחק מאחורי Claude Fable 5.1 ו-GPT-6, בעיקר במשימות קוד אוטונומיות.

חברת xAI של אילון מאסק השיקה את Grok 4.7, לדבריה הדגם היכולתי ביותר שפיתחה עד כה למשימות כתיבת קוד וידע. לפי הדיווח באתר The Decoder, הדגם נבנה על בסיס מודל גדול יותר, אומן בתהליך למידת חיזוק (reinforcement learning) ארוך יותר, ותוכנן — כך לפי החברה — לבדוק את הפלט של עצמו ביתר דיוק.

המחיר שנקבע לדגם נמוך במיוחד: 2 דולר למיליון טוקנים בקלט ו-6 דולר למיליון טוקנים בפלט. מדובר בתעריפים הקרובים יותר למחירי מודלים סיניים מאשר למחירי מודלי הדגל המערביים, וכפי שמציין הדיווח, כנראה לא בכדי.

פער בביצועים

במדד המשולב Artificial Analysis Intelligence Index (גרסה 4.3.2), המשלב עשרה מבחני ביצועים שונים, Grok 4.7 קיבל ציון 46 ומוקם באמצע הטבלה — הרחק מאחורי Claude Fable 5.1 ו-GPT-6, ששני אלה הובילו בציון 53 כל אחד. לפי הנתונים, שתי רמות ההיסק (reasoning) הגבוהות ביותר של הדגם מניבות תוצאות דומות זו לזו, כך שההשקעה החישובית הנוספת בהיסק המורכב יותר לא הניבה שיפור ניכר.

הפער מתרחב עוד יותר במשימות קוד אוטונומיות (agentic coding). במבחן Terminal-Bench 4.0 השיג Grok 4.7 26 אחוזים בלבד, לעומת 60 אחוזים ל-GPT-6 Astra ו-55 אחוזים ל-Claude Fable 5.1. אפילו הדגם הזול יותר DeepSeek V4.1 Flash הציג תוצאה טובה יותר, 27 אחוזים. הדגם זמין כעת דרך ה-API של Grok, וכן דרך הכלים Cursor ו-Grok Build.

למה זה קרה: פער בכוח חישוב?

חלק מההסבר האפשרי לפער נמצא בנתוני כוח חישוב (compute) שפרסם מכון המחקר Epoch AI. לפי כלי המעקב AI Chip Users Explorer של Epoch, שמעריך את כמות שבבי ה-AI שבשימוש חמש מעבדות המחקר המובילות בעולם, נכון לסוף 2025 עמד כוח החישוב המוערך של OpenAI על כ-1.74 מיליון "יחידות H100 שוות ערך" (H100e), ושל Google DeepMind על כ-1.58 מיליון. לפי אותה הערכה, שבה טווחי אי-הוודאות רחבים למדי, מעבדת xAI-SpaceX (המכונה במחקר "SpaceXAI") מוצגת עם כוח חישוב משוער של כ-615 אלף H100e בלבד — הנמוך מבין החמש. ייתכן שזהו אחד ההסברים למחיר הנמוך ולביצועים החלשים יחסית של Grok 4.7, שכן פחות כוח חישוב עשוי להגביל הן את גודל האימון והן את משך תהליך הלמידה. חשוב להדגיש: מדובר בהערכה חיצונית עם רף אי-ודאות משמעותי, ולא בנתון שפרסמה xAI עצמה.

המשמעות

השילוב של מחיר נמוך וביצועים חלשים ממקם את Grok 4.7 בעמדה תחרותית מורכבת: מצד אחד הוא מתחרה על מחיר מול מודלים סיניים זולים כמו DeepSeek, ומצד שני הוא עדיין רחוק מהביצועים של Claude ו-GPT בדיוק בתחום שבו xAI טענה לשיפור — כתיבת קוד. ככל הנראה, האסטרטגיה של xAI בשלב זה מתמקדת בנגישות מחיר ולא בהובלה טכנולוגית, מה שעשוי למשוך משתמשים רגישי-עלות אך להקשות על מיצוב הדגם מול המתחרים בפרויקטים תובעניים יותר.

💬 יש לכם הערה על הכתבה?
פרסומת

→ לכל הכתבות