מטא ממשיכה במרוץ המחירים: Muse Spark 1.3 מוזל מהמתחרים, הדגם הרביעי בחמישה חודשים
מטא השיקה את Muse Spark 1.3, הדגם הרביעי שלה מאז אפריל, עם שיפור בולט במשימות אוטונומיות (agentic) אך פער שנשאר מול המתחרים המובילים. הכרטיס המנצח של הדגם הוא המחיר — הזול ביותר בקטגוריית הביצועים שלו, אף שהוא יקר יותר מקודמו.
✦ נכתב אוטומטית על ידי AIמבוסס על מקורות גלויים · עבר בקרת איכות אוטומטית
מטא הציגה את Muse Spark 1.3, הדגם הרביעי בסדרה מאז השקתה באפריל — אחרי גרסה 1.1 ביולי ו-1.2 באוגוסט. הדגם זמין דרך Muse Code וממשק ה-API של מטא, כאשר רמת "xhigh" פעילה כבר עכשיו, ורמת "max" העוצמתית יותר נמצאת בשלב תצוגה מוקדמת מוגבלת לשותפים, בהמתנה לבדיקות בטיחות נוספות, כך על פי The Decoder, המסתמך על נתוני חברת הבנצ'מרקינג Artificial Analysis.
שיפור במשימות אוטונומיות, פער שנשאר
בציון ה-Intelligence Index הכולל, רמת ה-max מקבלת 62 נקודות ורמת ה-xhigh 61 — עלייה מ-57 באוגוסט ו-53 ביולי. העלייה נובעת בעיקר משלושה מבחנים שמקבלים משקל גבוה במדד: GDPval-AA v2 (20%), Terminal-Bench 2.1 (16%) ו-τ³-Bench Banking (14%) — ובדיוק שם מטא רשמה את הקפיצות הגדולות ביותר.
במבחן τ³-Banking, שבוחן סוכני AI המפעילים כלים בתרחיש בנקאות מדומה, רמת ה-max מגיעה ל-52% — המקום הראשון כרגע לפי Artificial Analysis, וההובלה היחידה שהדגם מחזיק בה. רמת ה-xhigh הזמינה כיום מגיעה ל-47%, בשוויון עם Claude Fable 5.1 (רמת max) ועם GLM-5.3-Flash, לעומת 35% בגרסה 1.2. במבחן Terminal-Bench 2.1, הבודק תכנות בסביבת מסוף, הדגם משתפר מ-80% ל-85% ברמת xhigh ול-86% ברמת max — אך Claude Fable 5.1 עדיין מוביל עם 91.4%. גם ב-GDPval-AA v2, שמודד ביצועים מול מומחי אנוש על פני 220 משימות מקצועיות אמיתיות, מטא משתפרת (מ-1,615 ל-1,754 ב-max) אך נשארת מתחת ל-1,853 של Claude Fable 5.1. חשוב לציין: רמת ה-max משיגה את היתרון הזה תוך צריכת 62% יותר "טוקני חשיבה" מרמת ה-xhigh.
מחוץ למבחנים האוטונומיים התמונה פחות חדה: ב-GPQA Diamond (שאלות מדע ברמת מומחים) הדגם עולה מ-90% ל-94%, אך עדיין מתחת ל-Gemini 3.8 Flash ו-Grok 4.6. ב-CritPt, מבחן בפיזיקה מחקרית, הקפיצה מ-18% ל-26% משאירה פער גדול מול GPT-5.6 Sol ו-Claude Fable 5.1. שני ציונים אף ירדו לעומת 1.2: AA-LCR צנח מ-83% ל-79%, ובמבחן האמינות העובדתית AA-Omniscience נרשמה ירידה של עד שלוש נקודות — ככל הנראה משום שהדגם נמנע לעיתים קרובות יותר ממתן תשובה כשאינו בטוח בה.
הכרטיס המנצח: המחיר
מטא לא שינתה את תעריפי ה-API — 1.25 דולר למיליון טוקני קלט ו-4.25 דולר למיליון טוקני פלט — כך שמשימה בודדת במדד עולה כ-0.55 דולר. אף דגם שמקבל 59 נקודות ומעלה זול יותר; מתחרים באותה רמת ביצועים נעים בין 0.94 ל-1.23 דולר למשימה. יחד עם זאת, 1.3 יקרה יותר מקודמתה — גרסה 1.2 היתה 0.40 דולר למשימה. מטא ו-Artificial Analysis טרם פרסמו מחיר לרמת ה-max, ולפי ההודעה צפויים בהמשך גם דגמים גדולים יותר וגרסת open source.
המשמעות
השחרור המהיר — דגם רביעי תוך חמישה חודשים — יחד עם מדיניות תמחור אגרסיבית, מרמז ככל הנראה שמטא בוחרת להתחרות קודם כול על נגישות ומחיר ולא רק על ביצועי שיא, אסטרטגיה שמזכירה את מרוץ המחירים שכבר התרחש בשוק המודלים הסיניים. העובדה שהמחיר עצמו עלה בין 1.2 ל-1.3 — למרות שהדגם עדיין "הזול ביותר בקטגוריה" שלו — מרמזת שהלחץ בין שיפור יכולות לבין שמירה על תמחור נמוך עלול, בטווח הארוך, להכביד על מרווחי הרווחיות של מטא בתחום המודלים, אף שהחברה לא פרסמה נתונים פיננסיים שיאששו זאת ישירות.