אנתרופיק משיקה את Claude Haiku 5.5: מודל קטן וזול יותר שמכוון לשוק של GPT-6 Luna
אנתרופיק השיקה את Claude Haiku 5.5, מודל קטן שמיועד למשימות בהיקף גבוה ורגישות לעלות. לפי החברה, הפעלתו זולה בכ-75% בממוצע מזו של Haiku 4.5, והוא עוקף את GPT-6 Luna של OpenAI ברוב מבחני הביצועים שפרסמה. במקביל, החברה מוזילה גם את Sonnet 5.5.
אנתרופיק השיקה את Claude Haiku 5.5, הדור החדש של משפחת המודלים הקטנים והזולים שלה. לפי החברה, זהו המודל הקטן "הזול, המהיר והמוכשר ביותר" שהוציאה עד היום. בממוצע, הפעלתו עולה כ-75% פחות מזו של קודמו, Haiku 4.5. במבחני הביצועים שפרסמה אנתרופיק בעצמה, המודל החדש מקדים את GPT-6 Luna, המודל הקטן של OpenAI, ברוב המדדים.
למה הוא מיועד
Haiku 5.5 נבנה למשימות שרצות בכמויות גדולות ושבהן העלות קובעת: סיכומים, דחיסת הקשר, שאילתות למסדי נתונים וסיווג בקשות. אנתרופיק מציעה גם לשלב אותו כ-subagent, כלומר סוכן משנה שמבצע חלקים מהעבודה, לצד המודלים הגדולים Opus 5.5 ו-Sonnet 5.5 במשימות קוד. מכיוון שזה המודל המהיר ביותר של החברה, היא ממליצה עליו גם לתמיכת לקוחות בזמן אמת ולהפעלת דפדפן באופן אוטומטי.
חידוש נוסף: זה המודל הראשון במשפחת Haiku שיש בו הגדרת "מאמץ" (effort). המשתמש בוחר כמה "לחשוב" על כל משימה, וכך מאזן בעצמו בין עלות לאיכות התשובה.
המספרים
לפי הנתונים של אנתרופיק:
- Terminal-Bench 4.0 (משימות קוד אוטונומיות): 39.2% ל-Haiku 5.5, לעומת 16.4% ל-GPT-6 Luna ו-0.0% ל-Haiku 4.5.
- OSWorld 2.1 (הפעלת מחשב לביצוע משימות ארוכות): 72.4%, לעומת 48.9% ל-Luna ו-15.7% לדור הקודם.
- GDPval-AA v2.1 (עבודה מקצועית ב-44 מקצועות): ציון Elo של 1620, לעומת 1437 ל-Luna.
- FrontierCode 1.1: 46.4%, לעומת 42.4% ל-Luna. כאן הפער קטן יותר.
Sonnet 5.5, המודל הבינוני והיקר יותר של החברה, עדיין מקדים את Haiku 5.5 בכל המדדים. כדאי לזכור שאלה תוצאות שהחברה עצמה פרסמה, ועדיין לא נבדקו באופן עצמאי.
גם כמה לקוחות שקיבלו גישה מוקדמת סיפקו נתונים. ב-Asana מדווחים על ירידה של יותר מ-30% בזמן ההשלמה של משימות. ב-HubSpot המודל השיג 92.8% בחבילת מבחני CRM, הציון הגבוה ביותר שראו שם בחבילה הזו. ב-AlphaSense, שמפעילים כלי שאלות על מסמכים בהיקף של כ-8 מיליון קריאות בשבוע, הציון עלה ל-0.84 לעומת 0.76 ב-Haiku 4.5.
מה עם המחיר
בהודעה הרשמית אנתרופיק מציינת רק את הירידה הממוצעת בעלות. דיווח בערוץ טלגרם בתחום ה-AI, שלא אומת מול המקור הרשמי, מוסר מחיר של 0.1 דולר למיליון טוקנים בקלט ו-0.5 דולר בפלט, לבקשות של עד 100 אלף טוקנים. לפי אותו דיווח, בבקשות ארוכות יותר המחיר גדל פי חמישה.
לצד ההשקה, אנתרופיק חותכת בחצי את המחיר של cache reads ב-Sonnet 5.5, כלומר קריאה חוזרת של הקשר ששמור במטמון. לדברי החברה, זה מוזיל את Sonnet 5.5 בכ-20% ברוב העבודה האגנטית. בנוסף, מנויי Claude Max ו-Team יקבלו קרדיט חודשי לשימוש ב-API.
המשמעות
השוק של המודלים הקטנים הוא המקום שבו חברות מריצות מיליוני קריאות ביום, ושם כל אגורה לקריאה מצטברת לסכומים גדולים. ההשקה, יחד עם ההוזלה של Sonnet, מרמזת ככל הנראה שאנתרופיק מנסה להתחרות על המחיר ולא רק על הביצועים בקצה העליון של השוק. אם הנתונים יחזיקו גם במבחנים עצמאיים, ייתכן שמפתחים שבנו מערכות על מודלים קטנים של OpenAI ישקלו מחדש את הבחירה שלהם.