OpenAI השיקה את GPT-6.1 Sol: ביצועים קרובים ל-Astra בחמישית ממחיר הטוקנים
OpenAI השיקה ב-29 בספטמבר את GPT-6.1 Sol, גרסה משודרגת של GPT-6 Sol. לפי הדיווח, הביצועים שלו בכתיבת קוד אוטונומית, בהפעלת מחשב ובעבודה מקצועית מתקרבים לאלה של Astra, ומחיר הטוקנים שלו הוא חמישית ממחירי Astra. המודל זמין כבר עכשיו דרך ה-API של החברה, ב-ChatGPT Work וב-Codex.
OpenAI השיקה ב-29 בספטמבר 2026 את GPT-6.1 Sol, גרסה משודרגת של GPT-6 Sol. לפי הדיווח ב-MarkTechPost, הביצועים של המודל החדש מתקרבים לאלה של Astra, המודל המתקדם של החברה, בשלושה תחומים: כתיבת קוד אוטונומית (agentic coding), הפעלת מחשב (computer use) ועבודה מקצועית. מחיר הטוקנים שלו הוא חמישית ממחירי Astra.
כמה זה עולה
זה המחירון שפורסם ל-GPT-6.1 Sol:
- קלט (input): 2 דולר למיליון טוקנים
- פלט (output): 10 דולר למיליון טוקנים
- קלט שמור במטמון (cached input): 0.10 דולר למיליון טוקנים
טוקן הוא יחידת הטקסט הבסיסית שמודל שפה קורא וכותב, בערך מילה או חלק ממילה. חברות שבונות מוצרים על מודלים של OpenAI משלמות לפי מספר הטוקנים שהן שולחות למודל ומקבלות ממנו. לכן כשהמחיר לטוקן יורד, יורדת גם עלות ההפעלה של כל מוצר כזה.
המחיר של קלט שמור במטמון בולט במיוחד: 10 סנט למיליון טוקנים, עשרים פעמים פחות ממחיר הקלט הרגיל. ה"מטמון" (caching) מאפשר למודל לעשות שימוש חוזר בטקסט שכבר עיבד, למשל הוראות מערכת קבועות או קוד שנשלח שוב ושוב באותה משימה. בתהליכים ארוכים של סוכני קוד, שבהם אותו הקשר נשלח למודל פעמים רבות, ההנחה הזאת עשויה להוזיל את החשבון הכולל באופן ניכר.
איפה המודל זמין
GPT-6.1 Sol זמין כבר עכשיו בשלושה ערוצים: דרך ה-API של OpenAI (הממשק שמפתחים משתמשים בו כדי לשלב את המודל באפליקציות שלהם), בשירות ChatGPT Work וב-Codex, כלי הקוד של החברה.
הכוונה לסוכנים ולא לצ'אט
שלושת התחומים שבהם OpenAI מדגישה את הביצועים מעידים ככל הנראה על קהל היעד: הלקוחות שמריצים סוכני AI, תוכנות שמבצעות משימות מרובות שלבים בעצמן, ולא משתמשים שמנהלים שיחה עם צ'אטבוט. "הפעלת מחשב" פירושה שהמודל שולט בממשק גרפי כמו אדם: לוחץ על כפתורים, ממלא טפסים ועובר בין חלונות. משימות כאלה צורכות כמויות גדולות של טוקנים, ולכן המחיר משפיע עליהן יותר מאשר על שימוש מזדמן.
למה זה חשוב
המשמעות היא כנראה שינוי בחשבון של חברות ומפתחים. אם מודל שעולה חמישית מקבל תוצאות קרובות לאלה של מודל הדגל, רבים מהם צפויים לשאול אם הפער הנותר בביצועים מצדיק את ההפרש במחיר. אצל חלק מהלקוחות התשובה עשויה להיות שלילית, ומשימות יעברו מ-Astra ל-Sol.
עם זאת, "קרוב ל-Astra" אינו "שווה ל-Astra". בחומרים שפורסמו לא מפורטים מבחני הביצועים שעליהם נשענת ההשוואה ולא גודל הפער, ולכן קשה להעריך בשלב זה באילו משימות הפער משמעותי ובאילו זניח. מפתחים ככל הנראה יצטרכו לבדוק את המודל על המשימות שלהם לפני שיחליטו אם להחליף.
המהלך משתלב במגמה רחבה בתעשייה: ספקי מודלים משחררים לצד מודל הדגל גרסאות זולות יותר שמצמצמות את הפער בביצועים. עבור השוק, התוצאה הסבירה היא ירידה מתמשכת במחיר של כל יחידת "אינטליגנציה", ומכאן יכולת להפעיל סוכני AI בהיקפים שעד לא מזמן היו יקרים מדי.