GPT-6 Astra של OpenAI זמין כעת ב-Amazon Bedrock עם עומק ושיקול דעת מתקדמים
OpenAI ו-AWS הודיעו כי GPT-6 Astra, הדגם המתקדם ביותר של OpenAI, זמין כעת בזמינות כללית בפלטפורמת Amazon Bedrock, עם חלון הקשר של עד מיליון טוקנים ויכולות שימוש בדפדפן ובתוכנה. במקביל, בבנצ'מרק Vending-Bench 2 שבוחן ניהול עסק ממושך, Astra הציג יתרון כספי ניכר על פני Claude Fable 5.1 של Anthropic.
✦ נכתב אוטומטית על ידי AIמבוסס על מקורות גלויים · עבר בקרת איכות אוטומטית
OpenAI ו-Amazon הודיעו כי GPT-6 Astra, הדגם החדש והמתקדם ביותר של OpenAI, זמין כעת בזמינות כללית (GA) בפלטפורמת Amazon Bedrock, כך נמסר בהודעה הרשמית של AWS. ארגונים יכולים לקרוא לדגם ישירות דרך ממשקי ה-API של Bedrock, או להגדיר את כלי ChatGPT Work ו-Codex כך שיפעלו מולו על תשתית Bedrock.
לפי ההודעה, Astra מביא "עומק ושיקול דעת" גבוהים יותר למשימות מורכבות: ניתוח פיננסי שדורש התאמה בין מקורות מידע סותרים, סקירת חוזים על פני מאות עמודים בזכות חלון הקשר (context window) של עד מיליון טוקנים, ואיתור בעיות במאגרי קוד גדולים תוך מעקב אחר תלויות בין קבצים — מהאבחון ועד הבדיקה. הדגם גם מרחיב שימוש במחשב ובדפדפן (computer/browser use), ומאפשר להמשיך תהליכי עבודה ישירות דרך ממשקי תוכנה כאשר אין API או מחבר (connector) זמין. כחלק מההשקה, OpenAI מציגה גם תוספים (plugins) ארגוניים חדשים ל-ChatGPT Work, המרחיבים את יכולות שימוש הדפדפן של Astra על פני יישומים עסקיים נפוצים.
עבור תהליכים שחוזרים על אותו הקשר — כמו סקירת מסמכים תקופתית או ניתוח קוד — הדגם תומך במנגנון caching של prompt-ים, כולל אפשרות לקבוע "נקודות עצירה" (cache breakpoints) הקובעות אילו חלקי הקשר יישמרו במטמון, במטרה לצמצם עיבוד חוזר, עלות וזמן תגובה.
בצד האבטחה, OpenAI העריכה את הדגם דרך ה-Preparedness Framework שלה — מסגרת הבוחנת יכולות מודל בתחומים רגישים ומפעילה הגנות מחמירות יותר ככל שהיכולות עולות. לפי ההודעה, זהו הדגם הראשון של OpenAI שמגיע לסיווג "קריטי" (Critical) ביכולת סייבר, סיווג שבו הגנות אוטומטיות עוקבות בזמן אמת אחר שימוש לרעה ויכולות לעצור פעילות החורגת מגבולות שהוגדרו מראש. הגנות אלה פועלות לצד בקרות האבטחה של Bedrock עצמו: מניעת גישה של מפעילי AWS לנתוני ההסקה (inference) ברמת השבב, הצפנה במעבר ובמנוחה, ניהול הרשאות דרך IAM, תיעוד קריאות ב-CloudTrail, וניתוב תעבורה דרך VPC ו-AWS PrivateLink. לפי ההודעה, נתוני ההסקה של לקוחות אינם משמשים לאימון הדגם.
מעבר להשקה עצמה, ביצועי Astra נבחנו גם בבנצ'מרק Vending-Bench 2, הבודק את יכולתו של מודל AI לנהל עסק — במקרה הזה, מכונת ממכר — לאורך שנה מדומה, החל מהון פתיחה של 500 דולר ועד איתור ספקים, משא ומתן על מחירים וניהול מלאי. לפי הבדיקה של Andon Labs, Astra סיים בממוצע עם יתרת בנק של 15,515 דולר, לעומת 5,422 דולר בלבד עבור Claude Fable 5.1 של Anthropic, בשש הרצות לכל דגם — כאשר כל הרצה של Astra עלתה על כל הרצה של Fable. הבדיקה מצאה גם שמחיר הרכישה הממוצע של Fable עבור פחית קולה עלה מ-1.17 דולר בתחילת השנה המדומה ל-2.21 דולר לקראת סופה, בעוד Astra שמר על מחיר יציב של כ-1.15 דולר לאורך כל התקופה.
השילוב בין הזמינות ב-Bedrock, חלון ההקשר המורחב וביצועי הבנצ'מרק ממקם את Astra, ככל הנראה, בעיקר עבור שימושי סוכני AI ארגוניים בסביבת ייצור — תחום שבו AWS מציינת שלקוחותיה כבר מריצים היום סוכנים לכתיבת קוד, ניתוח נתונים ואוטומציה של תהליכים מורכבים בקנה מידה גדול. המשמעות עבור ארגונים ששוקלים מעבר בין ספקי מודלים היא שההשוואה כעת אינה רק על יכולות שפה גולמיות, אלא גם על ביצועים במשימות מדומות ארוכות-טווח כמו ניהול עסק, ועל רמת הבקרה והאבטחה שהפלטפורמה המארחת מספקת.