יום שישי, 2 באוקטובר 2026 מתעדכן אוטומטית כל שעה
→ חזרה למהדורה

GPT-6 Astra של OpenAI: מודל שמפעיל את המחשב בעצמו, מ-Excel ועד Blender

ב-3 בספטמבר 2026 הכריזה OpenAI על GPT-6 Astra, מודל שמתמחה בהפעלה עצמאית של מחשב: הוא ממלא טפסים, מתקין תוכנות ובונה מודלים בתלת-ממד. לפי החברה, הוא עוקף את קודמו GPT-5.6 Sol ברוב המבחנים, וזה המודל הראשון שלה שסווג ברמת סיכון "Critical" בתחום הסייבר.

ב-3 בספטמבר 2026 הכריזה OpenAI על GPT-6 Astra, מודל חדש שנבנה בעיקר כדי לעבוד על המחשב במקום המשתמש. "כל מה שאפשר לעשות במחשב, Astra יכול לעשות בשבילך", הצהירה החברה בהשקה. לפי הנתונים שפרסמה, המודל עוקף את GPT-5.6 Sol, הדור הקודם, בהפעלת מחשב, בגלישה, בתכנות, במדע ובאבטחת סייבר.

ממודל שכותב לסוכן שמפעיל את המחשב

בשנים האחרונות מודלי שפה כבר לא רק כותבים טקסט. הם משמשים גם כ"סוכני AI" (AI agents): תוכנות שמפעילות דפדפן ויישומים ומבצעות משימות מתחילתן ועד סופן. לפי הסיכום של Gigazine, GPT-6 Astra ממלא טפסים, מסדר יומנים, עורך מחקר ברשת, בונה אתרים, ומתקין ובודק תוכנות. באתר של OpenAI מוצגות דוגמאות שבהן המודל פותר ב-Excel בעיות מתוך אליפות העולם ב-Excel.

במבחן Agents' Last Exam, שבודק עבודה ממושכת על המחשב במשימות שדומות לעבודה אמיתית כמו הפקת תלת-ממד, הנהלת חשבונות ופיתוח תוכנה, קיבל המודל ציון של 59.3%, לעומת 53.6% של GPT-5.6 Sol. במבחן OSWorld 2.0 הוא הגיע ל-72.6%, לעומת 65.7% של הדור הקודם. OpenAI מוסיפה שבהגדרות שהביאו לציון הגבוה ביותר, המודל הפיק כ-65% פחות טוקנים (tokens, יחידות הטקסט שהמודל מייצר) מאשר Claude Opus 5 של אנתרופיק. המשמעות המעשית היא ככל הנראה עבודה מהירה וזולה יותר.

מ-Blender ל-Unreal Engine

ההדגמות הבולטות מגיעות מעולם העיצוב. בהדגמה אחת המודל בונה מודל תלת-ממדי של בית בתוכנה Blender. בהדגמה נוספת הבית מיובא למנוע המשחקים Unreal Engine 5 והופך לחלל שאפשר להסתובב בו. חברת פיתוח המשחקים Playco, שניסתה לפתח משחקים עם המודל, דיווחה שהתיקונים הידניים ירדו ב-50% בהשוואה למודל הקודם.

ARC-AGI-3 וסייבר

הנתון שמושך הכי הרבה תשומת לב מגיע ממבחן ARC-AGI-3. המבחן בודק אם מודל מסתדר בסביבה מופשטת, מבוססת תורות, שלא ראה קודם, ומסיק את הכללים שלה בעצמו. המודל קיבל 99.9% בתצורה שנעזרת בכלי ניהול ההקשר של OpenAI, ו-62.7% בתצורה הסטנדרטית שנועדה להשוות בין מודלים של חברות שונות באותם תנאים. לשם השוואה, GPT-5.6 Sol קיבל 7.8%. לפי הדיווח, ב-96% מהשלבים המודל הגיע לפתרון בפחות פעולות מהחציון של בני אדם.

גם בסייבר נרשמה קפיצה. במבחן ExploitBench, שבודק אם המודל כותב קוד תקיפה שעובד בפועל מתוך פרצות אבטחה מוכרות, הוא קיבל 100%, לעומת 78.5% של הדור הקודם. OpenAI מציינת ש-GPT-6 Astra הוא המודל הראשון שלה שהגיע לרמת "Critical" ביכולות סייבר בהערכת הבטיחות הפנימית. לכן, לדבריה, הוגברו ההגבלות על בקשות שעלולות להוביל לתקיפות מתוחכמות.

ומה עם רובוטים?

ברשתות החברתיות הופצו טענות שלפיהן המודל הופך סרטון של חדר אמיתי לעולם תלת-ממדי אינטראקטיבי, שרובוטים יכולים להתאמן בו. זה דיווח שלא אומת: הטענה לא מופיעה במקורות הרשמיים שבידינו, ולא נמצא מקור שמתאר חיבור של המודל לרובוט פיזי.

למה זה חשוב

המשמעות היא ככל הנראה המשך המעבר ממודלים שעונים על שאלות לסוכנים שמבצעים עבודה בפועל, כולל בתוכנות מקצועיות ומורכבות. במקביל, הסיווג ברמת "Critical" בסייבר מראה ש-OpenAI עצמה רואה ביכולות האלה סיכון ממשי. חשוב לזכור שכל הנתונים פורסמו על ידי החברה, וטרם נבדקו באופן עצמאי.

💬 יש לכם הערה על הכתבה?
פרסומת

→ לכל הכתבות