יום שישי, 2 באוקטובר 2026 מתעדכן אוטומטית כל שעה
→ חזרה למהדורה

GPT-6 Astra יוצאת לעולם הפיזי: הדגמות של שליטה ברובוטים מעוררות דאגה בתעשיית הרובוטיקה

בעקבות ההשקה של GPT-6 Astra התפרסמו הדגמות רבות שבהן המודל שולט ברובוטים, וצוותי מחקר כבר החלו לבחון אותו. בתעשיית הבינה המגולמת יש מי שמזהירים ש"הזאב כבר בפתח", ויש מי שמזכירים שבלי נתונים פיזיים וחומרה, יכולת קוגניטיבית לבדה לא מספיקה.

המודל החדש של OpenAI‏, GPT-6 Astra, כבר לא נשאר רק מאחורי המסך. מאז ההשקה התפרסמו הדגמות רבות שבהן הוא שולט ברובוטים, וקהילת הבינה המגולמת (embodied intelligence, כלומר בינה מלאכותית שפועלת בגוף פיזי כמו רובוט) מיהרה לבחון אותו בעצמה. לצד ההתלהבות מתעוררת גם דאגה: ייתכן שספקי המודלים הגדולים יהפכו למתחרים ישירים של חברות הרובוטיקה שנשענות עליהם.

מה ההדגמות מראות, ומה עדיין לא אומת

ברשתות החברתיות הופץ תיאור שלפיו Astra מפעילה רובוט דמוי-אדם מדגם Unitree G1 בחדר שלא ראתה קודם, זוכרת היכן מונחים חפצים, מסדרת את החדר ומביאה פריטים גם כשההנחיה מעורפלת. זהו דיווח שלא אומת: במקורות שבידינו לא מצאנו הודעה רשמית של OpenAI שמתארת את ההדגמה הזו.

מה שכן מתועד הוא ניסוי של צוות חיצוני. Xu Huazhe, מייסד Shellbot Robotics, הציג בכנס Bund Summit את המבחנים שערך הצוות שלו על Astra. הוא מחלק משימות רובוטיות לשלוש רמות: סמנטיקה, מרחב ופיזיקה. לדבריו, בתנאי הבדיקה שלהם Astra הפגינה יכולות סמנטיות ומרחביות חזקות. היא זיהתה חפצים על שולחן ואף הצליחה להרים זוג צ'ופסטיקס דקים. נוסף על כך, סם אלטמן, מנכ"ל OpenAI, הצהיר על כוונת החברה לפתח רובוטים דמויי-אדם ורובוטים מסוגים אחרים.

הרקע: מודל שתוכנן להיות סוכן

GPT-6 Astra הושקה ביום שישי בלילה, ו-OpenAI מציגה אותה בראש ובראשונה כמודל סוכני (agentic), כלומר מודל שמקבל משימה מורכבת, מפרק אותה לשלבים ומבצע חלק גדול ממנה לבד. במבחן OSWorld 2.0, שבודק ביצוע משימות במחשב, המודל השיג 72.6% ובממוצע נדרשו לו כ-40 דקות למשימה. המודל הקודם, GPT-5.6 Sol, השיג 65.7% ונדרשו לו כ-75 דקות. חלון ההקשר של Astra מגיע לכ-1.05 מיליון טוקנים. נשיא החברה, גרג ברוקמן, אמר שלדעתו האישית "אנחנו שם", כלומר ש-OpenAI כבר הגיעה ל-AGI. הקפיצה מפעולה במחשב לשליטה ברובוט היא ככל הנראה המשך טבעי של אותה גישה.

"הזאב כבר בפתח"

Zhu Zheng, מייסד-שותף ומדען ראשי ב-Extreme Vision, הזהיר בכנס שמודלי השפה כבר השתלטו על היכולות המולטימודליות (עיבוד של טקסט, תמונה וקול יחד) ועכשיו חודרים לתחום הרובוטיקה, עם יתרון מלא בכוח אדם, בכוח מחשוב ובהון. "הזאב כבר בפתח, זנחו כל אשליה", אמר. לדבריו, השנה-שנתיים הקרובות הן חלון קריטי, ולענף עדיין אין "חפיר" (moat), כלומר יתרון תחרותי מבוצר.

לא כולם שותפים לחרדה. Zhu Xing, מנכ"ל Ant Group Lingbo, שאל אם OpenAI או אנתרופיק היו מצליחות לשבש את טסלה בזמן קצר אילו נכנסו היום לתחום הנהיגה האוטונומית. Wang Qian, מייסד ומנכ"ל Independent Variable Robotics, הזכיר שהשיפור ביכולות התכנות של מודלי השפה נבנה על כמויות עצומות של נתוני קוד ועל מערכות אימות. לדבריו, קפיצה ביכולת מגיעה בדרך כלל יחד עם נתונים, יעדי אימון ומנגנוני משוב מתאימים, והיא לא "זולגת" מעצמה מבינה כללית.

למה זה חשוב

הוויכוח מחדד שאלה שכדאי לשאול על כל הדגמה כזו: באיזה ממשק תנועה המודל משתמש, כמה יכולת שליטה ברמה הנמוכה כבר הייתה קיימת במערכת, האם נעשה שימוש בנתוני רובוטים, ומה יקרה עם חומרה או חפצים אחרים. הדגמה מציגה רק את התוצאה הסופית של מערכת שלמה. המשמעות היא ש-Astra מצמצמת ככל הנראה את הפער בהבנה ובתכנון, אבל רמת הפיזיקה, כלומר מגע, כוח ותנועה מדויקת, עדיין דורשת ניסיון מצטבר. בינתיים יש צוותים שלא מחכים לסוף הוויכוח וכבר משלבים את Astra במחקר, למשל ליצירת תרחישי סימולציה או לשליטה ברובוט לצד מודלים ייעודיים לרובוטיקה.

💬 יש לכם הערה על הכתבה?
פרסומת

→ לכל הכתבות