GPT-6 Astra של OpenAI: Cognition ו-Perplexity מפעילות את המודל בתהליכי עבודה קריטיים
OpenAI מדווחת כי Cognition ו-Perplexity כבר משלבות את GPT-6 Astra בתהליכי עבודה מרכזיים - בדיקת קוד אוטומטית מצד Cognition, ותפעול וניטור מערכות בייצור מצד Perplexity. לפי שתי החברות, רמת הפיקוח האנושי הנדרשת ירדה לעומת מודלים קודמים.
✦ נכתב אוטומטית על ידי AIמבוסס על מקורות גלויים · עבר בקרת איכות אוטומטית
חברת OpenAI פרסמה שתי הודעות רשמיות שלפיהן שתי חברות תוכנה מוכרות בתעשיית הבינה המלאכותית - Cognition ו-Perplexity - כבר משלבות את הדור החדש של המודל, GPT-6 Astra, בתהליכי עבודה מרכזיים: בדיקת קוד אוטומטית מצד אחת, ותפעול שוטף של מערכות בייצור מצד השנייה.
Devin לומד לבדוק את עצמו
לפי הודעה רשמית של OpenAI, Astra משפר את היכולת של Devin - סוכן התכנות האוטונומי של Cognition - לבדוק תוכנה שהוא עצמו כתב, ולהראות שהיא אכן עובדת כמצופה. המטרה המוצהרת, כפי שמנוסחת בהודעה, היא לצמצם את כמות הקוד שמהנדסים אנושיים נדרשים לעבור עליה ידנית, ובכך לאפשר קצב שחרור גבוה יותר של שינויים.
Devin משווק על ידי Cognition ככלי המבצע משימות פיתוח מקצה לקצה - כתיבת קוד, איתור באגים ופתיחת בקשות מיזוג (Pull Requests) - ולא רק ככלי עזר בתוך סביבת עריכה.
Perplexity: פחות בדיקות, יותר אוטונומיה
הודעה נפרדת של OpenAI מציינת כי Perplexity, המוכרת בעיקר כמנוע חיפוש מבוסס AI, משתמשת ב-Astra למגוון משימות: כתיבת תקשורת ארגונית, ביצוע שינויים בתוכנה, וניטור מערכות בייצור (production). לפי ההודעה, הצוותים ב-Perplexity נדרשים לבדוק את עבודת המודל בתדירות נמוכה משמעותית לעומת מה שנדרש עם דורות קודמים של מודלים.
למה זה חשוב
שני המקרים, כפי שהם מוצגים על ידי OpenAI, משקפים ככל הנראה מגמה רחבה יותר בתעשייה: מעבר הדרגתי ממודלים שמייצרים הצעות הדורשות אישור אנושי צמוד, למודלים המופעלים על משימות ארוכות טווח עם פיקוח מצומצם יותר. אם התיאורים של OpenAI מדויקים, המשמעות עבור ארגוני פיתוח עשויה להיות שינוי בתפקיד המהנדס האנושי - מבדיקת קוד שורה-שורה, להגדרת יעדים ואישור תוצרים ברמה גבוה יותר.
יחד עם זאת, חשוב לציין: שני המקורות הרשמיים אינם כוללים נתונים מדידים - שיעורי הצלחה, זמן עבודה שנחסך, או היקף השימוש בפועל בארגונים. כך שההערכות לגבי עומק האימוץ בשתי החברות נשענות, בשלב זה, על הצהרות OpenAI ושותפותיה, ולא על נתון עצמאי מאומת.