OpenAI: בין 80% ל-90% מהמחקר שלנו מכוונים כבר ל-GPT-7 ולדורות שאחריו
בוריס פאואר, ראש המחקר היישומי של OpenAI, אומר ש-80 עד 90 אחוז מהמחקר בחברה מכוונים ל-GPT-7, ל-GPT-8 ולדורות שאחריהם, כי לדבריו שם נמצא "רוב הערך". לדבריו, הבעיה המרכזית של עוזרי ה-AI כיום היא לא איכות המודלים, אלא העובדה שרוב המשתמשים לא יודעים מה אפשר לעשות איתם.
רוב המאמץ המחקרי של OpenAI כבר לא מופנה למודלים שזמינים היום. כך אומר בוריס פאואר (Boris Power), ראש המחקר היישומי (Head of Applied Research) בחברה. לדבריו, 80 עד 90 אחוז מהמחקר מכוונים ל-GPT-7, ל-GPT-8 ולדורות שאחריהם, כי שם נמצא "רוב הערך". את הדברים אמר במסגרת Fellows Forum, כך לפי האתר The Decoder.
עדכונים קטנים כהימור לטווח קצר
פאואר הסביר את ההבדל בין שני סוגי שיפור. השיפורים בתוך אותו דור, למשל המעבר מ-GPT-5.1 ל-GPT-5.2, מגיעים לדבריו מנתוני אימון ייעודיים. בחברה רואים בהם הימורים מכוונים לטווח קצר. הקפיצה האמיתית מגיעה עם דור חדש של מודל, שבו, כלשונו, "כל השאר פשוט עובד הרבה יותר טוב". אחרי כל קפיצה כזאת החברה צריכה ללמוד מחדש איפה כדאי להשקיע כדי להשיג שיפורים מהירים.
פאואר גם הודה במתח שיש בגישה הזאת. לדבריו, בתוך החברה העדכונים ההדרגתיים "נתפסים כקצרי ראות ביותר". ועדיין, הם עוזרים ל-OpenAI לבצע איטרציות וללמוד מהר יותר כבר עכשיו, אף שזו לא האסטרטגיה הנכונה לטווח הארוך.
המשמעות למשתמשים היא ככל הנראה שעדכוני הביניים שהם מקבלים לאורך השנה הם רק חלק קטן מהעבודה של החברה. רוב המשאבים המחקריים מושקעים במודלים שעדיין לא הוכרזו.
הבעיה: המשתמשים, לא המודל
הטענה הבולטת של פאואר נוגעת דווקא למשתמשים. לדבריו, האתגר המרכזי של עוזרי ה-AI כיום הוא לא איכות המודל, אלא ה-onboarding, כלומר הדרך שבה מכניסים משתמשים חדשים לעבודה עם המוצר. רוב משתמשי ChatGPT, כך אמר, לא יודעים מה הם יכולים לעשות עם AI. לכן לדעתו המודלים העתידיים צריכים להיות טובים יותר בהצגת האפשרויות למשתמש ובזיהוי מראש של מה שהוא צריך.
פאואר תיאר את ההתפתחות בין הדורות מנקודת המבט של המשתמש:
- GPT-4 דרש ניסוח זהיר של ההנחיות (prompting).
- GPT-5 קל יותר לשימוש, אבל עדיין צריך הרבה משוב מהמשתמש.
- GPT-6 כבר מתפקד לדבריו יותר כמו עמית מוכשר, שאפשר פשוט למסור לו מטרה.
למה זה חשוב
הדברים של פאואר מראים שינוי בדרך שבה אחת מחברות ה-AI המובילות מגדירה את צוואר הבקבוק. במשך שנים הדיון הציבורי התמקד ביכולות המודלים: מבחני ביצועים (benchmarks), היקף האימון והשוואות בין מתחרים. לפי פאואר, לפחות מבחינת המשתמש הרגיל, המגבלה המרכזית כבר עברה לפער בין מה שהמודל מסוגל לעשות לבין מה שהאדם שמולו יודע לבקש ממנו.
אם הניתוח הזה נכון, סביר שהתחרות בשנים הקרובות תתמקד גם בחוויית השימוש: מודלים שמציעים בעצמם דרכי שימוש ומבינים את ההקשר בלי הדרכה מפורטת. מנגד, יש בגישה גם הימור. אם רוב המחקר מכוון לדורות הבאים, אז ההצלחה של החברה תלויה במידה רבה בכך שכל קפיצה בין דורות תמשיך לספק שיפור משמעותי, כמו שפאואר מתאר.
חשוב לציין שמדובר בדברים שאמר בכיר אחד בחברה. הדיווח אינו כולל נתונים רשמיים של OpenAI על חלוקת תקציב המחקר שלה או מועדים ל-GPT-7.