OpenAI משיקה את Agents API: תשתית לסוכני AI הפועלים בענן למשך שעות
OpenAI פרסמה בגרסת בטא ציבורית את Agents API, ממשק תכנות שנותן למפתחים גישה לאותה תשתית שמריצה את Codex ו-ChatGPT. ה-API מאפשר להריץ סוכני AI בענן למשך שעות, עם ניהול הקשר אוטומטי, שימוש מקביל בכלים והעברת משימות לתת-סוכנים, ותומך גם בסביבות ריצה של שותפים כמו Cloudflare, Vercel ו-Oracle.
✦ נכתב אוטומטית על ידי AIמבוסס על מקורות גלויים · עבר בקרת איכות אוטומטית
OpenAI פרסמה את Agents API בגרסת בטא ציבורית — ממשק תכנות (API) המאפשר למפתחים לבנות סוכני AI מבוססי-ענן הפועלים למשך שעות, מריצים קוד ומעבדים קבצים. לפי ההודעה הרשמית של החברה, ה-API רץ על אותה תשתית שמפעילה כיום את Codex ואת ChatGPT.
בין היכולות המרכזיות שה-API חושף: ניהול הקשר (context) אוטומטי לאורך משימות ארוכות, שימוש מקביל בכלים שונים, ויכולת להעביר משימות מסוכן אחד למשנהו — מנגנון המכונה hand-off, המאפשר לפצל עבודה מורכבת בין תת-סוכנים ייעודיים. כך דיווח האתר The Decoder, שהוסיף כי מפתחים יכולים לבחור בין סביבת ריצה (sandbox) מנוהלת על ידי OpenAI עצמה, לבין סביבות של שותפים חיצוניים — Cloudflare, Vercel ו-Oracle. לפי OpenAI, אין עלות נוספת על השימוש בתשתית עצמה, וכל החיוב מתבצע לפי צריכת טוקנים בלבד.
מבחינה טכנית, ה-API נבנה על גבי ה-harness הקוד-פתוח של Codex — שכבת התזמור שמנהלת את פעולות הסוכן — ותומך בפרוטוקול MCP (Model Context Protocol), בפונקציות מותאמות-אישית שמפתחים יכולים להגדיר בעצמם, ובכלים מובנים כמו חיפוש באינטרנט. גם האתר MarkTechPost מאשר שמדובר באותו harness ותשתית שמריצים את Codex, כשההבדל המרכזי הוא שכעת ה-orchestration המלא — כולל ניהול sandbox, הקשר וכלים — זמין מאחורי קריאת API בודדת. השירות פעיל כבר לכל המפתחים, ולא דורש הרשמה למסלול סגור.
למה זה חשוב: עד כה, בניית סוכן AI שפועל באופן עצמאי לאורך זמן ומתאם בין כמה כלים ומשימות דרשה מהמפתחים להרכיב בעצמם את שכבת התזמור, ניהול הזיכרון וסביבת הריצה. המהלך של OpenAI, ככל הנראה, נועד להוריד את המחסום הזה — ולתת גם לצוותי פיתוח קטנים גישה לאותה תשתית ש"מפעילה מאחורי הקלעים" את כלי הדגל של החברה עצמה. האפשרות לבחור בין שרתי OpenAI לבין שותפי ענן חיצוניים כמו Cloudflare ו-Vercel מרמזת גם על כיוון אסטרטגי: OpenAI מעוניינת להישאר שכבת ה-AI המרכזית, גם כשהריצה בפועל של הסוכן מתבצעת על תשתית של גורם שלישי. מודל התמחור המבוסס אך ורק על טוקנים, ללא חיוב נפרד על זמן ריצה או שימוש ב-sandbox, עשוי להפוך שימוש ממושך בסוכנים לזול יותר לחיזוי עבור מפתחים — אם כי בפועל, עלות ריצה של סוכן הפועל שעות ארוכות תלויה במידה רבה בכמות הטוקנים שהוא צורך במהלך העבודה.