יום שני, 24 באוגוסט 2026 מתעדכן אוטומטית כל שעה

כל מה שחם בעולם הבינה המלאכותית · בעברית

📚 בית הספר ל-AI ✈️ הצטרפו לערוץ הטלגרם

אנבידיה: המערכת Vera Rubin NVL72 מספקת עד פי 30 יותר תפוקה למגה-וואט עבור סוכני AI

אנבידיה מדווחת כי מערכת ה-AI החדשה שלה, Vera Rubin NVL72, מספקת עד פי 30 יותר תפוקה למגה-וואט לעומת הדור הקודם, GB300 NVL72, בהרצת עומסי עבודה של סוכני AI. החברה גם הכריזה על כניסת מערכת ה-Groq 3 LPX לייצור מלא, ועל אימוץ הפלטפורמה בידי CoreWeave, Nebius ו-SpaceXAI.

אנבידיה פרסמה נתוני ביצועים חדשים למערכת ה-AI מדגם Vera Rubin NVL72, לפיהם היא מספקת עד פי 30 יותר תפוקה למגה-וואט בהשוואה למערכת הקודמת שלה, GB300 NVL72, כאשר מריצים עליה עומסי עבודה של סוכני AI (agentic AI) — מערכות שמבצעות שרשרת של פעולות עצמאיות במקום מענה חד-פעמי. הנתונים פורסמו בבלוג הרשמי של אנבידיה.

למה סוכני AI צורכים כל כך הרבה טוקנים

לפי נתוני OpenRouter המצוטטים בפוסט, עומסי עבודה של סוכני AI צורכים פי 15 יותר טוקנים מבקשת צ'אט פשוטה. הסיבה לכך היא אופן הפעולה של סוכן: כאשר הוא, למשל, חוקר חברה לצורך החלטת השקעה, הוא שואל מסדי נתונים פיננסיים, מחפש בחדשות ובדוחות, מפעיל תת-סוכן שמריץ השוואות מול מתחרים ומודלים של שווי, ולבסוף מסכם הכל להמלצה. בכל שלב כזה, הטוקנים שהצטברו הופכים לקלט לשלב הבא — כך שהיכולת להתמודד עם הקשר ארוך (long context) הופכת למרכזית בביצועי מערכות סוכנים.

כדי למדוד את הביצועים בתרחיש הזה, אנבידיה השתמשה בעומס העבודה AgentX של חברת המחקר SemiAnalysis, המבוסס על הקלטות אמיתיות של סשני קידוד עם סוכני AI, כולל צמיחת ההקשר, קריאות לכלים והפעלת תת-סוכנים כפי שקרו בפועל. לדברי אנבידיה, התוצאות עדיין ממתינות לבדיקת SemiAnalysis, ואינן כוללות עדיין את ביצועי מעבדי ה-Vera החדשים בקריאה לכלים (tool calling).

המשמעות הכלכלית: עלות נמוכה יותר לטוקן

מעבר לתפוקה, אנבידיה מדווחת גם על עלות נמוכה בעד פי 35 למיליון טוקנים בהשוואה ל-GB300 NVL72. החברה מציינת שעבור מרכזי נתונים המוגבלים בכוח חשמלי זמין, התפוקה למגה-וואט קובעת את היקף ההכנסה האפשרי, ועלות הטוקן קובעת את שולי הרווח על אותה הכנסה. ככל הנראה, הפער הזה נובע משילוב של תכנון משותף (codesign) של השבבים, הרשת התוך-מכנית NVLink והתוכנה, לצד טכנולוגיית ניהול חשמל בשם DSX MaxLPS שמאפשרת להפעיל עד 40% יותר מעבדי GPU בתוך אותה מכסת חשמל.

להשוואה, אנבידיה ציינה כי כבר הדור הקודם, GB300 NVL72, סיפק עד פי 15 יותר תפוקה למגה-וואט לעומת ארכיטקטורת Hopper שקדמה לו על המודל DeepSeek V4 Pro — כך שקפיצת ה-Vera Rubin מצטרפת למגמה של שיפור מהיר בין דורות.

הרחבת המערך: מערכת Groq 3 LPX ושותפים חדשים

במקביל, אנבידיה הודיעה על כניסה לייצור מלא של מערכת ה-Groq 3 LPX, מערכת בקנה מידה של רף המיועדת להאצת יצירת טוקנים במהירות גבוהה עבור מערכות סוכנים. בבנצ'מרק של Artificial Analysis על המודל הפתוח Gemma 4 31B, המערכת ייצרה 3,400 טוקנים בשנייה במקרי שימוש עם הקשר של 100,000 טוקנים — פי 4 מהר יותר מהחלופה הקרובה ביותר, לפי הדיווח.

ההכרזות, שהוצגו בכנס Hot Chips בפאלו אלטו, כללו גם רשימת שותפים: SpaceXAI הודיעה שתשתמש במעבדי Vera של אנבידיה עבור מערכות ה-AI העתידיות שלה; CoreWeave החלה להפעיל בייצור את רשת ה-Spectrum-X Multiplane המחברת בין מערכות Vera Rubin; ו-Nebius היא ענן ה-AI הראשון שמאמץ את Groq 3 LPX.

המשמעות, ככל הנראה, היא שאנבידיה ממשיכה למקד את פיתוח החומרה שלה סביב עומסי הסוכנים הגדלים והולכים בתעשייה — תחום שהחברה מציגה כשלב הבא אחרי שלב האימון וההסקה הפשוטה של מודלי שפה.

פרסומת

→ לכל הכתבות