GLM 5.3 של Z.ai זמין ב-Amazon Bedrock: מודל פתוח עם 753 מיליארד פרמטרים לקוד, לסוכנים ולאבטחת סייבר
אמזון הוסיפה ל-Bedrock את GLM 5.3 של Z.ai (Zhipu AI), מודל open-weight עם 753 מיליארד פרמטרים שנבנה למשימות קוד ולסוכנים שעובדים לאורך זמן. לפי Z.ai, המודל מציג תוצאות חזקות במבחני אבטחת סייבר. הגישה אליו פתוחה ללקוחות ארגוניים שעומדים בתנאי הזכאות.
אמזון הודיעה כי GLM 5.3, המודל החדש של החברה הסינית Z.ai (Zhipu AI), זמין כעת בשירות Amazon Bedrock. מדובר במודל open-weight, כלומר מודל שהמשקולות שלו מפורסמות לציבור, עם 753 מיליארד פרמטרים. לפי ההודעה הוא מותאם במיוחד לכתיבת קוד ולמשימות "סוכניות" ארוכות. בשלב זה הגישה למודל ב-Bedrock פתוחה ללקוחות ארגוניים שעומדים בתנאי הזכאות.
מה המודל אמור לדעת לעשות
GLM 5.3 בנוי בארכיטקטורת mixture-of-experts (MoE). בארכיטקטורה כזו כל בקשה מופעלת רק על חלק מהמודל, ולכן אפשר להריץ מודל ענק בעלות חישוב נמוכה יותר. לפי אמזון, המודל מיועד לתרחישים כמו שכתוב (refactoring) של מאגר קוד שמשתרע על מאות קבצים, תהליכי עבודה של סוכן שנמשכים כמה שעות בלי לאבד את ההקשר, ופתרון בעיות מערכת מורכבות שבהן המודל משתמש בכלים חיצוניים בכל שלב.
הנתונים לעומת הדגמים הקודמים
GLM 5 הגיע ל-Bedrock מוקדם יותר השנה, ו-GLM 5.3 ממשיך את אותה סדרה. לדברי Z.ai, המודל החדש מציג ביצועים תחרותיים בכמה מבחני קוד, ביניהם DeepSWE, Terminal Bench 3.0 ו-FrontierSWE. החברה מדווחת גם על שיפור של 50% לעומת GLM 5.2 במבחן קוד פנימי שלה. השוואה ישירה ל-GLM 5 לא פורסמה. לפי ההסבר, השיפורים היו גדולים כל כך שמאז ההכרזה על GLM 5.1 נאלצה החברה לעדכן את מבחני ההשוואה עצמם.
הנתון הבולט ביותר נוגע לאבטחת סייבר. לפי ההודעה, Z.ai מדדה ציון של 84.5 במבחן CyberGym בזמן ההשקה, ציון שהיא מגדירה כמוביל. אמזון מציגה את המודל כמתאים לתהליכי אבטחה הגנתיים, ובהודעה היא מדגימה בדיקת חדירות מורשית לאפליקציה של המשתמש עצמו בעזרת Strix, סוכן open source לבדיקות חדירות.
חשוב לזכור שכל הנתונים האלה מגיעים מ-Z.ai עצמה, ובשלב זה לא הוצגו בדיקות עצמאיות שמאששות אותם. ברשת מסתובבים גם דיווחים לא מאומתים על מבחנים קהילתיים, למשל השוואה שבה מודלים משחקים Civilization V. לפי הכותרת שלה GLM 5.3 עוקף שם את Claude Opus 5.5, אבל מדובר בבדיקה של משתמש, לא במדידה רשמית.
מה Bedrock מוסיף
גם קודם אפשר היה להוריד את GLM ולהריץ אותו, אבל השימוש במודלים פתוחים בהיקף כזה חייב בדרך כלל הקמה ותפעול של תשתית הרצה עצמאית. ב-Bedrock המודל זמין דרך API מנוהל:
- ממשקים: תמיכה ב-Responses וב-Chat Completions התואמים ל-OpenAI, וגם בממשקי Invoke ו-Converse של Bedrock. לאפליקציות חדשות אמזון ממליצה על הממשקים התואמים ל-OpenAI.
- Prompt caching: שמירה במטמון של חלקי פרומפט שחוזרים על עצמם, באופן אוטומטי או בשליטה ידנית. לפי אמזון, בעבודה עם סוכנים שולחים בכל סבב הוראות מערכת ארוכות או הקשר מתוך מאגר הקוד, וכך החיסכון יכול לכלול גם זמן תגובה וגם עלות.
- הפניה בין אזורים: פרופילים של cross-Region inference לארה"ב ופרופיל גלובלי.
- שכבות שירות: Flex למשימות שאינן דחופות ובעלות נמוכה יותר, Priority לבקשות רגישות לזמן תגובה במחיר גבוה יותר, ו-Standard כברירת מחדל.
המשמעות
ככל הנראה, המהלך משקף מגמה רחבה יותר: ספקיות הענן מוסיפות לקטלוג גם מודלים פתוחים מסין לצד המודלים הסגורים, ומציעות ללקוחות ארגוניים אפשרות להשתמש בהם בלי לנהל שרתים. אם הביצועים המדווחים יחזיקו גם במבחנים עצמאיים, GLM 5.3 עשוי להיות חלופה רלוונטית למודלים המובילים בתחום הקוד והסוכנים. עם זאת, בשלב זה מדובר בעיקר בנתונים של היצרנית עצמה.