יום שלישי, 6 באוקטובר 2026 מתעדכן אוטומטית כל שעה
→ חזרה למהדורה

Reflection AI, שאנבידיה משקיעה בה, חושפת את Beam: מודל פתוח שמתחרה במודלים הסיניים בעלות חישוב נמוכה יותר

Reflection AI, סטארט-אפ מברוקלין שאנבידיה משקיעה בו, הציגה את Beam: מודל open-weight עם 501 מיליארד פרמטרים. לפי החברה, הוא משתווה ל-GLM-5.2 של Z.ai במבחני הסקה מתקדמים, ומשתמש בפי 3–4 פחות חישוב בזמן inference. גורם בלתי תלוי עדיין לא אימת את הטענות, והמשקולות אמורות להתפרסם עוד החודש.

חברת Reflection AI הסירה הלוט מעל Beam, מודל ה-frontier הראשון שלה. זה מודל open-weight, כלומר משקולות המודל יהיו זמינות להורדה ולהרצה עצמאית. החברה טוענת ש-Beam משתווה למודלים הפתוחים הסיניים המובילים במבחני הסקה (reasoning) מתקדמים, ובעלות נמוכה בהרבה. גורם בלתי תלוי עדיין לא אימת את הטענות האלה.

מה יש בתוך Beam

לפי פוסט מפורט שהחברה פרסמה ביום שני, Beam הוא מודל טקסט בלבד בארכיטקטורת mixture-of-experts (MoE). בארכיטקטורה הזו רק חלק מהמודל פועל בכל שלב חישוב. למודל יש 501 מיליארד פרמטרים בסך הכול, ומתוכם 23 מיליארד פעילים. הוא אומן מראש על 23.8 טריליון טוקנים, וחלון ההקשר שלו מגיע למיליון טוקנים. לאחר מכן הוא עבר אימון ב-reinforcement learning עתיר חישוב, שנועד לחזק אותו בהסקה, בכתיבת קוד ובמשימות סוכניות (agentic). החברה מתארת את התוצאה כביצועים ב"שבריר מעלות הטוקנים ומהחישוב בזמן inference" לעומת המתחרים.

לשם השוואה, ל-GLM-5.2 של חברת Z.ai הסינית יש כ-744 מיליארד פרמטרים, ומתוכם 40 מיליארד פעילים. לפי Reflection, ציוני Beam במבחני הסקה מתקדמים דומים לאלה של GLM-5.2. היא גם טוענת שהוא עוקף את המודלים הפתוחים המערביים המובילים, ומשתמש ב"פי 3–4 פחות חישוב inference". החברה מגדירה אותו כ"מודל סוס עבודה" לארגונים, למגזר הציבורי ולמפתחים.

תשובה מערבית ל-DeepSeek ול-Qwen

Reflection ממצבת את עצמה מול כמה חזיתות. מצד אחד המעבדות הסגורות, כמו אנתרופיק ו-OpenAI. מצד שני המודלים הפתוחים הפופולריים מסין, כמו DeepSeek, Qwen ו-Z.ai. ומצד שלישי שחקנים מערביים כמו Mistral, מטא ו-Cohere. לפי TechCrunch, המתחרה האמריקאית הישירה ביותר היא כנראה Inkling, המודל הפתוח ש-Thinking Machines Lab של מירה מוראטי הוציאה ביולי. בטבלאות של Reflection עצמה, Beam עוקף את Inkling בארבעה מבחני קוד שבהם שני המודלים דיווחו תוצאות. עם זאת, Inkling הוא מודל multimodal, ו-Beam מטפל בטקסט בלבד.

ההכרזה מאשרת דיווח של Axios מסוף השבוע, שלפיו החברה עומדת לקראת השקה. לדברי Reflection, המשקולות והפרטים הטכניים המלאים יפורסמו עוד החודש. ההפצה תתבצע דרך ספקיות ענן גדולות ו-neoclouds, ובמועד ההשקה יהיו גם אינטגרציות לספריות open source.

הכסף, השבבים וה"מפעלים"

Reflection הוקמה ב-2024 על ידי שני חוקרים לשעבר ב-Google DeepMind. לפי PitchBook, החברה גייסה כ-4.7 מיליארד דולר ממשקיעים, ובהם אנבידיה, Sequoia Capital ו-Lightspeed Venture Partners. בסבב האחרון היא הוערכה ב-25 מיליארד דולר לפני הכסף. הקיץ חתמה החברה על עסקאות עם SpaceX ועם Nebius, בשווי כולל של יותר מ-7 מיליארד דולר, כדי להבטיח גישה לשבבי GB300 של אנבידיה עד 2029.

קהל היעד של Reflection הוא ארגונים ומדינות. החזון שלה הוא "מפעלי AI": מערכות מקומיות ומותאמות אישית, שבהן מוסדות מאמנים את המודלים של החברה על הנתונים הקנייניים שלהם. מנכ"ל אנבידיה, ג'נסן הואנג, מקדם את הרעיון הזה כבר זמן רב. מערכות כאלה אמורות לרוץ על המעבדים הגרפיים (GPU) של אנבידיה, כך שהחזון משרת גם אותה. לפי Axios, קרנות גידור וחברות מסחר הן בין הגופים שמעוניינים בפתרון כזה. בנוסף, Reflection כבר החלה לבחון שותפות של "מפעל AI ריבוני" עם קבוצת Shinsegae בדרום קוריאה.

למה זה חשוב

בשנים האחרונות מעבדות סיניות הובילו את זירת המודלים הפתוחים. אם הנתונים של Reflection יעמדו בבדיקה עצמאית, Beam עשוי להיות אחת החלופות המערביות הרציניות הראשונות. נקודת המכירה המרכזית שלו היא כנראה היעילות ולא רק הביצועים: מודל שמחזיר תוצאות דומות עם פחות חישוב זול יותר להפעלה. לארגונים שמריצים מודלים על התשתית שלהם, הפער הזה יכול להכריע. עם זאת, כרגע אלה נתונים של החברה עצמה. רק אחרי שהמשקולות ישוחררו אפשר יהיה לבדוק אותם באופן עצמאי.

💬 יש לכם הערה על הכתבה?
פרסומת

→ לכל הכתבות