יום שלישי, 6 באוקטובר 2026 מתעדכן אוטומטית כל שעה
→ חזרה למהדורה

Mistral חושפת את Mistral Large 4, "Le Chonk": מודל של טריליון פרמטרים, והמשקולות ישוחררו בסוף אוקטובר

Mistral הצרפתית השיקה תצוגה מקדימה ציבורית של Mistral Large 4, שזכה לכינוי "Le Chonk". זה מודל מולטימודלי של טריליון פרמטרים, והמשקולות שלו צפויים להתפרסם עד סוף אוקטובר. החברה טוענת שהוא עוקף כל מודל פתוח שפותח בארה"ב או באירופה, ומדגישה במיוחד את יכולותיו בתחום אבטחת הסייבר.

חברת ה-AI הצרפתית Mistral הכריזה היום (6 באוקטובר) על תצוגה מקדימה ציבורית של Mistral Large 4, שבחברה מכנים אותו "ML4" ובחצי חיוך גם "Le Chonk". זה המודל הגדול והחזק ביותר שהחברה בנתה עד היום. הוא כולל טריליון פרמטרים והוא מולטימודלי מלכתחילה (natively multimodal), כלומר מבין גם טקסט וגם תמונות. כבר עכשיו אפשר לנסות אותו דרך ה-API של פלטפורמת Mistral Studio, והמשקולות (weights), הקבצים שמאפשרים להוריד את המודל ולהריץ אותו על שרתים פרטיים, יתפרסמו לפי החברה עד סוף החודש.

ענק, אבל לא כולו פועל בבת אחת

לפי הבלוג של Mistral, בכל שלב בעיבוד פעילים רק 49 מיליארד מתוך הטריליון. כך עובדת ארכיטקטורה שבה רק חלק מהמודל מופעל בכל פעם, מה שמוזיל את ההרצה ביחס לגודל. בעמוד המודל ב-Hugging Face מופיע מספר אחר, 52 מיליארד פרמטרים פעילים, וגם שם המאגר מציין "A52B". מקור הפער לא הוסבר. מועד השחרור הצפוי שמופיע שם הוא 31 באוקטובר 2026. החברה הודיעה שתפרסם פרטים נוספים על הארכיטקטורה, מבחני ביצועים נוספים ושיטת האימון לקראת שחרור המשקולות.

Mistral טוענת שהמודל כבר מתחרה במודלי ה-open source החזקים בעולם, ושהוא עוקף בפער ניכר כל מודל פתוח שפותח בארה"ב או באירופה. לדבריה, בתחומים עסקיים כמו סייבר, פיננסים ומשפטים הוא מוביל בין המודלים הפתוחים. ביכולת אחת, visual grounding (זיהוי מדויק של אובייקטים בתוך תמונה), היא טוענת שהוא עוקף גם מודלים סגורים מהשורה הראשונה. החברה גם מציינת שהמודל "ממשיך להשתפר במהירות" תוך כדי העבודה עליו.

סייבר: היתרון של מודל שלא מסרב

את ההדגשה העיקרית בהכרזה מקבל תחום אבטחת הסייבר. לפי Mistral, המודל נמצא בין חמשת המודלים המובילים בעולם ב-Artificial Analysis Cyber Index, מדד עצמאי שבודק עד כמה מודלים מוצאים ומתקנים פרצות בתוכנה אמיתית. בין המודלים הפתוחים שפותחו מחוץ לסין הוא מוביל בפער גדול. באחד מהמבחנים במדד המודל צריך לשחזר חולשה אמיתית בתוכנת קוד פתוח ואז לתקן אותה, ושם ML4 השיג 82%, הציון הגבוה ביותר מכל המודלים. הוא גם פתר 93% מהאתגרים ב-Cybench, אוסף של 40 תרגילים מתחרויות אבטחה.

לפי Mistral, כמה מהמודלים הסגורים המובילים, ובהם Claude Opus 5.5 של אנתרופיק ו-GPT-6 Astra של OpenAI, מקבלים במבחן הזה ציון קרוב לאפס מפני שהם מסרבים לבצע את המשימה. הטיעון של החברה הוא שהגנה על תוכנה מתחילה פעמים רבות בהוכחה שהחולשה אמיתית. סירוב של ספק המודל עלול לחסום מחקר חולשות לגיטימי, ואובדן גישה ליכולת באמצע אירוע אבטחה הוא בעצמו סיכון. המשמעות היא שהמחלוקת על מידת הזהירות הנדרשת ממודלים בתחום הסייבר הופכת כאן ככל הנראה לטיעון מכירה. עד שחרור המשקולות המודל עובר red-teaming (בדיקות התקפיות מבוקרות) עם חברות סייבר, שותפים שעברו סינון ורשויות מדינה. הגופים האלה מקבלים גרסה עם פחות מגבלות תוכן ועם יכולות סייבר מורחבות.

"נבנה באירופה"

לפי Mistral, המודל אומן מאפס על 3,800 מעבדי Grace Blackwell של אנבידיה במרכזי הנתונים של החברה באירופה, ועל אותה תשתית רצה גם התצוגה המקדימה. נתוני האימון כוללים יותר מ-160 שפות, בהן כל השפות הרשמיות של האיחוד האירופי. המודל יוצע בכמה אזורים בעולם, ובהם פריסה אירופית ש-Mistral מפעילה בעצמה מקצה לקצה, באופן עצמאי מספקי שירות דיגיטליים אחרים ותחת החוק האירופי.

למה זה חשוב

המסר של "ריבונות AI" ומשקולות פתוחות מכוון ככל הנראה ללקוחות שרוצים להריץ את המודלים בעצמם: ממשלות, בנקים וחברות ביטחון, שלא רוצים להיות תלויים בשרתים ובמדיניות של חברה אמריקאית. Mistral מציינת שהמודל ישמש בסיס לדור חדש של מודלים מתמחים שלה. כדאי לזכור שכל נתוני הביצועים בשלב הזה מגיעים מהחברה עצמה, וחלקם מבוססים על הערכות פרטיות של Artificial Analysis שעדיין לא פורסמו לציבור. כשהמשקולות ישוחררו, הקהילה תוכל לבדוק את הטענות האלה באופן עצמאי.

💬 יש לכם הערה על הכתבה?
פרסומת

→ לכל הכתבות