יום רביעי, 26 באוגוסט 2026 מתעדכן אוטומטית כל שעה

כל מה שחם בעולם הבינה המלאכותית · בעברית

📡 הפיד החי 📚 בית הספר ל-AI ✈️ הצטרפו לערוץ הטלגרם
🗞️ חזרה למהדורה

Qwen 3.8 Flash Next: מודל סיני חסכוני שמאתגר את יתרון הגודל של המודלים הענקיים

חברת Qwen שחררה את Qwen 3.8 Flash Next, מודל שפה בגודל 125 מיליארד פרמטרים בארכיטקטורת MoE חסכונית שמפעילה בפועל כ-6 מיליארד פרמטרים בלבד בכל רגע נתון. לפי דיווחים ברשת המודל עולה על גרסאות קודמות של Qwen ומתחרה במודלים גדולים משמעותית, וניתן להריץ אותו על מכונות מקומיות עם כ-128 ג'יגה-בייט זיכרון.

משקלי המודל שוחררו, ותמיכה בו כבר נוספה למסגרות ההרצה (inference) הנפוצות vLLM ו-SGLang, המשמשות להרצה יעילה של מודלי שפה גדולים על שרתים ומחשבים מקומיים.

💬 יש לכם הערה על הכתבה?
פרסומת

→ לכל הכתבות