יום שישי, 2 באוקטובר 2026 מתעדכן אוטומטית כל שעה

בנושא

Qwen

Qwen על המחשב הביתי: כלים חדשים מהקהילה מנסים להריץ מודלים גדולים על חומרה מוגבלת

קהילת המודלים המקומיים מדווחת על כמה כלים חדשים להרצת מודלים מסדרת Qwen מחוץ לענן: גרסאות מכווצות (quants) של Dwarfstar, השוואה בין גרסאות שונות של Qwen3.8-27B, והרחבה ל-Pi שמאפשרת לקטוע את שלב ה"חשיבה" של המודל ולקבל תשובה מיד. רוב הדיווחים עדיין לא מאומתים, אבל הם מראים לאן הולך התחום: פחות זיכרון ופחות זמן המתנה על המחשב האישי.

עליבאבא משיקה מודל קול דו-כיווני שמחליט בעצמו מתי לדבר

צוות Qwen של עליבאבא השיק את Qwen-Audio-3.1-Realtime, מודל קול בזמן אמת שיכול להקשיב ולדבר בו-זמנית, להפעיל כלים ולהחליט מתי נכון לענות. בבדיקה שפרסמה החברה שיעור התגובות השגויות לדיבור ברקע ירד מ-73% ל-13%. המודל זמין כבר עכשיו כ-API בפלטפורמת QwenCloud.

Holo4 של חברת H: מודל פתוח לסוכני AI שעובדים בכל ממשק, בזמן שהמשרדים מתחילים "לגייס" סוכנים

חברת H השיקה את Holo4, סדרת מודלים לסוכני AI שמפעילים מחשב דרך מסך, קוד ו-API. המודלים מבוססים על Qwen של עליבאבא. לפי החברה, גרסת 27B משיגה 61.7% במבחן OSWorld 2.0, מול 81.8% של Opus 5.5, ובעלות נמוכה בהרבה. במקביל, בסקר של BCG אמרו 22% מהמנהלים שהארגון שלהם כבר הוסיף סוכני AI למבנה הארגוני.

מודלים של מאות מיליארדי פרמטרים על מחשב ביתי: FreeToken,‏ Colibrì ו-Splash מקדמים את ה-inference המקומי

כמה פרויקטי open source חדשים מנסים להריץ מודלי שפה ענקיים על חומרה ביתית. הם מפזרים את משקלי המודל בין כרטיס המסך, זיכרון ה-RAM והדיסק. FreeToken ו-Colibrì מכוונים למחשבים עם כרטיסי אנבידיה ולמעבדים רגילים, Splash 1.1.0 מתמקד במחשבי Mac, ומפתח עצמאי מדווח על הרצה של DeepSeek-V4-Flash על כרטיס מסך עם 12GB בלבד.

עליבאבא מציגה מפת דרכים "פרגמטית" ל-AI: מסלול ברור יותר להכנסות, על רקע זינוק בהשקעות התשתית

בכנס Apsara, הכנס המרכזי של עליבאבא, הציגה החברה השבוע מפת דרכים ל-AI שלדברי אנליסטים מסמנת פנייה פרגמטית, עם מסלול ברור יותר להפקת הכנסות. זה קורה בזמן שהוצאות ההון שלה עולות בחדות. לפי אנליסטית של CCB International, המשקיעים כבר לא מחפשים התלהבות. הם רוצים תשואה מוחשית ותשתית יעילה.

עליבאבא משיקה את Qwen Audio 3.1: חמישה מודלים קוליים, כולל זיהוי דוברים ורגשות, והוזלות של עד 95%

צוות Qwen של עליבאבא השיק את Qwen-Audio-3.1, סדרה של חמישה מודלים לזיהוי דיבור, להקראת טקסט ולשיחה בזמן אמת. גרסת ASR-Next מזהה כמה דוברים, רגשות וצלילי רקע. במקביל החברה מורידה את המחירים: עד 95% פחות על זיהוי דיבור, כ-85% פחות על המודל בזמן אמת וכ-70% פחות על הקראת טקסט.

אלבבה מתכננת מודל ענק עם עד 10 טריליון פרמטרים - ומגבה אותו בחומרה משלה

מנכ"ל אלבבה אדי וו הכריז בכנס Apsara על תוכנית לאמן מודל בינה מלאכותית בהיקף של 5 עד 10 טריליון פרמטרים, פי שניים עד ארבעה מהדגל הנוכחי Qwen 3.8 Max. לצד זה הציגה אלבבה את שבב ה-AI‏ Zhenwu V900 וסופר-נוד M890, כחלק מאסטרטגיית "full-stack" שמשלבת מודלים, שבבים וענן.

Alibaba: דיווחים על השקת מודל הדגל Qwen 4 בכנס Apsara, על רקע איחוד אסטרטגיית ה-AI הצרכנית

דיווחים שהופצו ברשתות החברתיות מצביעים על כך שאליבאבא הכריזה על Qwen 4, הדור הבא במשפחת מודלי השפה שלה, בכנס Apsara השנתי. ההכרזה הנטענת מגיעה בסמוך להשקה הרשמית של גרסה מחודשת לאפליקציית Qwen, כחלק ממהלך רחב יותר של החברה לאחד את מוצרי ה-AI הצרכניים שלה תחת מותג אחד ולהתחרות ב-ChatGPT, על רקע מרוץ טכנולוגי מואץ בין חברות סיניות ואמריקאיות.

סוכן קוד פתוח מנסה לשפר שיא בבעיה מתמטית פתוחה — בשידור כמעט חי

פרויקט קוד פתוח בשם Artificium מריץ סוכן AI אוטונומי, מבוסס על מודל Qwen בן 27 מיליארד פרמטרים, בניסיון לשפר שיא קיים בבעיית כיסוי קומבינטורית פתוחה הידועה כ-C(25,15,5). כל התהליך - הזיכרונות, הקוד והפעולות של הסוכן - מתפרסם בציבור, כך שניתן לעקוב ולבדוק את התוצאות באופן עצמאי; נכון לרגע זה טרם פורסם פתרון משופר.

אליבאבה משיקה את Qwen-Image-2.1: מודל יצירת תמונות במשקלים פתוחים מתיימר לעקוף מודלים סגורים

אליבאבה השיקה את Qwen-Image-2.1, מודל יצירת ועריכת תמונות עם משקלים פתוחים שרכיב היצירה בו מכיל 7 מיליארד פרמטרים בלבד. לפי בנצ'מארק פנימי של החברה הוא עוקף מודלים סגורים מובילים, אך בדיקות עצמאיות עדיין לא פורסמו, והרישיון אוסר שימוש מסחרי ללא אישור נפרד.

Qwen של אליבאבא משיקה מודל תרגום סימולטני עם עיכוב ממוצע של 2.3 שניות

צוות Qwen של אליבאבא השיק את Qwen3.8-LiveTranslate, מודל לתרגום סימולטני בזמן אמת המבוסס על ארכיטקטורה חדשה בשם Interleave. המודל מבין 60 שפות ודובר 29 מהן, ומצמצם את פער הזמן הממוצע בין דיבור לתרגום מ-2.8 שניות ל-2.3 שניות. הוא זמין כעת דרך WebSocket API בפלטפורמות הענן של אליבאבא.

קוון משיקה מודל מולטימדיה ראשון, במחיר נמוך משמעותית מ-Gemini Flash

קוון, משפחת מודלי ה-AI של עלי באבא, השיקה את Qwen3.8-Omni-Flash — המודל המולטימודלי הראשון שלה, שמעבד וידאו ואודיו במקביל ומפעיל כלים באופן עצמאי. לפי נתוני החברה, ביצועיו קרובים ל-Gemini 3.8 Flash של גוגל, אך תמחורו נמוך משמעותית ממנו.

עליבאבא משחררת את Qwen3.8-Flash-Next: מודל פתוח ורב-מודאלי עם הצצה לארכיטקטורת Qwen4

צוות Qwen של עליבאבא שחרר ב-26 באוגוסט את Qwen3.8-Flash-Next, מודל רב-מודאלי במשקולות פתוחות שנבנה על הארכיטקטורה המתוכננת לסדרת Qwen4. המודל כולל 125 מיליארד פרמטרים אך מפעיל רק 6 מיליארד בכל חישוב, תומך בחלון הקשר של עד מיליון טוקנים, וגרסת הענן שלו תוצע במחיר של 0.16 דולר למיליון טוקני קלט. לפי הדיווח, זמן האימון שלו היה תשיעית מזה של Qwen3.8-27B.

סין מצמצמת את הפער ב-AI: Z.ai גייסה 5 מיליארד דולר ו-Qwen חוזרת לפסגה המקומית

חברת הבינה המלאכותית הסינית Z.ai העלתה את תחזית ההכנסות השנתיות שלה ב-25% ל-3 מיליארד דולר, ימים אחרי שגייסה 5 מיליארד דולר. במקביל, המודל הסיני Qwen3.8 Max חזר לראש דירוג המודלים הפתוחים בסין, לפני GLM-5.3 ו-Kimi K3 - סימנים נוספים לתחרות הפנימית הנמרצת בתעשיית ה-AI הסינית.

Anthropic חושפת: מעבדות סיניות חילצו כמעט 200 מיליון פניות מ-Claude כדי לאמן מודלים מתחרים

Anthropic פרסמה ביום חמישי דו"ח המתאר חמישה קמפיינים שיטתיים של "דיסטילציה" מול Claude, בהם נצפו כמעט 200 מיליון פניות. הקמפיין הגדול ביותר, המיוחס לעליבאבא ולמודלי Qwen שלה, כלל 151 מיליון פניות בשלושה חודשים; קמפיין נוסף המיוחס ל-Moonshot AI (Kimi) נראה כמקושר לצבא הסיני.

מודלי AI ניהלו עסקים אמיתיים - ושלחו חשבוניות מזויפות בהיקף 12,431 דולר

חברת המחקר Bottleneck Labs נתנה לשבעה ממודלי ה-AI המובילים כסף אמיתי, מחשב פתוח והוראה אחת - "תרוויחו כמה שיותר" - ועקבה 72 שעות אחרי מה שקורה. התוצאה: 2,797 מיילים שנשלחו, חשבוניות מזויפות ב-12,431 דולר לזרים על עבודה שלא בוצעה, ואפס הכנסה אמיתית מול כ-3,200 דולר שאבדו.

אליבאבא משיקה Qwen-Drive 1.0 — מודל AI משולב לנהיגה אוטונומית

אליבאבא הציגה את Qwen-Drive 1.0, מודל AI המאחד תפיסה מרחבית, מענה על שאלות תנועה ותכנון מסלול בסוכן נהיגה יחיד, בבניה על מודל השפה-ותמונה Qwen3.5-4B. באימונים ובסימולציות ירד שיעור הסטיות מהכביש מ-24% ל-12%, אך לפי הדיווח ההסברים שהמודל נותן להחלטותיו לא תמיד תואמים את הפעולה בפועל.

גל כלים פתוחים לתפעול AI מקומי: קוואן, NVIDIA ופרפלקסיטי משחררים קוד

בתוך פרק זמן קצר שחררו קבוצת הפיתוח של קוואן, NVIDIA ופרפלקסיטי שלושה כלים פתוחים שמטרתם להקל על הרצת מודלי שפה מחוץ לענן: שכבת חיפוש מאוחדת לסוכני AI, פרוקסי לניתוב תעבורת LLM בין ספקים שונים, ושרת הסקה למק המותאם למודל קוואן. הכלים משקפים מגמה של השקעה בתשתית סביב מודלים פתוחים ומקומיים, לצד סוכני קידוד.

מרוץ המודלים הדגל: Astra, Qwen3.8-Max ו-Quasar 438B הוגשו תוך ימים ספורים

בתוך ימים ספורים הציגו OpenAI, עליבאבא ו-Multiverse Computing מודלים דגל חדשים - Astra, Qwen3.8-Max-0902 ו-Quasar 438B - לצד דיווחים לא מאומתים על עדכון ל-Gemini Flash. הבולט מביניהם הוא Astra, שמוגדר כמודל הראשון של OpenAI ברמת סיכון "קריטי" ביכולות סייבר, ובמקביל משווק כבטוח ביותר שהחברה פיתחה.

Qwen3.8-Max-0902: Alibaba משדרגת את מודל הדגל, אך משתמשים מתלוננים על עבודה שיתופית לקויה

Alibaba שחררה גרסה מעודכנת של מודל השפה Qwen3.8-Max, תחת השם Qwen3.8-Max-0902, עם 2.4 טריליון פרמטרים וחלון הקשר של מיליון טוקנים, לאחר אימון נוסף בתחומי קוד ועבודה משותפת. במקביל, דיווח משתמש בפורום r/LocalLLaMA מתאר קשיים בעריכות קוד קטנות מול הגרסה הקודמת, 3.6.

Qwen3.8-Flash-Next רץ גם על חומרה ישנה: גרסאות קהילתיות ל-V100 ול-Mac

קהילת המשתמשים בפורום r/LocalLLaMA פרסמה השבוע שני פרויקטים נפרדים המאפשרים להריץ את המודל Qwen3.8-Flash-Next על חומרה שלא נועדה במקור לכך: מערך של ארבעה כרטיסי Nvidia V100 ותיקים מצד אחד, ומחשב Mac ביתי עם שבב M1 Max מצד שני. שני הפרויקטים מבוססים על שיטות כימות (quantization) והזרמת נתונים המצמצמות את דרישות הזיכרון הנדרשות להרצת המודל.

Qwen3.8-27B מצית התלהבות בקהילת הקוד הפתוח בזכות ביצועים על חומרה ביתית

מודל שפה בגודל 27 מיליארד פרמטרים ממשפחת Qwen של עלי בבא מעורר תגובות נלהבות בפורום r/LocalLLaMA, לאחר שמשתמשים דיווחו על קצבי עיבוד גבוהים וצריכת זיכרון נמוכה יחסית בהרצה על חומרה צרכנית. במקביל, עלי בבא עברה מרישיון Apache 2.0 לרישיון קהילתי מגביל יותר, מהלך שמעורר ביקורת בקרב מפתחי קוד פתוח.

Qwen3.8-Flash-Next: סימנים להשקה קרובה לאחר שדף המודל עלה ב-ModelScope

דף מודל בשם Qwen3.8-Flash-Next הופיע בפלטפורמת ModelScope הסינית, ועורר תשומת לב בקהילת r/LocalLLaMA לאחר שמשתמש שיתף אותו בכותרת שרמזה על השקה קרובה. בשלב זה אין אישור רשמי מצד קוואן (Qwen) לגבי תאריך השקה, מפרט טכני או יכולות המודל.

ג'טבריינס בוחנת שילוב בינה מלאכותית מקומית עם מודל Qwen3.6

דיווח קהילתי בפורום r/LocalLLaMA ברשת Reddit מצביע על כך שג'טבריינס, מפתחת סביבות פיתוח כמו IntelliJ IDEA ו-PyCharm, בוחנת הרצת בינה מלאכותית מקומית בכלי הקידוד שלה באמצעות מודל השפה הסיני Qwen3.6 בגרסת 27 מיליארד פרמטרים. מדובר בדיווח לא רשמי, ללא אישור מטעם החברה, אך הוא מצטרף לסימנים נוספים לכך שהרצת AI מקומית חודרת גם לכלי פיתוח מרכזיים בתעשייה.

תומסון רויטרס משקיעה 40 מיליון דולר בבניית בינה מלאכותית משפטית משלה, במקום לשכור מ-OpenAI או Anthropic

חברת המידע תומסון רויטרס חשפה את "Thomson", מודל שפה משפטי שבנתה בעצמה על בסיס Qwen הסינית של עלי-באבא, בהשקעה של כ-40 מיליון דולר על פני יותר משנתיים. לפי נתוני החברה עצמה, המודל עוקף מתחרים כמו GPT-5.4 רק כשיש לו גישה לתוכן הקנייני של החברה — בגישה חופשית לאינטרנט בלבד הוא עדיין מפגר אחריהם.

דיון ברשת: מודל הקוד הפתוח Qwen 3.8 27B מציב אתגר לחברות ה-AI הסגורות

פוסט שצבר תהודה בפורום r/LocalLLaMA טוען כי מאז השקת מודל הקוד הפתוח Qwen 3.8 27B, חברות ה-AI הסגורות כמעט ואינן מתייחסות אליו בפומבי — בניגוד לתגובה התקשורתית הבולטת שליוותה השקות קודמות של מודלים פתוחים. לפי הפוסט, הסיבה היא שהמודל ניתן להרצה מקומית על מחשב בית, מה שמאיים ישירות על מודל ההכנסות של שירותי AI בתשלום.

GLM-5.3 מעורר דיון על מדדי ביצוע-מול-עלות בקהילת LocalLLaMA

מודל שפה חדש בשם GLM-5.3 הופיע בדירוג של Artificial Analysis ועורר דיון נרחב בקהילת r/LocalLLaMA סביב האופן שבו מוצג היחס בין ביצועים לעלות. במקביל, רמזים מעורפלים על מודל חדש בסדרת Qwen של Alibaba הציתו ספקולציות נוספות בפורום.

מודל קליל של עליבאבא מתחרה במודלי הדגל של OpenAI ודיפסיק

עליבאבא פרסמה את משקלי המודל הקליל Qwen3.8-27B, בעל 27 מיליארד פרמטרים בלבד, שמתחרה בביצועיו במודלים גדולים בהרבה מבית OpenAI, דיפסיק וג'יפו. הישג זה מדגיש מגמה של מודלים חסכוניים שרצים על חומרה רגילה.

קוואן משיקה את Qwen3.8-27B: מודל קוד פתוח שמצית דיון בקהילת המפתחים המקומית

חברת קוואן (Qwen) שחררה את המודל בעל הקוד הפתוח Qwen3.8-27B, ותוך זמן קצר הציפו משתמשי Reddit את קהילות ה-LLM בפוסטים, גרסאות מותאמות והשוואות. מפתחים שמריצים מודלים על מחשביהם מדווחים על התלהבות מיכולות המודל.