מודל שפה בגודל 27 מיליארד פרמטרים ממשפחת Qwen של עלי בבא מעורר תגובות נלהבות בפורום r/LocalLLaMA, לאחר שמשתמשים דיווחו על קצבי עיבוד גבוהים וצריכת זיכרון נמוכה יחסית בהרצה על חומרה צרכנית. במקביל, עלי בבא עברה מרישיון Apache 2.0 לרישיון קהילתי מגביל יותר, מהלך שמעורר ביקורת בקרב מפתחי קוד פתוח.
מודל שפה חדש בגודל 27 מיליארד פרמטרים ממשפחת Qwen של החברה הסינית עלי בבא הפך בימים האחרונים לנושא מרכזי בפורום r/LocalLLaMA — קהילת הדגל של מי שמריצים מודלי שפה על מחשבים אישיים. לפי דיווח של משתמש שהריץ את המודל, המכונה ברשת גם Qwen 3.8 Flash, על כרטיס מסך יחיד מדגם 5090 באמצעות תוכנת הרצה חדשה בשם Ninfer, קצב העיבוד הגיע לשיא של 220 טוקנים בשנייה, עם ממוצע סביב 170 טוקנים בשנייה — לדבריו, פי שניים ויותר מהקצב שקיבל באמצעות llama.cpp, תוכנת ההרצה המקובלת בקהילה. אותה הרצה בוצעה עם חלון הקשר (context window) של עד 240,000 טוקנים.
לצד המהירות, מה שמעורר עניין נוסף הוא היכולת להריץ את המודל על חומרה צנועה יחסית. משתמש אחר בפורום תיאר שימוש בגרסאות דחוסות (quantized) ברמת דיוק Q2, שאומנו בשיטת QAT (Quantization-Aware Training — אימון שמביא בחשבון מראש את אובדן הדיוק הצפוי מהדחיסה), הן עבור המודל הראשי והן עבור מודל נוסף בשם Qwen3.8-27B-DFlash2. שני הקבצים זמינים להורדה ב-Hugging Face: המודל הראשי ו-DFlash2. לדברי אותו משתמש, בשילוב עם מטמון KV ברמת דיוק Q5, סך צריכת הזיכרון עומדת על כ-13 עד 14 ג'יגה-בייט בלבד, גם בשימוש שנבדק עד חלון הקשר של 200,000 טוקנים, ולטענתו "עם ירידה מזערית מאוד באיכות".
במקביל לגל ההתלהבות, עלי בבא ביצעה שינוי ברישוי שמעורר ביקורת. לפי דיווח בפורום, הגרסה החדשה, המכונה שם Qwen 3.8 Flash Next, יוצאת תחת רישיון בשם "Qwen Community Licence" במקום רישיון Apache 2.0 הפתוח שבו נעשה שימוש בגרסאות קודמות. משתמשים ציינו שהרישיון החדש מגביל יותר מ-Apache 2.0, אם כי הפרטים המדויקים של ההגבלות — למשל לגבי שימוש מסחרי, מכירת גישה ל-API או הפצה מחדש של המשקלים — לא פורטו במלואם בדיון המקוון.
המשמעות: קהילת הקוד הפתוח עוקבת מקרוב אחרי מודלים סיניים בגודל בינוני-קטן כמו זה, מכיוון שהם ככל הנראה מצמצמים את הפער בין מה שניתן להריץ על מחשב יחיד לבין מודלים סגורים וגדולים בהרבה. באותו הפורום עלתה גם שאלה האם צירוף של כמה עותקים של המודל בגישת "אנסמבל" יוכל להתחרות בביצועי Fable-5 במבחן קידוד בשם LiveCodeBench Hard — שאלה שנותרה, לפי שעה, ללא תשובה מבוססת נתונים בדיון עצמו, אך מעידה על הציפיות שהמודל מעורר בקרב המשתמשים. יחד עם זאת, המעבר לרישיון מגביל יותר עשוי לרמז שגם יצרני מודלים פתוחים מסין מתחילים לאזן בין פתיחות לבין שליטה מסחרית בטכנולוגיה שלהם.