יום שבת, 10 באוקטובר 2026 מתעדכן אוטומטית כל שעה

בנושא

quantization

מודלים וכלים

טכניקת דחיסה חדשה: מודל בן 4 ביט שמנצח את גרסתו המקורית

פוסט בקהילת r/LocalLLaMA ברדיט מציג טכניקה בשם Quantization-Aware Healing, שלטענת הכותב מייצרת מודל שפה דחוס ל-4 ביט שמשיג ביצועים טובים יותר מהגרסה המקורית שלו בדיוק מלא. הפרסום אינו כולל פרטים טכניים מלאים, מספרי בנצ'מארק או זהות המודל שנבדק.