טכניקת דחיסה חדשה: מודל בן 4 ביט שמנצח את גרסתו המקורית
פוסט בקהילת r/LocalLLaMA ברדיט מציג טכניקה בשם Quantization-Aware Healing, שלטענת הכותב מייצרת מודל שפה דחוס ל-4 ביט שמשיג ביצועים טובים יותר מהגרסה המקורית שלו בדיוק מלא. הפרסום אינו כולל פרטים טכניים מלאים, מספרי בנצ'מארק או זהות המודל שנבדק.