דיון ברשת: מודלים נעשו אמינים יותר, אבל לא בהכרח חכמים יותר
דיון שהתפתח ברשת החברתית Reddit טוען שחברות הבינה המלאכותית התמקדו בתיקון תקלות פומביות מביכות של מודלים — כמו ספירת אותיות שגויה במילה 'strawberry' והשוואה מוטעית בין 9.11 ל-9.9 — במקום בשיפור היכולות המהותיות. הפוסט מפנה לבנץ'מארק בשם SciCode כתמיכה לטענה שהמודלים לא בהכרח נעשו חכמים יותר.