משפחת מודלים פתוחה חדשה בשם Ornith-1.5 מגיעה עד 397 מיליארד פרמטרים
בפורום LocalLLaMA ברשת רדיט פורסמה הכרזה על משפחת מודלי שפה פתוחים חדשה בשם Ornith-1.5, הכוללת שלוש גרסאות בגדלים שונים - מ-9 מיליארד ועד 397 מיליארד פרמטרים. לפי המפרסמים, המודלים אומנו באמצעות שיטות "שיפור עצמי" ומציגים ביצועים מובילים בתחומם.
✦ נכתב אוטומטית על ידי AI מבוסס על מקורות גלויים · עבר בקרת איכות אוטומטית
הכרזה שהתפרסמה ברשת רדיט, בפורום הפופולרי LocalLLaMA המוקדש למודלי שפה שניתן להריץ באופן עצמאי, חושפת משפחת מודלים חדשה בשם Ornith-1.5. מדובר בשלוש גרסאות בגדלים שונים: מודל "צפוף" (Dense) עם 9 מיליארד פרמטרים, ומודלי MoE (Mixture of Experts, ארכיטקטורה שבה רק חלק מרשת הפרמטרים מופעל בכל בקשה) בגדלים של 35 מיליארד ו-397 מיליארד פרמטרים.
לפי הפוסט, המודלים אומנו באמצעות "אסטרטגיות שיפור עצמי" (self-improving strategies) - גישת אימון שבה המודל משתפר על בסיס פלט משלו, לצד תהליכי אימון סטנדרטיים. מפרסמי הפוסט טוענים כי המודלים משיגים ביצועים מובילים בתחומם, אם כי הפוסט המקורי אינו כולל פירוט מלא של תוצאות מבחני ביצועים (benchmarks) או השוואה שיטתית מול מודלים מתחרים. בכותרת הפוסט מוזכר גם ציון "DeepSWE 56" עבור המודל הגדול, המרמז ככל הנראה על ביצועים במבחן ייעודי הקשור לכתיבת קוד, אך פרטים נוספים על אופי המבחן לא נמסרו.
הפוסט אינו מציין באופן מפורש מי החברה או הגוף שמאחורי פיתוח Ornith-1.5, ומקור המידע היחיד הוא הפרסום ברדיט עצמו. יחד עם זאת, ההכרזה מצטרפת לגל רחב יותר של מודלי שפה פתוחים שמתפרסמים בתדירות גבוהה בחודשים האחרונים, כאשר חלק ניכר מהם מגיע מחברות סיניות כמו DeepSeek ו-Qwen, שהצליחו למקם מודלים פתוחים בראש טבלאות דירוג ביצועים לצד מודלים סגורים של חברות מערביות כמו OpenAI ו-Anthropic.
המשמעות של הכרזות מסוג זה, ככל שהן מתאמתות, היא המשך מגמת התחרות הגוברת בשוק מודלי השפה הפתוחים - תחום שבו כל שחקן חדש עשוי לשנות את מפת הביצועים והזמינות עבור מפתחים וחוקרים שמעדיפים להריץ מודלים באופן עצמאי במקום להסתמך על שירותי API סגורים. עם זאת, מכיוון שמדובר בפוסט קצר יחסית בפורום קהילתי ולא בהודעה רשמית או מאמר טכני (paper) מפורט, יש להמתין לאימות עצמאי של הנתונים והביצועים המדווחים לפני שניתן לקבוע את מיקומו המדויק של Ornith-1.5 מול מודלים מתחרים בשוק.
פרסומת
הכתבה הבאה
Meta הריצה פרסומות לאפליקציית deepfake שיצרה תוכן פורנוגרפי של דמות הדומה לפוליטיקאית אמריקאית בכירה אפליקציית AI בשם Kromix פרסמה במטא פרסומת שהציגה סרטון deepfake של אישה הדומה לפוליטיקאית אמריקאית בכירה בסצנה פורנוגרפית, כחלק ממערך פרסומות רחב יותר לאפליקציה. הפרסומות רצו למרות מדיניות מטא האוסרת תוכן מיני, ומעלות שאלות על יעילות מנגנוני הבקרה של החברה. → לכל הכתבות