יום שישי, 2 באוקטובר 2026 מתעדכן אוטומטית כל שעה
→ חזרה למהדורה

סוכן קוד פתוח מנסה לשפר שיא בבעיה מתמטית פתוחה — בשידור כמעט חי

פרויקט קוד פתוח בשם Artificium מריץ סוכן AI אוטונומי, מבוסס על מודל Qwen בן 27 מיליארד פרמטרים, בניסיון לשפר שיא קיים בבעיית כיסוי קומבינטורית פתוחה הידועה כ-C(25,15,5). כל התהליך - הזיכרונות, הקוד והפעולות של הסוכן - מתפרסם בציבור, כך שניתן לעקוב ולבדוק את התוצאות באופן עצמאי; נכון לרגע זה טרם פורסם פתרון משופר.

פרויקט קוד פתוח בשם Artificium מריץ סוכן AI אוטונומי בניסיון לשפר שיא קיים בבעיה קומבינטורית פתוחה, ומשדר את התהליך בפומבי כמעט בזמן אמת. הסוכן, המבוסס על מודל השפה הפתוח Qwen בגרסת 27 מיליארד פרמטרים בכימות 4-סיביות (4-bit), רץ על כרטיס גרפי מסוג RTX 5090 המושכר בשירות הענן Runpod, ופועל על הבעיה המוכרת בתור C(25,15,5) — מציאת המספר הקטן ביותר האפשרי של קבוצות בנות 15 מספרים, מתוך 25 מספרים, כך שכל חמישיית מספרים אפשרית תהיה מוכלת לפחות בקבוצה אחת. ניתן לעקוב אחרי הניסיון ולבדוק את תוצאותיו באופן עצמאי בעמוד הפרויקט.

בעיות מהסוג הזה, המכונות "עיצובי כיסוי" (covering designs), עוסקות במציאת המספר המזערי של תת-קבוצות בגודל קבוע שיחד "מכסות" את כל תת-הקבוצות האפשריות בגודל קטן יותר מתוך קבוצה נתונה, לפי ההגדרה בוויקיפדיה. במקרה הנוכחי, מתוך 25 מספרים יש 53,130 חמישיות אפשריות, וכל אחת מהן צריכה להופיע בלפחות אחת מהקבוצות בנות 15 המספרים. השיא הקיים ברשימת הפתרונות המתועדים - 42 קבוצות, שנרשם על ידי פרנקו אצני (Franco Atzeni) ב-6 בספטמבר 2026 במאגר הייעודי לבעיות מסוג זה - הוא נקודת המוצא של הניסוי; המטרה שהוצבה לסוכן היא להגיע ל-41 קבוצות או פחות.

לפי פוסט שפרסם מפתח הפרויקט בפורום r/LocalLLaMA, ריצת הסוכן נמשכת כבר למעלה מ-50 שעות ועיבדה למעלה מ-100 מיליון טוקנים - נתון שלא אושר במפורש בעמוד הפרויקט עצמו, שבו השדות המקבילים (משך הריצה, טוקנים, זיכרונות, קריאות לכלים) מוצגים ללא ערך סופי בזמן הבדיקה. הפרויקט מפרסם את "זיכרונות" הסוכן, קוד שהוא כותב לעצמו, וסיכום פעולותיו לקובץ נתונים ציבורי ב-Hugging Face, כך שכל אדם יכול לקרוא את שרשרת ההיגיון של הסוכן ולבדוק את הפתרונות שהוא מציע, בלי להעמיס על השרת שמריץ אותו.

נכון לתמונת המצב האחרונה שפורסמה, הסוכן טרם פרסם מועמד לפתרון משופר, ועמוד הניסוי מציין במפורש שהוא "ממתין למועמד". כלומר, בשלב זה אין אישור לכך שהושג שיפור בפועל על פני הרשומה הקיימת בת 42 הקבוצות.

המשמעות המעניינת בניסוי הזה נעוצה פחות בתוצאה עצמה ויותר בשיטה: מדובר בבעיה שהפתרון לה ניתן לאימות אוטומטי ומדויק - כל הצעה אפשר לבדוק במחשב אם היא אכן מכסה את כל 53,130 החמישיות, בלי צורך בשיפוט אנושי סובייקטיבי. תכונה כזו הופכת ככל הנראה בעיות כיסוי קומבינטוריות למקרה מבחן נוח יחסית להערכת היכולת של סוכני AI לעבוד באופן עצמאי לאורך זמן ארוך - לבנות לעצמם כלים, לצבור זיכרון ולנסות גישות שונות ברצף. אם וכאשר יעלה הסוכן מועמד תקין ל-41 קבוצות, אותה בדיקה פשוטה תהיה גם מה שיקבע אם אכן מדובר בשיפור אמיתי על פני השיא הקיים.

💬 יש לכם הערה על הכתבה?
פרסומת

→ לכל הכתבות