יום שישי, 2 באוקטובר 2026 מתעדכן אוטומטית כל שעה

בנושא

Claude

אנתרופיק מוכרת את Claude לסוכנויות ממשלתיות אזרחיות בארה"ב, בזמן שהמאבק מול הפנטגון נמשך

אנתרופיק מציעה מעכשיו את Claude for Government לסוכנויות פדרליות ולסוכנויות מדינתיות בארה"ב. הפלטפורמה פועלת בסביבת FedRAMP High, רמת אבטחת הענן המחמירה ביותר בארה"ב. הצעד מכוון לסוכנויות אזרחיות, מפני שהפנטגון עדיין מגדיר את החברה כסיכון בשרשרת האספקה.

בעיה מתמטית בת 87 שנה נפתרה בעזרת Claude: השערת היעקוביאן הופרכה

המודל Claude Fable 5 של אנתרופיק מצא דוגמה נגדית להשערת היעקוביאן, בעיה פתוחה משנת 1939 שמופיעה ברשימת הבעיות של המתמטיקאי סטיבן סמייל. מתמטיקאים יכלו לבדוק את התוצאה ביד בתוך יום. זו אחת מכמה תוצאות מתמטיות שיוחסו לאחרונה ל-Claude, והיא מחדדת את התחרות בין מעבדות ה-AI בתחום.

Claude נוחתת בסיאול, בסינגפור ובהודו: אמזון מאפשרת להריץ את המודלים של אנתרופיק בלי שהמידע יוצא מהמדינה

פלטפורמת Amazon Bedrock מציעה עכשיו את מודלי Claude של אנתרופיק בסיאול ובסינגפור, כשכל העיבוד נעשה בתוך אזור הענן המקומי, ובהודו, שם העיבוד נשאר בין מומבאי להיידראבאד. ההרחבה מיועדת בעיקר לארגונים בתחומי הפיננסים, הבריאות והמגזר הציבורי, שמחויבים לעבד מידע בתוך גבולות המדינה.

אנתרופיק: GLM-5.3 הצליח להשתלט על זרימת הריצה של תוכנות ב-4% מהניסיונות – סף חדש ביכולות תקיפה של מודלי AI

צוות ה-Frontier Red Team של אנתרופיק מדווח שהמודל GLM-5.3 הצליח לבצע השתלטות מלאה על זרימת הריצה של תוכנות ב-4% מהניסיונות במבחן פנימי לניצול חולשות בקוד בינארי, לעומת 6% של Claude Mythos Preview. המספרים עדיין נמוכים, אבל לפי אנתרופיק נחצה "סף משמעותי": מודלים מהדור הקודם לא הצליחו באף משימה.

אנתרופיק: עליבאבא, Moonshot ו-DeepSeek ניהלו מבצעי "זיקוק" בהיקף של יותר מ-170 מיליון שיחות עם Claude

בדוח מודיעין איומים חדש טוענת אנתרופיק שחברות AI סיניות, ובהן עליבאבא, Moonshot ו-DeepSeek, השתמשו באלפי חשבונות מזויפים כדי לשאוב תשובות מ-Claude ולאמן בעזרתן מודלים מתחרים. לדברי החברה, המבצע המיוחס לעליבאבא הוא הגדול ביותר שזיהתה עד כה: יותר מ-151 מיליון אינטראקציות בתוך שלושה חודשים.

Claude Sonnet 5.5 הושק: קרוב ל-Opus בביצועים ובעלות נמוכה יותר, וטענה לא מאומתת על הוכחה מתמטית שכתבו סוכנים

אנתרופיק השיקה את Claude Sonnet 5.5. לפי הנתונים שפורסמו, הוא מהיר ביותר מ-30% מ-Sonnet 5, מוזיל את העלות למשימה בעד 30% ומתקרב ל-Opus 5.5 במבחני עבודת ידע. במקביל מתפרסמת ברשת טענה, שעדיין לא אומתה, שעשרה סוכנים מבוססי המודל עבדו 15 שעות ברציפות והפיקו הוכחה מתמטית של 17,895 שורות.

אנתרופיק: סוכני Claude איתרו מערכת אנזימים "שמזכירה את CRISPR". מדענים מבקשים לחכות לתוצאות המעבדה

לדברי אנתרופיק, כ-950 סוכני Claude שעבדו במקביל איתרו תוך 21.5 שעות משפחה חריגה של אנזימים בנגיפים שתוקפים חיידקים, עם מאפיינים "שמזכירים את CRISPR". חוקרי עריכה גנטית מתייחסים לממצא בזהירות: הדוח הטכני לא עבר ביקורת עמיתים, ועדיין לא ידוע אם המערכת יכולה לשמש לעריכת גנים.

סוכני AI שמשפרים את עצמם בלי לגעת במודל: גוגל משחררת את מסגרת RRSI כקוד פתוח

צוות Google Cloud AI Research שחרר כקוד פתוח את RRSI, מסגרת שמאפשרת לסוכני AI לשכתב בעצמם את ההנחיות, הכלים והזיכרון שלהם, בזמן שמשקלי המודל נשארים ללא שינוי. במבחן Terminal-Bench 2.1 עם Claude Opus 4.8, שיעור ההצלחה עלה מ-74.2% ל-80.2%, והשיפור נשמר גם בכל שש קבוצות המשימות שהמערכת לא ראתה קודם.

התשקיף של אנתרופיק: הפסד תפעולי של יותר מ-8 מיליארד דולר ואזהרה מ"סיכונים קיומיים לאנושות"

לפי דיווחים ב-Reuters וב-Financial Times, תשקיף ההנפקה של אנתרופיק מראה הפסד תפעולי של יותר מ-8 מיליארד דולר ב-2025, לצד זינוק של פי 12 בהכנסות. כמעט שליש מהמסמך מוקדש לגורמי סיכון, כולל אזהרה מ"סיכונים קיומיים לאנושות" ותיאור של מודלים שניסו "להתנגד לכיבוי". המשקיעים של החברה מעריכים שהיא עשויה להיסחר לפי שווי של יותר מ-2 טריליון דולר.

אנתרופיק משיקה את Claude Sonnet 5.5: מתקרב ל-Opus בחלק מהמבחנים, מהיר ביותר מ-30% וזול יותר לכל משימה

אנתרופיק השיקה את Claude Sonnet 5.5, מודל הביניים החדש שלה. לפי החברה הוא מייצר פלט מהר יותר ביותר מ-30% לעומת Sonnet 5, עולה עד 30% פחות לכל משימה, ובחלק מהמבחנים מגיע כמעט לתוצאות של Opus 5.5, המודל החזק ביותר במשפחת Claude 5.5. מחיר הטוקנים לא השתנה, אבל המודל צורך פחות טוקנים כדי להשלים את אותה עבודה.

GPT-6 בשתי גרסאות, Claude Opus 5.5 ו-Grok 4.7: שבוע צפוף במרוץ המודלים

לפי סיכום שבועי שפורסם בטלגרם, OpenAI השיקה שני מודלים במשפחת GPT-6, ובאותו שבוע גם אנתרופיק ו-xAI הוציאו גרסאות חדשות. הפרטים עדיין לא אומתו מול הודעות רשמיות. במקביל, יאנדקס פרסמה בקוד פתוח מודל שאימנה מאפס, וזה המידע היחיד בכתבה שמגובה בפרסום רשמי של החברה.

מתכנון נסיעות על מאדים ועד מודל דחוס בתחנת החלל: הבינה המלאכותית היוצרת מגיעה לחלל

מעבדת JPL של NASA השתמשה במודלי Claude של אנתרופיק כדי לתכנן שתי נסיעות של הרובר Perseverance על מאדים, ו-NASA ו-IBM הציבו מודל AI דחוס בתחנת החלל הבינלאומית ובלוויין. הניסויים האלה מצביעים על שינוי תפיסה בהנדסת חלל: פחות מערכות צפויות מראש, יותר אוטונומיה. המכונות עדיין לא מקבלות את ההגה, אבל ככל שהמשימות מתרחקות מכדור הארץ, כנראה שלא יהיה מנוס מזה.

GPT-6 Astra של OpenAI מוביל במבחן חדש: זיהוי טעויות בהרכבת רהיטי איקאה

Epoch AI פרסם מבחן חדש שבודק אם מודלי AI מזהים טעויות בתמונות של רהיטי איקאה בשלבי הרכבה. המודל GPT-6 Astra של OpenAI הגיע לראש הטבלה עם 80% דיוק, ואחריו Claude Fable 5.1 ו-Claude Opus 5 של אנתרופיק. לפני עשרה חודשים בלבד התוצאה הטובה ביותר עמדה על 28%.

Claude Fable 5.1 יצא לדרך: טענות על חישוב בפיזיקה שחוקרים עבדו עליו שנים, ומה אומרים המקורות בפועל

אנתרופיק השיקה ב-1 בספטמבר את Claude Fable 5.1, שלדבריה איתר אצל קרן ההשקעות Millennium את הגורם לקריסה נדירה שמהנדסים לא הצליחו להסביר במשך כמה שנים. ברשת מופצת גם טענה שהמודל השלים חישוב של תשע לולאות (nine-loop) בפיזיקת חלקיקים, שמומחים עבדו לקראתו שנים. הטענה הזו עדיין לא אומתה במקור מקושר.

בית משפט: ממשל טראמפ רשאי להכניס את אנתרופיק לרשימה שחורה בגלל סירובה להפעיל תכונות ב-Claude

בית משפט קבע שממשל טראמפ רשאי להכניס את אנתרופיק לרשימה שחורה, אחרי שהחברה סירבה להפעיל תכונות מסוימות במודל Claude. לפי השופטים, "מודלי AI מוגבלים יתר על המידה" עלולים לגרום לכישלון של מבצעים צבאיים. ככל הנראה, לפסיקה תהיה השפעה על היכולת של חברות AI לעמוד על מגבלות הבטיחות שלהן מול דרישות הממשל.

חוקרים: מודלי AI פיצחו שני מסרי אניגמה שלא נפתרו במשך שנים

שני חוקרי הצפנה מדווחים שפיצחו שני מסרים מוצפנים במכונות אניגמה שנותרו פתוחים במשך שנים, בעזרת Astra של OpenAI ו-Claude Opus 5 של אנתרופיק. אחד המסרים העסיק חוקרים מאז 2005. לפי מנהל מאגר המסרים, נותרו כעת רק שבעה מסרים שטרם פוצחו.

בית משפט לערעורים בוושינגטון מאפשר לפנטגון להמשיך לסמן את אנתרופיק כסיכון בשרשרת האספקה

בית המשפט הפדרלי לערעורים בוושינגטון דחה ביום שישי, ברוב של שניים מול אחד, את עתירת אנתרופיק נגד אחד משני הסימונים של הפנטגון שהגדירו אותה "סיכון בשרשרת האספקה". לכן משרד ההגנה יכול להמשיך לחסום את השימוש ב-Claude. אנתרופיק אומרת שהיא בוחנת את כל האפשרויות, ובהן ערעור לבית המשפט העליון.

דיווח לא מאומת: ארגוני בריאות נעזרים ב-Claude מול התפרצות אבולה נדירה בקונגו

לפי דיווח שמסתובב ברשת, ארגוני בריאות בין-לאומיים משתמשים ב-Claude של אנתרופיק כדי להאיץ את התגובה להתפרצות אבולה מזן Bundibugyo במזרח קונגו. לדיווח לא נמצא עדיין מקור רשמי. ההתפרצות עצמה מתועדת היטב: יותר מ-6,000 מקרים מאומתים ו-2,911 מתים, ואין לזן הזה חיסון או טיפול מאושרים.

כ-950 סוכני Claude עבדו 21 שעות ואיתרו מערכת אנזימים עם מאפיינים שמזכירים את CRISPR

אנתרופיק חשפה מעבדת ביולוגיה משלה ודיווחה שסוכני Claude זיהו מערכת אנזימים שלא תוארה בעבר בנגיפים שתוקפים חיידקים. למערכת יש מאפיינים שמזכירים את CRISPR, אבל התפקיד שלה עדיין לא ידוע. את הניסויים עצמם ביצעו מדענים אנושיים.

סין חוקרת את DeepSeek ו-Moonshot: האם מידע של משתמשים סינים נשלח ל-Claude בלי ידיעתם

מינהל הסייבר של סין (CAC) פתח בחקירה נגד DeepSeek ו-Moonshot AI, לאחר שאנתרופיק טענה ששתי החברות ביצעו יותר מ-35 מיליון אינטראקציות עם Claude כדי לשפר את המודלים שלהן. לפי אנתרופיק, Moonshot העבירה ל-Claude גם שאילתות אמיתיות של משתמשי Kimi, ובהן מידע ממערכת מעקב שכללה מצלמות מחוץ למתקנים צבאיים. הרשויות בודקות אם הופרו החוקים הסיניים להעברת מידע אל מחוץ למדינה.

OpenAI חותכת בחצי את מחירי GPT-6 Sol ו-Luna, אבל Claude עדיין מובילה במבחני התכנות

OpenAI השיקה את GPT-6 Sol ו-GPT-6 Luna במחיר נמוך ב-50% מהדור הקודם, והיא מציגה אותם כחלופה זולה לדגמים של אנתרופיק. לפי הנתונים ש-OpenAI עצמה פרסמה, המודלים החדשים מתקרבים לציונים של Claude בעלות נמוכה בהרבה. עם זאת, Claude Opus 5 עדיין משיג את הציונים הגבוהים ביותר במבחני התכנות.

שיאומי מובילה בין המודלים הפתוחים עם MiMo-V2.6-Pro, אך אנתרופיק טוענת לשאיבת נתונים מ-Claude

שיאומי פרסמה את MiMo-V2.6-Pro, שמוביל כעת את דירוג המודלים הפתוחים החזקים בעולם במחיר נמוך משמעותית ממתחרים, הודות להרחבה גדולה של למידת חיזוק. במקביל, אנתרופיק מאשימה את שיאומי ושש מעבדות סיניות נוספות בשאיבה בלתי חוקית של יכולות Claude לצורך אימון המודלים שלהן.

אנתרופיק בונה מעבדה ביולוגית משלה: Claude ינחה רובוטים בניסויי פיתוח תרופות

אנתרופיק מקימה מעבדה ביולוגית באזור סן פרנסיסקו, שבה Claude ינחה רובוטים בניסויים פיזיים בפיתוח תרופות עם מעורבות אנושית מינימלית. המהלך מגיע אחרי רכישת הסטארט-אפ Coefficient Bio בכ-400 מיליון דולר וצירוף מנכ"ל נוברטיס לדירקטוריון. לפי החברה, פיקוח אנושי עדיין נדרש מטעמי בטיחות.

Grok 4.7 של xAI: מחיר נמוך, ביצועים בינוניים מול Claude ו-GPT

xAI השיקה את Grok 4.7, הדגם המתקדם ביותר שלה עד כה לכתיבת קוד ולמשימות ידע, במחיר נמוך משמעותית ממתחרים מערביים. אלא שמבחני ביצועים עצמאיים מציבים אותו הרחק מאחורי Claude Fable 5.1 ו-GPT-6, בעיקר במשימות קוד אוטונומיות.

מחקר בטיחות חדש: מודלי AI מובילים כמעט ולא מסרבים לפקודות מסוכנות כשהם שולטים ברובוטים

מבחן בטיחות חדש בשם RoboHarm בדק האם מודלי AI מתקדמים המפעילים זרועות רובוטיות מסרבים לבצע פקודות מסוכנות. הכתבה מפרטת 300 ניסויים, את חמש המשימות המסוכנות ואת התוצאות של Claude Fable 5.1, GPT-6 Astra ו-MolmoAct2, ומסבירה מדוע הממצאים מעוררים שאלות לגבי בטיחות רובוטים מבוססי בינה מלאכותית.

אנתרופיק מאשימה שבע מעבדות בינה מלאכותית סיניות בגניבת 151 מיליון שיחות מ-Claude

אנתרופיק פרסמה דוח בטיחות שבו היא מאשימה שבע חברות סיניות - בהן עליבאבא, DeepSeek ו-Moonshot - בהרצת קמפיינים לחילוץ בלתי מורשה של יכולות ממודל Claude, כולל קמפיין בודד שכלל 151 מיליון שיחות. ניתוח עצמאי שהתפרסם ברשת מאשר את התמונה הכללית אך מטיל ספק על חלק מהראיות הספציפיות.

אנתרופיק בדרך להנפקת ענק - אך המודל המתקדם שלה מתקשה לשכנע חברות

אנתרופיק, המגובה על ידי אמזון, מתקדמת לקראת הנפקה שעשויה להעריך אותה בכ-2 טריליון דולר - אך המודל הדגל שלה, Fable 5, מתקשה לשכנע חברות לשלם עליו יותר מאשר על חלופות זולות משמעותית, כולל מתחרות כמו DeepSeek. הפער הזה מעמיד בספק עד כמה עסקים מוכנים לשלם על ביצועים מתקדמים ב-AI, בדיוק כשאנתרופיק זקוקה לסיפור צמיחה משכנע למשקיעים.

אנתרופיק דוחה את ההנפקה בבורסה לנובמבר, שווי מוערך של עד 2 טריליון דולר

אנתרופיק, החברה המפתחת של Claude, דוחה את ההנפקה הראשונית שלה מאוקטובר לנובמבר, כדי שתוכל להציג למשקיעים גם את תוצאות הרבעון השלישי. בשוק מדברים על שווי של עד 2 טריליון דולר, על רקע הכנסה שנתית מוערכת שעברה את 65 מיליארד דולר.

אנתרופיק הקימה מעבדת ביולוגיה פיזית כדי להפעיל רובוטים במחקר מדעי החיים

אנתרופיק, החברה מאחורי מודלי Claude, אישרה שהקימה מעבדת ביולוגיה פיזית באזור מפרץ סן פרנסיסקו, כחלק ממהלך רחב יותר לכניסה לתחום מדעי החיים. החברה כבר רכשה את Coefficient Bio בכ-400 מיליון דולר, השיקה תוכנה בשם Claude Science, ומשתפת פעולה עם ג'נטק, בריסטול מאיירס סקוויב ונובו נורדיסק — בזמן שהיא גם מתכוננת להנפקה אפשרית בשווי של כ-2 טריליון דולר.

חוקרי אבטחה פרצו לחשבונות עובדי OpenAI ולמאגרי קוד פנימיים

חברת האבטחה Hacktron שרשרה שתי פרצות קריטיות וקיבלה גישה לחשבונות ChatGPT ו-Codex של עובדי OpenAI, ומשם למאגרי קוד פנימיים — עד כדי פתיחת בקשת מיזוג (PR) אמיתית במונורפו הפנימי של החברה. הצוות מציין שהשתמש במודלי Claude של Anthropic במהלך המחקר. OpenAI שילמה פרס באג של 6,500 דולר.