יום שישי, 2 באוקטובר 2026 מתעדכן אוטומטית כל שעה

בנושא

שבבי AI

אלבבה מתכננת מודל ענק עם עד 10 טריליון פרמטרים - ומגבה אותו בחומרה משלה

מנכ"ל אלבבה אדי וו הכריז בכנס Apsara על תוכנית לאמן מודל בינה מלאכותית בהיקף של 5 עד 10 טריליון פרמטרים, פי שניים עד ארבעה מהדגל הנוכחי Qwen 3.8 Max. לצד זה הציגה אלבבה את שבב ה-AI‏ Zhenwu V900 וסופר-נוד M890, כחלק מאסטרטגיית "full-stack" שמשלבת מודלים, שבבים וענן.

Huawei מוותרת על התפשטות גלובלית של שבבי AI בשל ביקוש סיני חזק

חברת הבינה המלאכותית הסינית DeepSeek מתכננת לפרוס לפחות 160 אלף מאיצי AI מתקדמים של Huawei במרכז נתונים ענק שנבנה במונגוליה הפנימית — אחד המצבורים הגדולים הידועים של שבבי Huawei מסוגם. אך קיבולת הייצור המוגבלת של Huawei, הנובעת ממחסור ברכיבים כמו זיכרון מתקדם, מחייבת אותה להעדיף לקוחות מקומיים על פני התפשטות לשווקים בחו"ל.

הואווי מקדימה את השקת שבב ה-AI הבא שלה ומציגה ארכיטקטורה שתחבר עד מיליון מעבדים למחשב אחד

הואווי הודיעה בכנס Huawei Connect כי שבב ה-Ascend 960DT יושק ברבעון הראשון של 2027, חצי שנה לפני התכנון המקורי, והציגה את ארכיטקטורת Peerium המבוססת על טכנולוגיית החיבור UnifiedBus. המהלך נועד לפצות על מגבלות הייצור שמטילה ארה"ב באמצעות חיבור מאות אלפי שבבים למערכת מחשוב אחת, ומגיע שבוע לפני פגישת טראמפ ושי בוושינגטון.

OpenAI חושפת את Jalapeño, שבב ה-AI הראשון שפיתחה בעצמה

OpenAI חשפה ב-25 באוגוסט את Jalapeño, ה-AI accelerator הראשון שפיתחה בעצמה, שלפי בדיקות החברה מקטין latency בעד פי 3.6 בהשוואה ל-GB300 של Nvidia. מעבר לביצועים, הכתבה מתארת כיצד OpenAI השתמשה במודלי השפה שלה כדי לזרז את תהליך תכנון השבב עצמו, בשיתוף עם ברודקום.

Anthropic משיקה את Fable 5.1 ו-Mythos 5.1, בעיצומה של התחרות הטכנולוגית בין ענקיות ה-AI

Anthropic פרסמה עדכון גרסה 5.1 לשני ממודלי Claude שלה - Fable ו-Mythos - כפי שעלה מהכרזות רשמיות ומדיווחים שהופצו ברשתות החברתיות. ההשקה מגיעה ימים ספורים לאחר ש-OpenAI חשפה שבב הסקה ייעודי משלה, Jalapeño, שלפי דיווחים עולה בביצועים על שבבי Blackwell של Nvidia - סימן נוסף לקצב התחרות המתמשך בין חברות ה-AI המובילות.

Nvidia משקיעה 3.5 מיליארד דולר ב-MediaTek: ההימור על שותפות מול תחרות השבבים

Nvidia משקיעה 3.5 מיליארד דולר ב-MediaTek הטאיוואנית, במסגרת עסקה שתאפשר לחברה לתכנן שבבי AI מותאמים אישית עבור ספקיות ענן ומעבדות AI, תוך שילוב בתשתית NVLink Fusion של Nvidia. המהלך, שבא בעקבות שותפות דומה עם AWS, ממחיש כיצד Nvidia מנסה לשמור על מעמדה המרכזי בשוק גם מול חברות טכנולוגיה שמפתחות שבבי AI משלהן.

חברת ה-AI הסינית Z.ai משדרת מודל שפה במלואו על שבבים מקומיים

החברה הסינית Z.ai דיווחה כי היא מפעילה את המודל שלה GLM-5.3-Flash באמצעות שבבי בינה מלאכותית סיניים בלבד, ללא תלות בחומרה אמריקאית. הידיעה הופצה בפורום r/singularity ברדיט על ידי המשתמש u/yogthos.

אמזון משלשת את הזמנת שבבי Nvidia: עוד 2 מיליון מעבדים ל-AWS על רקע ביקוש שחורג מהתחזיות

אמזון ו-Nvidia הודיעו על הרחבת שיתוף הפעולה ביניהן, הכוללת הזמנה של עוד 2 מיליון מעבדי GPU עבור מרכזי הנתונים של AWS בשנים 2027-2028. ההודעה, שווה ככל הנראה עשרות מיליארדי דולרים, מגיעה חמישה חודשים בלבד אחרי הזמנה קודמת של יותר ממיליון שבבים, ומשקפת האצה בביקוש לתשתיות בינה מלאכותית.

Nvidia חוצה סף היסטורי: תחזית להכנסות של 108 מיליארד דולר ברבעון

Nvidia דיווחה על הכנסות שיא של 96.2 מיליארד דולר ברבעון האחרון, בעיקר הודות לפעילות מרכזי הנתונים שהוכפלה בהשוואה שנתית, וצופה כי ברבעון הקרוב ההכנסות יזנקו ל-108 מיליארד דולר. בפלח הצרכני, לעומת זאת, הקצב איטי בהרבה, על רקע מחירי זיכרון גבוהים ומחסור ברכיבים.

אנבידיה שילמה 20 מיליארד דולר על רישיון לטכנולוגיית גרוק — בלי לרכוש את הסטארטאפ

בסוף 2025 שילמה אנבידיה 20 מיליארד דולר על רישיון כולל לחומרה ולטכנולוגיה של סטארטאפ שבבי ה-AI גרוק (Groq), במקום לרכוש את החברה במלואה. מבנה העסקה חוסך לאנבידיה בדיקה רגולטורית, ולפי דיווח חדש הוא חלק ממהלך רחב יותר להתחרות בשוק מודלי ה-AI הפתוחים.

Nvidia מייקרת שרתי AI: עליית מחירים של 15% ומעלה בעקבות התייקרות רכיבי זיכרון

לקוחות גדולים של Nvidia קיבלו הודעה על עליית מחירים של יותר מ-15% בשרתי בינה מלאכותית, כך דיווח בלומברג. העלייה, שתיכנס לתוקף בתחילת 2027, נובעת מהתייקרות דרמטית של שבבי זיכרון DRAM ותשפיע גם על מערכות עם השבבים המובילים Vera Rubin ו-Grace Blackwell.

מהנדס פרטי פיצח שבב AI סיני ובנה לו קומפיילר בקוד פתוח

מהנדס שעובד באופן עצמאי הנדס לאחור את פורמט הרגיסטרים של יחידת ה-NPU בשבב RK3588 הסיני, ובנה קומפיילר וסביבת ריצה בקוד פתוח שמאפשרים להריץ עליו מודלים ישירות מ-PyTorch, ONNX ו-JAX, בלי להזדקק ל-SDK הקנייני של היצרן. בפוסט שפרסם ב-Reddit הוא מדגים הרצת GPT-2 במהירות של 36 טוקנים בשנייה על החומרה הזו.

סין מאפשרת כניסת שבבי H200 של Nvidia כדי לסייע לחברות ה-AI המקומיות שלה

בייג'ינג מתירה לחברות טכנולוגיה סיניות, ובהן ByteDance ו-Tencent, לרכוש שבבי H200 של Nvidia בכמויות מוגבלות – מהלך שנועד לסייע לתעשיית ה-AI המקומית להתמודד עם פערי חומרה מול ארה״ב, על אף בקרות הייצוא האמריקאיות.

AMD מדווחת על ספציפיקציות ל-Helios: מחשב GPU ענק שמכוון אל נבידיה

על פי דיווחים שהתפרסמו ברשת, AMD חשפה פרטים על מערכת ה-AI הענקית שלה, Helios, הכוללת ככל הנראה עשרות מאיצי MI455X ונפח משמעותי של זיכרון HBM4. הפרטים טרם אומתו באופן עצמאי, אך המערכת מוצגת כמתחרה הישירה ביותר עד כה למערכת Vera Rubin NVL72 של נבידיה.

Groq גייסה 350 מיליון דולר במעבר מייצור שבבי AI לשירותי ענן ייעודיים

סטארטאפ השבבים Groq גייס 350 מיליון דולר בהובלת קרן Disruptive, עם השתתפות מתוכננת של Nvidia, לפי שווי של 3.5 מיליארד דולר — ירידה חדה מהשווי של 6.9 מיליארד דולר בספטמבר האחרון. הגיוס ממחיש את המעבר של החברה מייצור שבבים משלה לספקית תשתיות ענן המבוססות על מערכות Nvidia.