ב-IFA 2026 הציגה NVIDIA, בשיתוף פעולה עם שותפים כולל מיקרוסופט, מארז כלים להרצת עוזרי AI מקומית על מחשבים ביתיים, ובראשם PAIR — כלי קוד פתוח שמחבר בין מחשבים ברשת הבית לרשת חישוב משותפת. לצד זאת יושקו באוקטובר מחשבי RTX Spark קומפקטיים, ואפליקציות כמו Perplexity Portable Computer, Hermes Agent ו-OpenClaw יקבלו התקנה מקומית מפושטת.
✦ נכתב אוטומטית על ידי AIמבוסס על מקורות גלויים · עבר בקרת איכות אוטומטית
NVIDIA הציגה ב-IFA 2026 בברלין, בשיתוף פעולה עם שותפים כולל מיקרוסופט, מארז כלים שמטרתו להריץ עוזרי AI ("agents") ישירות על מחשבים ביתיים במקום להסתמך על שרתי ענן. בליבת ההכרזות עומד PAIR (Personal AI Router) — כלי קוד פתוח וחינמי שמחבר בין מחשבים בבית לרשת חישוב משותפת — לצד מחשבי RTX Spark קומפקטיים שיגיעו לשוק באוקטובר.
לפי ההודעה הרשמית של NVIDIA, PAIR מזהה אוטומטית מחשבים תואמים ברשת הביתית ומחלק ביניהם עומסי הסקה (inference) של מודלי AI כשהם פנויים. הכלי, כך מדווח The Verge, תומך בכרטיסי מסך מסדרת GeForce RTX 20 ומעלה, כרטיסי RTX Pro, מחשבי DGX Spark, וגם במחשבי מק עם שבבי M4 ומעלה. החיבור בין המכשירים מאובטח באמצעות קוד בן שש ספרות ופרוטוקול mTLS (Mutual TLS) המצפין את התקשורת. הגרסה הראשונית (beta) של PAIR זמינה כבר היום עבור Windows, Linux ו-macOS.
מנהל המוצר של NVIDIA, סת שניידר (Seth Schneider), הדגים ל-The Verge תרחיש של בית עם כמה מחשבים חזקים — נייד RTX Spark, מחשב DGX Spark, נייד עם RTX 5090 ומחשב גיימינג — שביחד מספקים כ-165 טרהפלופס של כוח חישוב שאינו מנוצל. לדבריו, "זהו למעשה אוצר של טוקנים חינמיים שפשוט יושבים היום בבתים". עם זאת, כשנשאל מי הקהל הריאלי עבור הכלי, הוא ציין שרוב המשתמשים הצפויים מחזיקים בפועל בציוד צנוע יותר — מחשב נייד אחד (מק או Windows) לצד מחשב גיימינג אחד.
לצד PAIR, שלוש אפליקציות סוכני AI נפוצות — Hermes Agent, OpenClaw ו-Perplexity Portable Computer — יקבלו תהליך התקנה מקומי מפושט על מחשבי Windows עם כרטיסי NVIDIA, כך שהפעלת סוכן AI מקומי תדרוש מספר קליקים בלבד במקום הגדרה ידנית של מודל, שרת הסקה ורמת דחיסה (quantization). כלי Perplexity Portable Computer, שהושק בחודש שעבר עבור Linux ומחשבי DGX Spark עם כרטיס בעל 24GB VRAM לפחות, מאפשר הרצת משימות מקומית ללא צריכת קרדיטים, עם אפשרות "לשלוח" חלקים מהמשימה לענן ולמעלה מ-15 מודלים מתקדמים כשנדרש כוח חישוב נוסף — אך רק לאחר בקשת אישור מהמשתמש. תמיכה ב-Windows צפויה להגיע בקרוב. NVIDIA מציינת גם שיפור מהירות הסקה מקומית של עד פי 1.9 בזכות אופטימיזציות חדשות ל-llama.cpp ו-vLLM, הזמינות גם דרך LM Studio ו-Ollama.
בתחום החומרה, מחשבי RTX Spark החדשים — שיוצרו על ידי Lenovo ו-Acer — יגיעו באוקטובר, ולפי NVIDIA חברות משחקים כמו Electronic Arts, Embark ו-Ubisoft כבר מתאימות כותרים להרצה על הפלטפורמה.
המשמעות המעשית של המהלך היא ניסיון של NVIDIA למצב את עצמה לא רק כספקית שבבים לענן, אלא גם כמי שמניעה תשתית AI בתוך הבית עצמו — כך שמשתמשים יוכלו להריץ מודלים חזקים, ולעיתים גם לחבר בין כמה מחשבים בבית לכוח חישוב משותף, מבלי לשלוח נתונים החוצה או לשלם עבור כל שאילתה בענן. ככל הנראה, זהו גם ניסיון להתמודד עם עלייה בביקוש לפרטיות ולעצמאות מספקי ענן, בפרט לנוכח הריבוי המהיר של מודלים פתוחים (open source) שניתן להריץ מקומית — מגמה שהואצה בחודשים האחרונים עם שחרור מודלים כמו Nemotron של NVIDIA עצמה, לצד מודלים מבתי יוצר אחרים.