גוגל משיקה את llama.app: כלי להרצת מודלי AI מקומית במחשב האישי
גוגל השיקה את llama.app, כלי המבוסס על מנוע הקוד הפתוח llama.cpp להרצת מודלי AI ישירות על המחשב האישי, ללא צורך במפתחות API ובלי שליחת נתונים לענן. הכלי תומך במגוון רחב של חומרה ומגיע עם גישה מהירה למודלים כמו Gemma 4, GPT-OSS ו-Qwen 3.8, ומסמן ככל הנראה עניין גובר של חברות הענן הגדולות בהרצה מקומית של בינה מלאכותית.
✦ נכתב אוטומטית על ידי AIמבוסס על מקורות גלויים · עבר בקרת איכות אוטומטית
גוגל השיקה כלי חדש בשם llama.app, המיועד להרצת מודלי AI ישירות על המחשב האישי של המשתמש, ללא תלות בשרתי ענן. ההכרזה פורסמה בחשבון ה-X הרשמי googlegemma, הקשור לצוות Gemma של גוגל, ואותרה על ידי משתמשים בפורום r/LocalLLaMA. הכלי, כך על פי אתרו הרשמי, בנוי מעל מנוע הקוד הפתוח llama.cpp ומוגדר כפרטי, ללא טלמטריה וללא הגבלות שימוש.
מה זה בעצם עושה
לפי אתר llama.app, ההתקנה נעשית בשורת פקודה אחת (סקריפט curl), או דרך מנהלי חבילות כמו Brew ו-Winget, וגם מקוד המקור עצמו. לאחר ההתקנה ניתן להריץ שרת מודל מקומי בפקודה llama serve, ולחבר אליו כלי קידוד AI מקומי בשם Pi באמצעות תוסף בשם pi-llama — לדברי גוגל, החיבור נעשה אוטומטית, ללא צורך בהגדרות או במפתחות API, וכל הבקשות נשארות במחשב המשתמש.
מבחינת חומרה, החברה מציינת ש-llama.app "מותאם לכל חומרה" — מ-Apple Silicon (M Ultra, M Pro, M Max) ועד כרטיסי מסך כמו RTX 5090, RTX 4090, RTX 3090, H100, A100, B200, MI300 ו-Radeon RX, וכן מעבדים ייעודיים כמו Jetson ו-DGX Spark, לפי הרשימה המופיעה באתר הכלי.
האתר גם ממליץ למשתמשים החדשים על ארבעה מודלים להרצה ראשונה: Qwen 3.8 של עליבאבא (מודל דחוס בגודל 27 מיליארד פרמטרים עם חלון הקשר של 256K, מותאם לקוד ולמשימות סוכניות), Gemma 4 של גוגל עצמה (המבוסס, לפי התיאור באתר, על טכנולוגיית Gemini 3, עם תמיכה ביותר מ-140 שפות), GPT-OSS של OpenAI (המודלים הפתוחים הראשונים של החברה מאז GPT-2, עם יכולות קריאה לפונקציות וכלים), ו-Gemma 3, הדור הקודם של מודלי גוגל הפתוחים, עם חלון הקשר של עד 128K.
למה זה מעניין
llama.cpp, המנוע שעליו מבוסס הכלי, הוא פרויקט קוד פתוח ותיק המשמש שנים להרצת מודלי שפה על חומרה צרכנית. השקת כלי רשמי מטעם גוגל שעוטף אותו בממשק נוח להתקנה ולשימוש — במקום להשאיר את התחום הזה לקהילה בלבד — היא ככל הנראה אינדיקציה לכך שגם שחקניות הענן הגדולות רואות ערך עסקי בהרצה מקומית של בינה מלאכותית, ולא רק במודלים סגורים שרצים על השרתים שלהן.
המשמעות המעשית למשתמשים היא אפשרות להריץ מודלים מתקדמים, כולל מודל Gemma של גוגל עצמה, בלי לשלוח נתונים לשרת חיצוני ובלי לשלם על קריאות API — יתרון שרלוונטי בעיקר למפתחים, לחוקרים ולארגונים הרגישים לפרטיות נתונים. עם זאת, מאחר שהמקורות הזמינים אינם כוללים את תוכן ההודעה הרשמית של גוגל במלואה, לא ניתן לאשר בשלב זה פרטים נוספים כמו לוח זמנים לעדכונים או היקף התמיכה הרשמית שגוגל מתכננת להעניק לכלי.