יום ראשון, 4 באוקטובר 2026 מתעדכן אוטומטית כל שעה
→ חזרה למהדורה

גוגל מעבירה את אימון המקלדת Gboard מהטלפון לשרתים מאובטחים שאפשר לבדוק מבחוץ

Google Research הציגה גרסה חדשה של federated learning: חישובי האימון עוברים מהטלפונים לסביבות מחשוב מאובטחות (TEE) בשרתים. מדיניות הגישה מתפרסמת ביומן ציבורי, וכך גורמים חיצוניים יכולים לבדוק בעצמם את הבטחות הפרטיות. המקלדת Gboard כבר משתמשת במערכת לחיזוי המילה הבאה באנגלית וביפנית.

גוגל משנה את הדרך שבה המקלדת שלה לומדת מהמשתמשים. לפי דיווח ב-MarkTechPost, חטיבת Google Research הציגה מערכת federated learning שבה חלק מרכזי של חישובי האימון כבר לא רץ על הטלפון. הוא עובר לסביבות מחשוב מבודדות ומאובטחות בשרתים, שנקראות TEE (Trusted Execution Environments). המקלדת Gboard כבר משתמשת במערכת כדי לאמן את חיזוי המילה הבאה באנגלית וביפנית.

מה היה עד עכשיו

federated learning ("למידה מבוזרת") היא שיטה שגוגל מקדמת כבר שנים, ו-Gboard היא אחת הדוגמאות המוכרות שלה. הרעיון הוא שהטקסט שהמשתמשים מקלידים נשאר במכשיר. הטלפון מחשב בעצמו את העדכון למודל, שנקרא gradient, ושולח לשרת רק את העדכון ולא את הנתונים עצמם. השרת מאחד את העדכונים ממכשירים רבים ומשפר בעזרתם את המודל המשותף.

לפי הדיווח, הגישה החדשה מעבירה את חישוב ה-gradients מהטלפונים לסביבות TEE מאומתות (attested) בצד השרת. TEE הוא אזור מבודד בחומרה, שאמור למנוע גישה לנתונים שבתוכו גם ממפעיל השרת עצמו. "אימות" (attestation) הוא מנגנון שבו הסביבה מוכיחה מבחוץ איזה קוד בדיוק רץ בתוכה.

איך אפשר לבדוק את זה מבחוץ

החידוש העיקרי הוא היכולת לבדוק את המערכת, ולא רק את ההבטחה שהיא מאובטחת. לפי הדיווח, מדיניות הגישה של המערכת מתפרסמת ביומן Rekor של פרויקט Sigstore. זהו יומן שקיפות ציבורי שנועד לתעד חתימות של תוכנה באופן שקשה לשנות בדיעבד. בנוסף, אפשר לבנות את קובצי ההרצה של המערכת מחדש בצורה זהה (reproducible builds). כלומר, גורם חיצוני יכול לקמפל בעצמו את קוד המקור ולוודא שהתוצאה זהה למה שרץ בפועל.

שני המנגנונים יחד מאפשרים, לפי הדיווח, לבדוק מבחוץ את הבטחת ה-differential privacy המרכזית (central DP). differential privacy היא שיטה מתמטית שמוסיפה "רעש" מבוקר לתהליך הלמידה, כדי שאי אפשר יהיה לשחזר מהמודל המוגמר מידע על משתמש מסוים. בגרסה ה"מרכזית" הרעש מתווסף בשלב האיחוד בשרת. לכן משתמשים נאלצו עד היום פשוט לסמוך על כך שהשרת אכן מפעיל אותו.

למה זה חשוב

המשמעות היא ככל הנראה שינוי במודל האמון: במקום לבקש מהמשתמשים להאמין להצהרות של גוגל על פרטיות, החברה מנסה לספק אמצעים שמאפשרים לחוקרים ולמבקרים חיצוניים לבדוק אותן בעצמם. למעבר החישוב לשרתים יש ככל הנראה גם יתרון מעשי, כי הוא מוריד עומס מהטלפונים, שמשאבי החישוב והסוללה שלהם מוגבלים.

עם זאת, השיטה עדיין תלויה בכך שהחומרה המאובטחת עצמה אמינה, ושמישהו אכן יבצע את הבדיקות שהמערכת מאפשרת. העובדה ש-Gboard כבר משתמשת במערכת בפועל, ולא רק במחקר, מרמזת ככל הנראה שגוגל רואה בה תשתית שאפשר להרחיב גם לשפות ולמוצרים נוספים. בשלב זה השימוש המדווח מוגבל לאנגלית וליפנית.

💬 יש לכם הערה על הכתבה?
פרסומת

→ לכל הכתבות