יום שישי, 9 באוקטובר 2026 מתעדכן אוטומטית כל שעה
→ חזרה למהדורה

1.8 מיליארד דולר לנתונים ביולוגיים פתוחים: גוגל DeepMind, מטא וממשל ארה"ב חוברים לבניית "תא וירטואלי"

Biohub, משרד האנרגיה האמריקאי, מכוני הבריאות הלאומיים (NIH) וחברות טכנולוגיה כמו גוגל DeepMind, Isomorphic Labs ומטא מתחייבים יחד ל-1.8 מיליארד דולר כדי לייצר נתונים ביולוגיים פתוחים שמוכנים לאימון מודלי AI. לפי היוזמה, זו ההתחייבות המתואמת הגדולה עד היום לייצור נתונים ביולוגיים בפורמט שמתאים ל-AI. המטרה היא מודלים שיחזו איך תאים מגיבים לתרופות ולהתערבויות אחרות, וכך יאיצו את פיתוח הטיפולים במחלות.

קואליציה בינלאומית של גופי ממשל, מוסד מחקר וחברות טכנולוגיה הודיעה ב-7 באוקטובר על התחייבות כוללת של 1.8 מיליארד דולר לייצור נתונים ביולוגיים שמוכנים לאימון מודלי בינה מלאכותית. השותפים הם Biohub, משרד האנרגיה האמריקאי (DOE), מכוני הבריאות הלאומיים של ארה"ב (NIH), וגם גוגל DeepMind, Isomorphic Labs ומטא. לדבריהם, זו ההתחייבות המתואמת הגדולה עד היום לייצור נתונים ביולוגיים "AI-ready". התוצר יהיה מאגר פתוח לקהילת המחקר.

מי משלם על מה

הסכום הכולל אינו רק כסף מזומן. הוא כולל גם מימון, נתונים קיימים, כוח מחשוב וטכנולוגיות מדידה חדשות. כך הוא מתחלק:

  • משרד האנרגיה האמריקאי ישקיע יותר מ-500 מיליון דולר על פני חמש שנים, דרך Genesis Mission, יוזמה בין-משרדית שהמשרד מוביל. הכסף ילך למדידות במעבדה, למידול ולמחשוב. המשרד יעמיד לרשות היוזמה את המעבדות הלאומיות שלו, ובהן מחשבי-על ברמת exascale (מיליארד מיליארדי חישובים בשנייה), מתקני פיזור קרני X ונייטרונים, מיקרוסקופיית קריו-אלקטרונים ומעבדות אוטונומיות.
  • NIH ירכז מאגרי נתונים ובסיסי ידע קיימים שפותחו בהשקעה פדרלית קודמת של יותר מ-500 מיליון דולר. Biohub תעבוד עם NIH על האחדת הנתונים לפורמט שמתאים לאימון מודלים.
  • גוגל DeepMind, ‏Isomorphic Labs ומטא משקיעות יחד 300 מיליון דולר בטכנולוגיות ובמאגרי נתונים רב-מודאליים, כלומר נתונים שמשלבים כמה סוגי מדידה.
  • Biohub הובילה את היוזמה עם התחייבות ייסוד של 500 מיליון דולר. 400 מיליון מהם מיועדים לטכנולוגיות שירחיבו את מה שביולוגים מסוגלים למדוד, למשל טומוגרפיה בקריו-אלקטרונים, שמציגה פרטים כמעט ברמה האטומית בתוך התא, ומיקרוסקופיה שיכולה לצלם מיליוני ועד מיליארדי תאים ברקמה חיה. 100 מיליון דולר נוספים יממנו מחקר מחוץ ל-Biohub.

המטרה: "תא וירטואלי"

Virtual Biology Initiative הוכרזה באפריל 2026, וההודעה הנוכחית מרחיבה אותה. המטרה היא לייצר את המדידות הבסיסיות שנדרשות כדי לאמן מודלים שחוזים התנהגות ביולוגית. בפרט, היוזמה רוצה לאסוף נתונים על תגובת תאים להתערבויות בהרבה יותר סוגי תאים ובהרבה יותר תנאים ממה שנחקר עד כה.

"מודל מדויק שחוזה את הביולוגיה יכול להאיץ מאוד את הגילוי המדעי, כי הוא יאפשר למדענים לבצע ניסויים באופן דיגיטלי", אמר אלכס רייבס, ראש תחום המדע ב-Biohub. לדבריו, בניית תא וירטואלי היא "אחד האתגרים החשובים ביותר של העידן הבא במדע", ומשימה כזו מחייבת ייצור נתונים מתואם בקנה מידה לאומי ובינלאומי.

מקס ג'דרברג, נשיא Isomorphic Labs, אמר ש"ייצור הנתונים הדרוש לביולוגיה של מערכות מנבאת מחייב לחרוג ממה שכל ארגון בודד מסוגל לייצר היום". דריו גיל, תת-שר המדע במשרד האנרגיה, תיאר את השותפות כ"צעד קריטי" בשימוש ב-AI לטובת הציבור.

למה זה חשוב

מודלי שפה גדולים (LLM) התקדמו בין השאר משום שהיו זמינות להם כמויות עצומות של טקסט. בביולוגיה המצב שונה: הנתונים יקרים לייצור, מפוזרים בין מעבדות רבות ונמדדים בשיטות שלא תמיד מתאימות זו לזו. ככל הנראה, זה החסם שהיוזמה מנסה לפרק. היא עושה זאת בשתי דרכים: מייצרת נתונים חדשים בהיקף גדול, ומאחידה לפורמט אחד נתונים קיימים שכבר מומנו בכסף ציבורי.

ההודעה אינה כוללת הערכה של חיסכון בעלויות. עם זאת, המשמעות האפשרית היא שמאגר פתוח ואחיד יוריד את סף הכניסה לחוקרים ולחברות שרוצים לאמן מודלים ביולוגיים ולא יכולים לייצר את הנתונים בעצמם. ההשתתפות של מטא ושל שתי חברות מקבוצת אלפבית מלמדת ככל הנראה שענקיות ה-AI רואות בביולוגיה תחום שבו כמות הנתונים, ולא רק המודלים, היא שתכריע.

נותרו שאלות פתוחות: מה יהיו תנאי השימוש במאגר, מתי יתפרסמו הנתונים הראשונים, ועד כמה החיזויים של "תא וירטואלי" יחזיקו מעמד מול ניסויים במעבדה. בינתיים, Biohub מזמינה את קהילת המדע העולמית להצטרף לפרויקט.

💬 יש לכם הערה על הכתבה?
פרסומת

→ לכל הכתבות