עלייבאבא השיקה בגרסת בטא את Wan3.0, מודל ליצירת וידאו שמייצר קליפים באורך של עד 30 שניות מתוך טקסט, תמונות ואף קבצי PDF ומצגות. ההשקה מגיעה על רקע הגדלה משמעותית של השקעות ה-AI של החברה, כולל גיוס הון שיא ורווח רבעוני שצנח.
עלייבאבא (Alibaba) השיקה בגרסת בטא את Wan3.0, מודל ליצירת וידאו מבוסס בינה מלאכותית שמייצר קליפים באורך של עד 30 שניות - כפול מהאורך שאפשרה הגרסה הקודמת, Wan2.5. לפי הדיווח, המודל מקבל כקלט טקסט, תמונות, קובצי PDF, מצגות PowerPoint ואף עמודי אינטרנט, והופך אותם לסרטון.
קלט מרובה-מודלים
Wan3.0 מעבד בו-זמנית טקסט, תמונות, וידאו ואודיו: פרומפט בודד יכול לכלול עד עשר תמונות, חמישה קטעי וידאו וחמישה קטעי אודיו כחומרי ייחוס. המודל גם ממליץ על אורך הסרטון המתאים ביותר בהתאם לפרומפט של המשתמש, וכולל כלי הרחבה (extension) המאפשר להאריך סרטונים קיימים מעבר לאורכם המקורי.
בעיה נפוצה במודלים ליצירת וידאו היא "סחיפה" חזותית - עיוותים שמצטברים ככל שהסרטון מתקדם, בעיקר בפנים ובממשקי משתמש. לפי עלייבאבא, Wan3.0 נועד לצמצם את התופעה באמצעות שמירה עקבית יותר על פרטים מחומרי הייחוס - דמויות, אביזרים ופריסה מרחבית של הסצנה.
זמינות ותמחור
המודל זמין דרך אתר wan.video, פלטפורמת Alibaba Cloud Model Studio, וכ-API דרך Qwen Cloud, בשתי רמות שירות: Standard, הנהנית כעת מהנחה של 30%, ו-Prime המהירה יותר. להלן התמחור לפי דקה ולקליפ מלא של 30 שניות:
| רזולוציה |
Standard לשנייה |
Prime לשנייה |
קליפ 30 שנ' (Standard) |
קליפ 30 שנ' (Prime) |
| 480p |
$0.05 |
$0.068 |
$1.50 |
$2.04 |
| 720p |
$0.10 |
$0.14 |
$3.00 |
$4.20 |
| 1080p |
$0.20 |
$0.28 |
$6.00 |
$8.40 |
למי זה מיועד
עלייבאבא מציגה טווח שימושים רחב למודל: מהאצת הפקות קולנוע ויצירת דרמות קצרות ותוכן לרשתות חברתיות, דרך עסקים שמעוניינים להפוך טקסטים ותמונות לסרטוני שיווק והדרכה, ועד חברות טכנולוגיה שיכולות להשתמש בסרטונים כחומרי סימולציה לאימון רכבים אוטונומיים ומערכות רובוטיקה.
על רקע הגדלת השקעות ה-AI
ההשקה מגיעה בעיצומה של הגדלה משמעותית בהשקעות ה-AI של עלייבאבא. החברה הכריזה לאחרונה על מכירת המניות הגדולה ביותר אי-פעם על ידי חברה הרשומה בבורסת הונג קונג, שנועדה לממן את מהלכי ה-AI שלה, ובשבוע שעבר דיווחה על ירידה של 75% ברווח הרבעוני לעומת התקופה המקבילה אשתקד - ירידה שנבעה, לפי החברה, מהשקעות ה-AI הגדולות.
היקף היכולות של Wan3.0 - קלטים מרובי-מודלים, קליפים ארוכים יחסית ומאמץ מוצהר לצמצם עיוותים חזותיים - ממקם את המודל בתחרות ישירה מול כלים מובילים כמו Sora של OpenAI ו-Veo של גוגל. ככל שהחברה תצליח להוכיח יציבות ואיכות בפועל, מדובר בצעד שעשוי לחזק את מעמדה בזירת יצירת הווידאו הגנרטיבי - אחת החזיתות התחרותיות המרכזיות בתעשיית ה-AI הגלובלית כיום.