יום שישי, 2 באוקטובר 2026 מתעדכן אוטומטית כל שעה
→ חזרה למהדורה

קוון משיקה מודל מולטימדיה ראשון, במחיר נמוך משמעותית מ-Gemini Flash

קוון, משפחת מודלי ה-AI של עלי באבא, השיקה את Qwen3.8-Omni-Flash — המודל המולטימודלי הראשון שלה, שמעבד וידאו ואודיו במקביל ומפעיל כלים באופן עצמאי. לפי נתוני החברה, ביצועיו קרובים ל-Gemini 3.8 Flash של גוגל, אך תמחורו נמוך משמעותית ממנו.

חברת קוון (Qwen) — משפחת מודלי AI של ענקית הטכנולוגיה הסינית עלי באבא — השיקה את Qwen3.8-Omni-Flash, המודל המולטימודלי (multimodal) הראשון שלה המיועד לסוכני AI. לפי ההודעה שפרסמה קוון, המודל מגיע לתוצאות קרובות לאלו של Gemini 3.8 Flash של גוגל במבחני מולטימדיה, אך במחיר נמוך משמעותית.

מה המודל יודע לעשות

Qwen3.8-Omni-Flash מעבד וידאו ואודיו יחד, מגבש מסקנות מהם, ומסוגל להפעיל כלים (tools) באופן עצמאי — למשל לערוך vlogs, לתרגם סרטונים קצרים או לסכם סרטים. חלון ההקשר (context window) שלו עומד על מיליון טוקנים. לצד המודל השיקה קוון גם את Qwen-Live Harness, מסגרת לאינטראקציה בזמן אמת דרך מצלמה ומיקרופון.

לפי הנתונים שפרסמה החברה, בביצועי audio-video המודל מתקרב לרמת הביצועים של Gemini 3.8 Flash.

פער מחירים ניכר

בעוד קוון מציגה ביצועים דומים, המחיר שונה בבירור. תמחור ה-API של Qwen3.8-Omni-Flash עומד על 0.15 דולר למיליון טוקני קלט (input) ו-0.47 דולר למיליון טוקני פלט (output). לפי הערכת החברה, עיבוד קלט אודיו עולה פחות מסנט אחד לשעה, ווידאו באיכות 720p עם אודיו בקצב פריים אחד לשנייה עולה כ-0.20 דולר — לא כולל עלות התגובה שמפיק המודל.

לשם השוואה, Gemini 3.8 Flash של גוגל גובה כיום 0.75 דולר למיליון טוקני קלט ו-3.75 דולר למיליון טוקני פלט, במחיר ההשקה שלו — ולפי המקור, המחירים הללו צפויים להכפיל את עצמם החל מ-1 בינואר 2027.

זמינות ואינטגרציה

המודל זמין דרך Qwen Studio, Qwen Cloud וה-API של החברה. קוון פרסמה גם בקוד פתוח (open source) את Qwen-MM-Plugins, שמוסיפים לסוכני AI יכולות עריכת וידאו, זיהוי דוברים, יצירת הערות מתוך וידאו בפורמט PDF, ותהליכי עבודה (workflows) לשימוש חוזר — הניתנים לחיבור לכלים כמו Claude Code, Gemini CLI ו-Qwen Code עצמו.

למה זה חשוב

ככל הנראה, ההשקה משקפת מגמה של חברות סיניות לתחר עם גוגל, OpenAI ואנתרופיק לא רק ביכולות אלא גם במחיר לטוקן — תחום שבו מודלים סיניים כמו קוון עשויים להציע יתרון מחיר משמעותי על פני מקביליהם המערביים. אם פער התמחור בין קוון לגוגל אכן יתרחב בתחילת 2027 כפי שמתואר במקור, המשמעות עשויה להיות שסוכני AI שצורכים כמויות גדולות של קלט אודיו-וידאו — כמו כלים לעריכת תוכן או תמלול (transcription) שיחות — יעדיפו יותר ויותר ספקים סינים זולים יותר על פני Gemini, בעיקר במקרים שבהם רמת הדיוק הנדרשת אינה בשיא האפשרי.

💬 יש לכם הערה על הכתבה?
פרסומת

→ לכל הכתבות