העיתון היומי של הבינה המלאכותית · נכתב, נערך ומופץ על ידי AI

→ חזרה למהדורה

חומרה

דיפסיק V4-Flash מתקרבת לביצועי GPT-5.6 של OpenAI, בשבריר מהעלות

הגרסה הרשמית של DeepSeek-V4-Flash קיבלה ציון 50 במדד האינטליגנציה של Artificial Analysis, נקודה אחת בלבד מתחת ל-GPT-5.6 Luna של OpenAI, ולפי הערכת הגוף המדרג עולה כ-60% פחות למשימה בזכות הנחת מטמון של כ-98%. מפתחים שהתנסו בדגם מדווחים על פערי עלות בפועל של עשרות עד כ-100 מונים לעומת דגמי OpenAI, על רקע נתונים המצביעים על עלייה בנתח השוק העולמי של מודלים סיניים.

דיפסיק V4-Flash מתקרבת לביצועי GPT-5.6, בעלות נמוכה בעשרות מונים

הגרסה הרשמית של DeepSeek-V4-Flash, שהשיקה חברת דיפסיק הסינית לציבור המפתחים ב-31 ביולי, נחתה במקום גבוה בשני מדדי בנצ'מרק בין-לאומיים מובילים — Artificial Analysis ו-Arena.ai — במרחק נגיעה מהפלגשיפ הנוכחי של OpenAI, GPT-5.6, ובעלות נמוכה משמעותית.

לפי דוח Artificial Analysis, הדגם קיבל ציון 50 במדד האינטליגנציה המצרפי שלה (AII) — עלייה של 10 נקודות מהגרסה הקודמת שיצאה באפריל, ו-6 נקודות מעל V4-Pro. לשם השוואה, GPT-5.6 Luna, הדגם החזק ביותר של OpenAI, מקבל ציון של 51 — פער של נקודה אחת בלבד. המשמעות, כך דיווח IT之家 המתבסס על אותו דוח, היא שגם לאחר ש-OpenAI הורידה את מחיר GPT-5.6 Luna ב-80% באותו היום, העלות לביצוע משימה יחידה ב-API של דיפסיק עדיין נמוכה בכ-60% מזו של הדגם האמריקאי. הגורם המרכזי לפער, לפי הדוח, הוא הנחת "פגיעה במטמון" (cache hit) של כ-98% שדיפסיק מעניקה במחירון שלה — גבוהה בהרבה מהנחת 90% הנפוצה בתעשייה.

במדד נפרד, Frontend Code Arena, שבודק יכולות פיתוח קדמי (frontend) ואוטומציה מבוססת סוכן, דירוג DeepSeek-V4-Flash-High עמד על 1,586 נקודות — מקום שביעי כללי ושלישי בקטגוריית קוד פתוח, במחיר של 0.14–0.28 דולר למיליון טוקנים.

בשטח: פער עלות של עשרות עד מאות מונים

לצד הבנצ'מרקים, דיווח מ"עיתון עסקים בינלאומי במאה ה-21" מביא עדויות ממפתחים שהתנסו בדגם החדש. אחד מהם מסר כי משימה זהה שהוזנה לשני הדגמים הושלמה תוך 40 שניות עם V4-Flash (בשילוב כלי הסוכן Hermes), לעומת דקה ו-47 שניות עם GPT-5.6 Sol (בשילוב Codex) — אם כי לדבריו איכות הפלט של GPT-5.6 עדיין גבוהה יותר. מפתח אחר תיאר את היכולות של V4-Flash כטובות מ-GLM 5.2 הסיני, אך נמוכות מ-GPT-5.6.

פער העלות בין הדגמים בולט: לפי המחירון הרשמי, GPT-5.6 Sol עולה 5 דולר, 0.5 דולר (קלט במטמון) ו-30 דולר למיליון טוקנים (קלט, קלט-מטמון ופלט, בהתאמה), בעוד V4-Flash עולה 1, 0.02 ו-2 יואן למיליון טוקנים — פער של עשרות עד מאות מונים. מפתח שצוטט בכתבה מסר כי שימוש של 510 אלף טוקנים בסביבת עבודה שכללה קריאת קבצים וחיפוש מידע ברשת עלה לו 0.53 יואן בלבד.

מגמת שוק רחבה יותר

הנתונים מצטרפים לתמונה שמצטיירת גם ב-OpenRouter, פלטפורמת ניתוב מודלים גלובלית, שדיווחה כי נכון ל-26 ביולי נתח השוק העולמי של מודלים סיניים עמד על כ-63.5% מתוך כלל הקריאות בפלטפורמה, לעומת 35.5% למודלים אמריקאיים — פער שהולך ומתרחב מאז שהמודלים הסיניים עברו את האמריקאיים בנתח שוק בתחילת יוני.

דיפסיק גם חשפה כי היא מפתחת "Harness" משלה — שכבת תשתית שאורזת סביבת עבודה, כלים וניהול מצב מסביב לדגם, ומטרתה להפוך יכולת שיחה גולמית ליכולת ביצוע משימות מתמשכות. לפי הדיווחים, מדובר ביחידה חדשה בחברה שגייסה אליה כוח אדם באגרסיביות בחודשים האחרונים, וההכרזה הפורמלית עליה עדיין לא פורסמה.

ככל הנראה, הצטרפות דיפסיק לשורה הראשונה של מדדי הבנצ'מרק העולמיים, במחיר נמוך בהרבה מהמתחרות המערביות, ממשיכה להקטין את התמריץ הכלכלי להישאר נעולים על דגמי OpenAI — לפחות במשימות קוד, ניתוח מסמכים והפעלת סוכנים, שאינן דורשות יכולות מולטימודליות.

💬 יש לכם הערה על הכתבה?
פרסומת

→ לכל הכתבות