DeepSeek חושפת את V4-Flash עם ראייה — וטוענת שהוא משתווה לצמרת של Anthropic

DeepSeek הסינית הציגה את DeepSeek-V4-Flash-Vision-Exp, גרסה ניסיונית עם יכולת vision של ארכיטקטורת V4 Flash שלה, שהחברה טוענת שמתחרה מקרוב ב-Opus 4.8 מדרגת העל של Anthropic בהערכות agent מולטימודליות. המודל זמין למפתחים דרך פלטפורמת ה-API של DeepSeek וממוצב כאופציה מולטימודלית בעלות נמוכה.
מבחינה טכנית, השחרור מוסיף הבנה חזותית ל-V4 Flash תוך שמירה על ה-benchmarks החזקים בטקסט של מודל הבסיס. DeepSeek אומרת שהוא יכול לעבד, להעריך ולבצע משימות על בסיס קלט חזותי — סוג היכולת של קריאת screenshots וניווט ב-UI שהופכת מרכזית יותר ויותר ל-workflows של agent. הכינוי 'Exp' מסמן אותו כניסיוני, מה שמרמז שה-stack החזותי עדיין מבשיל.
ההשקה היא נקודת נתונים נוספת בצמצום המהיר של פער החזית על ידי סין. Qwen 3.8 של Alibaba סגרה חלק ניכר מפער החשיבה על benchmarks מאומתים, אם כי אנליסטים מציינים שהמודלים הסיניים עדיין מפגרים אחרי חברות ה-AI האמריקאיות בקוד מבוסס-agent. הטענה של DeepSeek לשוויון עם Opus 4.8 בהערכות מולטימודליות — אם תעמוד במבחן בדיקה עצמאית — תסמן אבן דרך בולטת ל-AI מולטימודלי פתוח ובעל עלות נמוכה.
טענות שוויון כאלה ראויות לספקנות עד שגורמי צד שלישי ישחזרו אותן; בחירת ה-benchmarks ומתודולוגיית ההערכה מעצבות מאוד את המסגור של 'מתחרה בדרגת העל'. עדיין, הלחץ התחרותי אמיתי: DeepSeek ו-Qwen מאלצות את חברות ה-AI המערביות להגן הן על היכולת והן על המחיר. הקוראים צריכים לעקוב אחר benchmarks מולטימודליים עצמאיים, האם מודל ה-vision הניסיוני יתקדם לשחרור יציב, וכיצד יגיבו Anthropic ו-OpenAI לתחרות מולטימודלית סינית בעלות נמוכה.