DeepSeek משיקה V4-Flash-Vision — מודל multimodal ניסיוני על רקע קדחת IPO של 86 מיליארד דולר

DeepSeek השיקה את DeepSeek-V4-Flash-Vision-Exp, הרחבה ניסיונית multimodal לפלטפורמת V4 Flash שלה, המסוגלת לנתח תמונות, צילומי מסך ו-prompts ויזואליים תוך שימור יכולות הטקסט, ה-reasoning וה-agent האוטונומי החזקות של הסדרה. משתמשים יכולים להעלות תמונות ולבקש ניתוח או משימות המשך המבוססות על התוכן הוויזואלי. דיווחים מציינים שהוא מתקרב לביצועים ברמת Opus של Anthropic ב-benchmarks של agent multimodal, תוך שמירה על יתרון העלות האופייני של DeepSeek.
קהילת ההנדסה התחברה מיד: המודל הוביל את r/LocalLLaMA (546 upvotes), ובהדגמה מרשימה של יעילות הפלטפורמה, מפתח אחד בנה engine ל-inference ב-C99 שמריץ את DeepSeek-V4-Flash (284 מיליארד פרמטרים) על 3.2GB בלבד של RAM באמצעות streaming של המודל מ-NVMe. אופטימיזציה קיצונית מהסוג הזה היא בדיוק מה שהפך את DeepSeek לגיבורת-עם בקרב חובבי המודלים המקומיים.
התזמון אסטרטגי. השחרור נוחת על רקע buzz מדווח של IPO ב-86 מיליארד דולר, וממקם את DeepSeek ישירות מול Anthropic וחברות AI מובילות אמריקאיות אחרות בתחרות ה-AI בין ארה"ב לסין. thread נפרד ב-r/DeepSeek שתמחר מחדש 'שימוש Claude Code Max 20x מול API של DeepSeek V4 Pro' טען שהתמחור החדש 'משנה לחלוטין את ההשוואה' — זווית העלות נותרת הנשק החד ביותר של DeepSeek.
לא כל הסנטימנט חיובי: thread ב-r/DeepSeek שאל 'איך זה שיש פתאום כל כך הרבה שנאה כלפי DeepSeek?' (140 תגובות), ומשקף חיכוך גאופוליטי ואמון ככל שהחברה גדלה. ההסתייגות לגבי המודל עצמו היא שהוא ניסיוני במפורש. שווה לעקוב אם V4-Flash-Vision יתקדם לשחרור יציב ואם ה-IPO יתממש בשווי השמועה.