DeepSeek משיקה את V4 Flash Vision הניסיוני לפני ה-IPO

DeepSeek שחררה את DeepSeek-V4-Flash-Vision-Exp, מודל multimodal ניסיוני הזמין בפלטפורמת ה-API שלה שמרחיב את V4-Flash מבוסס-הטקסט ביכולת קריאת תמונות וצילומי מסך תוך שמירה על יכולות הטקסט, ה-reasoning וה-agent של המודל. DeepSeek מיצבה אותו כמקרב את ביצועי ה-agent לאלו של Opus-4.8 של Anthropic, ושחררה גרסה 0.1.1 של ה-agent harness שלה עם תמיכה מובנית במודל החדש.
החברה גם עשתה open-source למה ש-HPCwire כינה 'השכבה החסרה בין מודלי AI ל-agents' — תשתית שמחברת מודלים לכלים אג'נטיים — ומחזקת את הדפוס של DeepSeek לשחרר רכיבים פתוחים חזקים שמפעילים לחץ על יריבות סגורות.
התזמון טעון: ההשקה מגיעה כש-DeepSeek מדווחת כמתכוננת ל-IPO, מה שהופך את הדגמת היכולת לתרגיל מיצוב למשקיעים לא פחות משהיא שחרור מוצר. מודל vision שמתחרה ב-agents ברמת Opus במחיר הנמוך האופייני ל-DeepSeek יהיה סיפור משכנע לקראת ה-IPO.
אבל הקהילה חשפה סתירה. בעוד V4 Flash אהוב על קהל ה-LLM המקומי — משתמשים ב-r/LocalLLaMA הציגו rigs שמריצים אותו ב-130-1000 tokens/sec על חומרה צרכנית — ב-r/DeepSeek התלקח זעם על תמחור ה-API המתארח: משתמש אחד דיווח ששלוש שאלות עלו 4.30 דולר (114 upvotes, 119 תגובות), וכינה את העלאת המחיר 'מטורפת'. המתח הזה בין מודלים פתוחים וזולים מקומית ל-API יקר מתארח הוא הסיפור שכדאי לעקוב אחריו כש-DeepSeek מחזרת אחר משקיעי שוק ציבורי שיבחנו בקפדנות את מודל ההכנסות שלה.