המודל הפתוח V4-Flash של DeepSeek נוחת ב-0.03$ למשימה — פי 105 זול מ-Claude Fable 5

DeepSeek השיקה רשמית את V4-Flash ב-31 ביולי 2026, וכבר ב-3 באוגוסט חברת מחקר עצמאית הכתירה אותו כמודל ה-AI הידוע והזול ביותר להרצה — כשלושה סנט בממוצע לכל benchmark, לעומת 3.15 דולר עבור Claude Fable 5 של Anthropic. פער של פי 105 בערך. תעריף ה-API הרשמי של DeepSeek עומד על 0.14 דולר למיליון input tokens ו-0.28 דולר למיליון output tokens, מתחת ל-Kimi K3 של Moonshot AI, ל-GPT-5.6 Sol של OpenAI ול-Fable 5 של Anthropic בפער ניכר.
מה שהופך את V4-Flash לבולט מעבר למחיר הוא שאין כאן צעצוע: הוא מקבל ציון 50 ב-Intelligence Index של Artificial Analysis, שווה ל-Gemini 3.6 Flash של Google, ומגיע עם יכולות agent משופרות ובתור מודל פתוח. השילוב הזה — אינטליגנציה קרובה לרמת המובילים, כלי agent ועלות שולית שואפת לאפס — הוא מה שמדאיג את חברות ה-AI המערביות סביב הכלכלה של עלות-לכל-יחידת-אינטליגנציה.
ההשקה מסלימה את מלחמת המחירים המתחדדת של סין בתחום ה-AI, והגיעה באותו שבוע שבו Alibaba חשפה את Qwen3.8-Max. Semafor תיארה זאת כסין מציפה את השוק במודלים פתוחים במחירי רצפה בעוד חברות ה-AI האמריקאיות עדיין גובות תעריפי API פרימיום. ראוי לציין ש-DeepSeek גם עצרה את סבב הגיוס Series B שלה — סימן שהיא אולי מעדיפה לתפוס נתח שוק על פני גיוס הון בטווח הקרוב.
ההערה האפלה: V4-Flash נוצל לרעה במהירות. hacker חיבר את המודל ל-framework בשם Hermes Agent (open-source) כדי לתקוף אוטונומית 460 מערכות דרך Telegram, והשיג 14 חדירות — אם כי כולן ניצלו חולשות ציבוריות שכבר טופלו. התגובה בקהילת r/DeepSeek הייתה אופורית בכל הנוגע לעלות ('שירותי מנוי מתים מבחינתי', 507 upvotes), בעוד חוקרי cybersecurity ציינו שכשלי התפעול היו משמעותיים יותר מכל בהלה סביב אוטונומיה של AI. השאלה הפתוחה לקוראים: האם מודלים פתוחים וזולים שוחקים באופן מבני את החפיר של חברות ה-AI הסגורות היקרות, או שכלים, evals ואיכות ה-harness נותרים ההבדל האמיתי.