DeepSeek V4 זמין לכולם — Flash של 284 מיליארד רץ מקומית ומתחרה ב-GPT-5.6 Sol בקוד

משפחת V4 של DeepSeek הגיעה לזמינות כללית סביב ה-19–20 ביולי, אחרי השקה מוגבלת של V4 Flash ו-V4 Pro. היא משוחררת תחת רישיון MIT מתירני, ובאה בשני גדלים: V4 Pro עם 1.6 טריליון פרמטרים ו-V4 Flash עם 284 מיליארד. ארכיטקטורת ה-MoE שלה מפעילה בכל רגע רק כ-13 מיליארד פרמטרים, מה שמאפשר למודל ה-Flash הקטן יותר לרוץ מקומית על חומרה חזקה תוך שהוא עדיין מתחרה במערכות הענן המובילות — יכולת ש-XDA Developers הדגימו כשהריצו את מודל ה-284B על תשתית מקומית. המודל מתהדר בחלון הקשר של מיליון token.
לפי הדיווחים, benchmarks ראשוניים ממקמים את הביצועים של V4 קרוב למודלי Opus של Anthropic ול-GPT-5.6 Sol של OpenAI במשימות coding, ובמחיר נמוך בהרבה. השילוב הזה — איכות קרובה למובילים, יכולת deploy מקומית, ורישוי מתירני — הופך את V4 לחלק מרכזי מגל המודלים הפתוחים מסין השבוע, לצד Kimi K3 ו-Qwen 3.8. Bloomberg תיארה את הרגע הקולקטיבי הזה כ'DeepSeek 2.0' בלתי נמנע.
בצד העסקי, DeepSeek מפתחת שבב inference משלה כדי לצמצם את התלות ב-NVIDIA וב-Huawei, והכריזה על תוכניות לגייס הון טרי לפי שווי של 74 מיליארד דולר לקראת IPO מקומי שמכוון להנפקה ב-2027 — שבועות אחרי שסגרה סבב Series A מדווח של 7 מיליארד דולר. שמות מודלי ה-API הישנים ייצאו משימוש ב-24 ביולי, עם מעבר לגרסאות V4.
ספקנים ב-r/DeepSeek התווכחו על טענות המחיר, כשthread אחד פירק את מסגור הקרדיט של 'משלמים 10 דולר ומקבלים 60 דולר' כאשליית תמחור. אימות עצמאי של טענות ה-parity ב-coding מול Opus/Sol עדיין מוגבל. הקוראים כדאי שיעקבו אחרי מעבר ה-API ב-24 ביולי, אחרי המיקום ב-benchmarks עצמאיים, ואחרי השאלה אם שבב ה-inference המותאם אישית באמת יתממש לפני ה-IPO.