DeepSeek V4-Pro-0813 עולה ל-GA: MoE של 1.6 טריליון פרמטרים — ומחירי API שמזנקים עד 1,100%

DeepSeek סיימה חודשים של preview והשיקה את V4-Pro-0813 באפליקציה, בווב וב-API, וגם שחררה אותו כמודל פתוח ב-Hugging Face תחת רישיון MIT. מדובר במודל mixture-of-experts בגודל 1.6 טריליון פרמטרים שמפעיל 49B פרמטרים לכל token, תומך ב-context של מיליון token ובפלט של עד 384K token, ומציג מספרים חזקים ב-agentic coding — 87.9 ב-Terminal Bench 2.1 ו-62.7 ב-DeepSWE, קרוב לרמת ה-coding של Anthropic Opus לפי benchmark קהילתיים.
הכותרת הגדולה למפתחים היא התמחור. DeepSeek מעלה את מחירי ה-API בשעות העומס בטווח של 50% ועד 1,100% החל מ-16 באוגוסט, כשהפלט של V4-Pro מטפס ל-3.96 דולר למיליון token. משימות מחוץ לשעות העומס יזכו להנחה של כמחצית כדי לעודד הסטת עומסים. גם אחרי הייקור, העלות ל-token של DeepSeek נשארת מתחת למתחרות המערביות הגדולות — מהלך שאנליסטים קוראים כניסיון מכוון לשפר מרווחים לקראת IPO שמדובר עליו בשמועות, תפנית חדה עבור חברה שכל המותג שלה נבנה על תמחור רצפה.
הקבלה הייתה מפוצלת. בשרשור בן 869 נקודות ו-350 תגובות ב-Hacker News שיבחו מפתחים את הקרבה כמעט-מלאה למודל הדגל של Anthropic במחיר זעום — אחד דיווח שהוציא רק 12.5 דולר על 2 מיליארד token בשיעור cache-hit של 50% לפני הייקור. אבל SCMP ו-Tech in Asia ציינו שהמודל 'מתקשה ב-benchmark, זורח ב-cybersecurity', מה שמחזק דפוס רחב יותר של 'ניצחונות בנישה, פערים כמודל כללי' בקרב חברות ה-AI הסיניות. ההגעה מחריפה שבוע צפוף של שחרורים מובילים מסין לצד Qwen3.8-Max של Alibaba, ומכינה מבחן לשאלה אם DeepSeek תצליח לייצר הכנסות בלי לאבד את בסיס הלקוחות הרגיש-למחיר שהפך אותה למפורסמת.