DeepSeek משיקה את V4 Pro בגודל 1.7 טריליון — ומייקרת את ה-API עד 1,100%

DeepSeek השיקה רשמית את DeepSeek-V4-Pro-0813, מודל mixture-of-experts בן 1.7 טריליון פרמטרים שמפעיל 49 מיליארד פרמטרים לכל token, עם חלון context של מיליון tokens וציון 87.9 ב-Terminal Bench 2.1. לצד המודל היא שחררה את DeepSeek Harness v0.1, framework agentic ברישיון MIT הממוצב כמתחרה ל-Claude Code של Anthropic, שמשפר משמעותית יכולות coding אוטונומי ו-agents.
הכותרת האמיתית, עם זאת, היא התמחור. DeepSeek מכפילה את עלויות ה-API שלה בשינוי אסטרטגי חד, ועוברת למבנה של שעות שיא/שפל שמעלה מחירים בכל מקום בין 50% ל-1,100%, כשתמחור שעות השיא מגיע ל-3.96 דולר למיליון output tokens — עלייה של פי ארבעה בערך — החל מ-16 באוגוסט. Forbes ציין ש-V4 Pro מתומחר פי 14 מהמודל הזול ביותר של DeepSeek, סימן ברור להתרחקות מדימוי המשבש הזול, הפתוח והאגרסיבי שהפך את DeepSeek למפורסמת.
מבחינה תחרותית, הצעד משתלב בתמת יישור-התמחור של השבוע: אפילו מובילת המחירים של התעשייה נוטשת את כלכלת המרוץ-לתחתית עכשיו כשיש בידיה נתח שוק משמעותי. זה ממסגר מחדש את מרוץ העלויות של המודלים הפתוחים, שבו Qwen של Alibaba ו-Gemini 3.7 Flash החדש והזול של Google (0.75/3.75 דולר) נראים עכשיו אגרסיביים בהשוואה.
תגובת הנגד בקהילה הייתה מיידית ורועשת. ב-r/DeepSeek, thread בשם 'העלאת מחיר של 1500% בשעות השיא' צבר 418 upvotes, כשמשתמשים אמרו שהכפלה פי 2 הייתה סבירה אבל זה 'יותר מדי' והאשימו את DeepSeek בנשיכת מרווחים; רבים אמרו שהם עוברים ל-Muse Spark, GPT Luna או Gemini 3.7 ('זה מדהים'). ה-Harness הפתוח וציון ה-Terminal Bench החזק אולי ישמרו על משתמשי-על, אבל הימור התמחור בוחן כמה נאמנות ה-benchmarks של DeepSeek באמת יכולים לקנות.