DeepSeek-V4-Pro ב-GA: 1.6T פרמטרים — ו-surge pricing ששובר עצבים

DeepSeek-V4-Pro הגיע לזמינות כללית עם build 0813, ובוגר מ-preview של ארבעה חודשים. ארכיטקטונית זהו מודל Mixture-of-Experts בן 1.6 טריליון פרמטרים עם 49B פרמטרים פעילים וחלון context של מיליון token, שרושם מספרי benchmark agentic חזקים כולל 87.9 ב-Terminal Bench 2.1 ו-62.7 ב-DeepSWE — ממקם אותו כאופציית open-tooling רצינית ל-coding ו-workflows של agent ארוכי-אופק. ההשקה הגיעה יחד עם כלי harness ב-open-source שמפתחים ב-r/DeepSeek שיבחו, כשאחד השרשורים מכנה את מערכת ה-harness Cordis 'ה-VS Code של harnesses של agent'.
המחלוקת היא התמחור. החל מ-16 באוגוסט, DeepSeek הציגה surge pricing מונע-ביקוש: תעריפי שעות שיא מתרבעים, ודוחפים את פלט V4-Pro עד 3.96 דולר למיליון token, בעוד מחוץ לשעות השיא יורד ל-50% ותמחור cache-hit עלה עד פי 12. חלק מהדיווחים מסגרו את העלייה האפקטיבית כעד 1,100% בתצורות מסוימות. זה מבטל את ההחלטה הקודמת של DeepSeek להפוך הנחות קידום לקבועות, והתפנית החדה היא מה שצרב הכי הרבה אצל מפתחים.
תגובת הקהילה התמקדה באי-ודאות עלויות עבור workloads של agent ב-production. מפתחים השוו את התנודתיות בין שיא/מחוץ-לשיא באופן לא-מחמיא להנחות Grok הקבועות והצפויות של xAI, בטענה ש-surge pricing מכניס חיכוך תכנון בדיוק עבור מקרי השימוש התמידיים של agent ש-V4-Pro בנוי עבורם. השרשורים ב-r/DeepSeek וב-r/artificial דנו באסטרטגיות ניתוב כדי לחמוק מחלונות השיא, והשוואה מתמשכת 'האם GPT-5.6 Luna זול יותר לביצוע' צברה תאוצה.
הקריאה האסטרטגית: DeepSeek מנסה למונטז רווחי יכולת אמיתיים אחרי חודשים של מכירה בהפסד, אך השינוי המבני הפתאומי מסתכן בדחיפת מפתחים רגישי-מחיר לעבר Qwen, Grok או self-hosting. אפילו בשיא, V4-Pro נשאר זול יותר מכמה APIs מובילים מערביים — אך צפיות, לא רק מחיר מוחלט, היא מה שצוותי production אומרים שהם צריכים.