DeepSeek V4 מביא תמחור API לפי שעות עומס — כמו חברת חשמל, באמצע יולי

DeepSeek תשיק את הגרסה הרשמית של מודל השפה הגדול שלה V4 באמצע יולי, ותציג מודל תמחור API לשעות שיא שמכפיל עלויות בחלונות עמוסים — 09:00 עד 12:00 ו-14:00 עד 18:00 שעון בייג'ינג. המהלך מסמן פרידה אסטרטגית מהתמחור האחיד ששלט במלחמת המחירים של ה-LLM בסין, ומאמץ גישה בסגנון חברת תשתית שנועדה למתן קפיצות ביקוש ולהבטיח יציבות שירות בתקופות עומס גבוה.
מבחינה טכנית, ל-V4 יהיה חלון context של מיליון token וביצועים משופרים בביצוע משימות מבוססות-agent, בהיגיון מתמטי ובייצור קוד — מה שממצב אותו מול ההשקות המובילות האחרונות של חברות ה-AI האמריקאיות. מודל תמחור השיא הוא הודאה בולטת בכך שאפילו ספקים בעלות אולטרה-נמוכה מתמודדים עם מגבלות קיבולת שתעריף אחיד לא מצליח לנהל.
שינוי התמחור מסמן התבגרות בשוק הסיני: במקום למרוץ את העלויות לאפס, DeepSeek מבצעת אופטימיזציה לכלכלת התשתית ולאמינות, סימן שהחברה מצפה לשימוש כבד ומתמשך. זה בא בעקבות גיוס של כ-7.4 מיליארד דולר ותוכניות להכפלת כוח האדם, חלק ממהלך מתואם להתחרות ברצינות בקו החזית של המודלים המובילים.
לקהילת המפתחים היו דעות נחרצות. ב-r/DeepSeek, thread בכותרת 'V4 peak pricing is coming mid-July, here's how to mostly dodge it' צבר 268 upvotes ו-86 תגובות כשמשתמשים גיבשו אסטרטגיות לעקוף את חלונות השיא, בעוד thread נפרד על הכפלת התמחור הגיע ל-184 upvotes ו-130 תגובות. תגובת ה'לשחק עם לוח הזמנים' מרמזת שמשתמשים חסכניים פשוט יתזמנו בקשות לשעות שאינן שיא. שווה לעקוב אם המודל אכן ימתן את העומס והאם מתחרים יעקבו עם תמחור מבוסס-ביקוש דומה.