DeepSeek מזהירה מעליית מחירי API אחרי שעיבדה 8 טריליון tokens ביום אחד

DeepSeek הודיעה ללקוחות ה-API שלה על העלאות מחיר משמעותיות בכל השירותים, היפוך חד מאסטרטגיית חיתוך המחירים האגרסיבית שהפכה אותה לסמל של AI סיני זול. הטריגר: מודל V4-Flash שהיא השיקה לאחרונה עיבד 8 טריליון token ביום אחד, הציף את קיבולת ה-GPU ואילץ את DeepSeek להעלות מחירים כדי לנהל את הביקוש, במקום להמשיך לחתוך את המתחרים.
V4-Flash עצמו הוא מודל טקסט-בלבד בגודל 284 מיליארד פרמטרים עם חלון context של מיליון token, שנכנס ל-public beta בתעריפים תחרותיים מאוד — 0.14 דולר למיליון input tokens ו-0.28 דולר למיליון output, עם הנחה של 98% על input שנשמר ב-cache — והשיג intelligence index של 50, מקום שני מבין 162 מודלים במחלקה שלו. העלאת המחיר נחתה כמעט מיד אחרי שאותם תעריפים שיא-נמוכים הוצגו בגאווה, מה שהזין ספקנות בקהילה לגבי הקיימות של כלכלת מודלים סינית זולה במיוחד (שרשור ב-r/DeepSeek על 'האמת מאחורי העלאת המחיר של DeepSeek' הגיע ל-468 upvotes).
מעבר לתמחור, DeepSeek חידשה סבב גיוס של 8 מיליארד דולר לפי שווי של כ-74 מיליארד דולר ורכשה נתח של 2.31% ביצרנית הרובוטים ההומנואידיים Unitree לקראת ה-IPO שלה — מה שמסמן שאיפות מעבר ל-API של מודלים גרידא, לתוך רובוטיקה ו-AI מגולם.
הספקנים קוראים את העלאת המחיר כעדות לכך שהמודל הזול היה מסובסד ולא-קיים בסקאלה, מה שחותר תחת הנרטיב שלחברות ה-AI הסיניות הייתה כלכלה זולה יותר מבנית. מה לעקוב: כמה המחירים באמת יעלו, האם הביקוש יחזיק בתעריפים גבוהים יותר, והאם הנתח ב-Unitree מסמן פנייה רחבה יותר לחומרה.