חזרה
DeepSeekAugust 29, 20261 מקורות

DeepSeek V4-Flash חותכת מחירים ל-0.14 דולר למיליון tokens בזמן ש-Harness מתקרב ל-200 אלף כוכבים

ניתוח AI

DeepSeek דוחפת קדימה את אסטרטגיית שיבוש המחירים שלה עם V4-Flash, שמוצע ב-0.14 דולר למיליון input tokens (ב-cache miss) ו-0.28 דולר למיליון output tokens, לצד חלון קונטקסט של מיליון tokens. התמחור הזה יושב ברצפה האגרסיבית של מרוץ פערי מחירים בין חמישה שחקנים, שכולל גם את Gemini 3.7 Flash של Google ואת Qwen3.8 Flash של Alibaba — מרוץ שמכווץ בהתמדה את עלות היכולת שקרובה למובילה עד לגרושים בודדים למיליון tokens.

מבחינה טכנית, היתרון של DeepSeek נשאר היעילות: היא מספקת ביצועי reasoning וכתיבת קוד תחרותיים בשבריר מעלות ה-tokens של חברות ה-AI המערביות, ולוחצת על השוליים של OpenAI, Anthropic ו-Google. ה-DeepSeek Harness — ה-framework הפתוח של החברה ל-agent ולכתיבת קוד — צבר כמעט 200,000 כוכבים ב-GitHub, סימן ל-mindshare חזק בקרב מפתחים, ו-Modellix.ai של Aurora Mobile הוסיפה מודלים חינמיים של DeepSeek דרך plugin ב-beta, והרחיבה את ההפצה.

מבחינה תחרותית, לחץ המחירים הוא כל העניין. הסנטימנט בקהילה מתאר בעקביות את DeepSeek כמשבשת המחירים ששומרת על הוותיקים ישרים; ארגונים שמתמודדים עם שיתוק־הערכה על רקע מחזורי שחרור מובילים של כ-11 יום הופכים יותר ויותר את המודלים בדרג הביניים לסחורה, והכלכלה של DeepSeek מאיצה את המגמה הזו.

ההסתייגויות הן הרגילות למודל מחברת AI סינית: חששות ממשל נתונים ותאימות מגבילים את האימוץ בארגונים מערביים מפוקחים, וקיימות התמחור של גרושים ל-token תחת עומס אמיתי לא הוכחה. מה כדאי לעקוב: benchmark איכות עצמאי של V4-Flash מול Gemini 3.7 Flash ו-Qwen3.8 Flash, והאם ספירת הכוכבים של ה-Harness תתורגם לשימוש ב-production בר-קיימא ולא רק סקרנות.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog