Briefing
חזרה
DeepSeekJuly 21, 20261 מקורות

DeepSeek V4 יוצא לכולם: חלון מיליון tokens ותמחור שמזנק בשעות העומס

ניתוח AI

DeepSeek V4 הגיעה לזמינות כללית (GA), עם חלון קונטקסט אחיד של מיליון token בכל השכבות ושיפורים בביצוע agentic, בהיסק מתמטי ובכתיבת קוד. ההשקה מביאה איתה שני שינויים משמעותיים מבחינה תפעולית למשתמשי ה-API. ראשית, DeepSeek הופכת לחברת ה-AI המובילה הראשונה שמעגנת רשמית תמחור דינמי מבוסס עומס: התעריפים כמעט מכפילים את עצמם בשעות העבודה בביג'ין (peak) לעומת שעות שפל, מבנה מודע-עלות באופן מפורש אך מייצר חיכוך לצוותים שמחוץ לאזור הזמן הסיני. שנית, deadline הגירה קשיח — הכינויים הישנים deepseek-chat ו-deepseek-reasoner ייעלמו ב-24 ביולי בשעה 15:59 UTC ללא שום תקופת חסד — מכריח את המשתמשים לעבור ל-deepseek-v4-flash או deepseek-v4-pro.

החיתוך ללא תקופת חסד הוא נקודת הכאב של המפתחים, ובקהילות רבות סימנו אותו כשבירה חדה שתשאיר pipelines לא-מהוגרים תקועים. במקביל, קוראים את מודל ה-peak/off-peak כתבנית שאחרות עשויות להעתיק כדי לנהל ביקוש ל-GPU.

מבחינה תחרותית, DeepSeek משתלבת באותו מומנטום סיני של מודלים פתוחים לצד Qwen 3.8 ו-Kimi K3, והתגובות ב-r/DeepSeek חיוביות מאוד: 'Deepseek V4 Pro is AMAZING' (383 upvotes) ושרשורים שמשלבים את DeepSeek עם Claude Code כ'workflow ה-agentic החסכוני ביותר לפיתוח'. שיחות לפני ההשקה מיקמו את V4 קרוב מאוד ל-GPT-5.6 Sol. המחיר הנוח וחלון המיליון token הם המשיכה; התמחור הדינמי ו-deadline הגירה הם ההסתייגות. זה גם מצטלב עם העניין המדווח של Microsoft במודלים סיניים עבור Copilot. שווה לעקוב אחרי האימוץ אחרי החיתוך ב-24 ביולי, ואם צוותים אמריקאים יסבלו תמחור שתלוי באזור הזמן.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog