Briefing
חזרה
DeepSeekAugust 01, 20262 מקורות

DeepSeek משחררת את V4-Flash-0731 ומאיצה את ה-"race to zero" של AI

ניתוח AI

DeepSeek השיקה רשמית את V4-Flash-0731 ב-31 ביולי, מודל mixture-of-experts עם 284B פרמטרים כוללים ו-13B פעילים, שקיבל 82.7% ב-Terminal-Bench — עקף את V4-Pro-Preview שלה עצמה — והגיע ל-50 ב-ArtificialAnalysis Index, נקודה אחת מאחורי GLM-5.2 ו-GPT-5.6 Luna. במחיר של בערך 0.14$ למיליון input tokens ו-0.28$ למיליון output, הוא ממוצב באגרסיביות כדי לקבוע בסיס כלכלי חדש לאוטומציה agentic ברמת enterprise. Axios ו-Nikkei מסגרו את ההשקה, לצד קו V4 שאומן מחדש, כמאיצה את ה'race to zero' של AI, כאשר output tokens של V4-Pro מדווחים כקרובים ל-0.87$/M לעומת 50$/M של Fable של Anthropic.

סיפור היעילות מרכזי בתגובת הקהילה. ב-r/LocalLLaMA, פוסט השחרור ב-Hugging Face (773 upvotes) ו-thread שכותרתו 'going to cause another market crash' (600+ upvotes) הניעו התלהבות עזה, בעוד ש-r/DeepSeek שאל 'how is that even possible?' (356 upvotes) לגבי מודל של ~300B שחותך במחיר מודלים קטנים בהרבה. Victor Mustar מ-Hugging Face פרס endpoint inference ציבורי וחינמי תוך שעות.

קריטי לאימוץ, V4-Flash דובר גם את ה-Responses API של OpenAI וגם את פורמט ההודעות התואם-Claude של Anthropic, מה שמאפשר למפתחים להחליף אותו לתוך agent stacks קיימים בחיווט מחדש מינימלי. אותה interoperability, בתוספת context שנטען כמיליון token, ממצבת אותו כחוסך-עלויות שניתן להשחיל ישירות במקום גן נעול.

ההשקה גם הגיעה על רקע גל רחב יותר של חברות AI סיניות — מודל הווידאו הפתוח H3 של MiniMax ו-Seedance 2.5 של ByteDance נחתו באותו שבוע — מה שמאותת על לחץ מתואם של תמחור ויכולת על השחקניות המבוססות בארה"ב. השאלה הפתוחה היא עמידוּת: אם הכלכלה של DeepSeek תחזיק בקנה מידה תחת עומס production אמיתי, וכיצד OpenAI ו-Anthropic יגיבו מעבר להורדות המחירים האחרונות שלהן.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog