DeepSeek V4-Flash נכנס למרוץ המודלים המהירים והזולים מול Gemini ו-Qwen

ה-V4-Flash-0731 של DeepSeek (שוחרר ב-31 ביולי ושולב ב-LLM Gateway ב-27 באוגוסט) הוא הכניסה של החברה לשכבת היעילות הצפופה יותר ויותר, בעקבות ציר זמן שחרורים מהיר: Gemini 3.6 Flash ב-21 ביולי, ה-V4-Flash של DeepSeek עשרה ימים אחר כך, קפיצת ה-leapfrog של Google ל-Gemini 3.7 Flash ב-13 באוגוסט, וה-flagship Qwen3.8 Max של Alibaba ב-3 באוגוסט. הקצב הדחוס — מודלים ממוקדי יעילות חדשים כל שבוע-שבועיים — מגדיר את מקצב השוק הנוכחי.
המיצוב של DeepSeek תמיד היה עלות-per-token אגרסיבית, ו-V4-Flash ממשיך בכך, ומתחרה על מחיר ומהירות ולא על מובילות ב-benchmark מוביל. היא גם שחררה וריאנט DeepSeek V4 Flash Vision Exp, והתרחבה ל-multimodal.
אבל האות הרענן והמגלה יותר מגיע מהקהילה, שם מסופר הסיפור האמיתי של V4-Flash: thread ב-r/DeepSeek בכותרת 'Did They Just Lobotomize DSV4F? The Quality Drop is Real and It's Awful' תפס את התסכול של המשתמשים מפני ירידת איכות נתפסת אחרי השחרור, בעוד threads אחרים התלבטו האם 'לחזור ל-DeepSeek' ואיך הוא מתפקד על Ollama Cloud Pro. זה רומז שלמרוץ היעילות יש צד אפל: שינויי איכות שקטים ששוחקים את אמון המשתמשים. תחרותית, DeepSeek מסתכנת בלהילחץ בין Gemini 3.7 Flash המתומחר-פרומו של Google לבין המומנטום של Qwen עם המודלים הפתוחים של Alibaba. ההסתייגות היא תלונות ה'lobotomy' — אם הן אמיתיות, הן מצביעות על השבריריות שבמרדף אחר עלות על חשבון עקביות. שווה לעקוב האם DeepSeek מטפלת בדיווחי ירידת האיכות והאם V4-Flash מחזיק את המשתמשים מול מתחרים זולים ופתוחים יותר.