חזרה
DeepSeekSeptember 27, 20262 מקורות

DeepSeek V4.1-Flash חותך 70% ממחיר ה-output וטוען שהוא מכה את Opus 5

ניתוח AI

DeepSeek דוחפת את יתרון העלות שלה בעוצמה עם V4.1-Flash, המודל הקטן ביותר במשפחת ארכיטקטורה אסימטרית חדשה. בשעות שאינן שיא המודל מתמחר cached input tokens ב-0.003 דולר למיליון ו-output ב-0.60 דולר למיליון — חיתוך של כ-70% ב-output לעומת הדגל שלה עצמה V4-Pro — תוך טענה שהוא מנצח את Opus 5 של Anthropic על benchmarks נבחרים של coding ו-reasoning.

טכנית, V4.1-Flash הוא מודל mixture-of-experts של 552 מיליארד פרמטרים (שוחרר ל-API ב-10 בספטמבר) הבנוי על ארכיטקטורה אסימטרית חדשה עם הבנה ויזואלית מולטימודלית מובנית וחלון context של עד מיליון tokens. תמחור השעות שאינן שיא הוא כשלעצמו אות אסטרטגי: DeepSeek למעשה עושה arbitrage על הקיבולת הפנויה שלה כדי להפוך עומסי עבודה בעלי context גבוה ונפח גבוה לזולים דרמטית מ-APIs מובילים מערביים.

המהלך מחדד את תת-הנושא הדומיננטי של השבוע — מלחמת מחירים מואצת בין LLMs. עם Meta ששולחת בשקט את Muse Spark 1.3 סביב 0.10 דולר למיליון משוקלל ו-Alibaba שדוחפת מודלי Qwen פתוחים, רצפת העלות ממשיכה לרדת, ומיסגור ה'מנצח את Opus 5' של DeepSeek מחושב ללחוץ על חברות AI מערביות במחיר פרימיום ברמת עלות-per-token.

ספקנים קוראים לזהירות לגבי טענות ה-benchmark, שהן ברובן מדווחות-עצמית, ומציינים שתמחור שעות שאינן שיא מסבך השוואות TCO בעולם האמיתי. יש גם עומס גאופוליטי: r/singularity (218 הצבעות) ציין ש'המודל האחרון של Dario עורר רגשות קשים בקרב בסיס המשתמשים הסיני', ברמיזה למצב רוח תחרותי של מכה-תמורת-מכה. אבל למפתחים, המסקנה המעשית חדה — יכולת קרובה למובילה בשבריר ממחירי המובילים היא עכשיו שגרה, וחברות AI מערביות מתחרות יותר ויותר על אמון, כלים ואינטגרציה מאשר על מחיר גולמי.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog