חזרה
DeepSeekSeptember 14, 20262 מקורות

0.15 דולר למיליון tokens: DeepSeek משחררת את V4.1-Flash ברישיון MIT עם חלון של מיליון tokens

ניתוח AI

V4.1-Flash ממשיך את הדפוס של DeepSeek לשחרר מודלים פתוחים תחרותיים לרמה המובילה בשבריר מהתמחור המערבי. מודל ה-mixture-of-experts בן 552B פרמטרים מפעיל רק 8B–16B פרמטרים לכל token, כולל הבנה ויזואלית native, ומציע חלון context של 1M tokens — הכל תחת רישיון MIT מתירני במחיר 0.15$/M input ו-0.60$/M output tokens. Benchmarks שהופצו על ידי DeepSeek וצדדים שלישיים טוענים שהוא משתווה או עולה על Claude Opus 5 ו-GPT-5.6 Sol בכמה משימות agentic coding.

הטענה הטכנית המרכזית היא הפחתה של 75% בדרישות ה-HBM של KV-cache, מה שמוריד באופן מהותי את עלות הזיכרון של inference בחלון ארוך ומהווה עניין גדול לכל מי שמארח בעצמו. היעילות הזו הובילה את DeepSeek להוציא מהשירות את מודל ה-V4 Pro הישן יותר לטובת Flash, גם מטעמי ביצועים וגם מטעמי עלות.

לשחרור המודל הפתוח היו השלכות מיידיות: תוך שעות מהדחיפה ל-Hugging Face ב-10 בספטמבר, מפתחים הסירו את שכבות הבטיחות והעלו forks 'abliterated' ו'uncensored', עם לפחות שני builds קהילתיים חיים שמשכו תעבורת הורדות עד 13 בספטמבר. ב-r/LocalLLaMA ההתלהבות הגיעה עם הסתייגות — הרצות מקומיות הראו שצנזורה פוליטית מובנית נשארת, מה שהוליד את המשפט 'open weights ≠ open model'.

הקשר תאגידי מחדד את התמונה: DeepSeek גייסה CFO עם רקע בעסקאות, לפי Reuters, לקראת IPO אפשרי ב-STAR Market בשנגחאי, מה שמאותת על כוונה למסד את עצמה. המשמעות התחרותית חדה — חברת AI סינית קובעת את גבול מחיר-ביצועים למודלים agentic פתוחים, ולוחצת גם על השחקנים הקנייניים הוותיקים וגם על הכלכלה של API-ים סגורים. שווה לעקוב האם החששות מצנזורה ומקור מגבילים אימוץ ארגוני מערבי.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog