הפער כמעט נעלם: DeepSeek V4.1 Flash מצמצם את יתרון ארה״ב על סין ל-3% בלבד

לפי מעקב ה-benchmark העדכני של Bloomberg Intelligence, הפער בין המודלים המובילים של ארה״ב לאלה של סין עומד היום על כ-3 נקודות אחוז בלבד. זו ירידה חדה מכ-9% במאי ומכ-15% בתחילת 2026. הגורם המיידי הוא DeepSeek V4.1 Flash, מודל מולטימודלי ש-DeepSeek השיקה ב-10 בספטמבר. הוא מדורג שישי ב-LiveBench, משיג 74.2% ב-DeepSWE v1.1 ו-90.9 ב-GPQA Diamond.
DeepSeek מציבה את V4.1 Flash כמודל שמכוון ל-throughput גבוה במחירי token אגרסיביים, והוא זמין כמודל פתוח ב-Hugging Face תחת רישיון MIT המתירני. השילוב הזה חשוב לא פחות מהציון. ארגונים יכולים להריץ בעצמם מודל שנמצא במרחק כמה נקודות מהמודלים האמריקאיים המובילים, בלי שום חיכוך רישוי. כך נשחקת חלק גדול מהפרמיה שחברות ה-AI האמריקאיות גובות על גישה סגורה דרך API.
התחרות צפופה. ב-DeepSWE v1.1 עוקף V4.1 Flash את Grok 4.7 של xAI (71.0%), אבל נשאר מאחורי Gemini 4 Argon המוגבל של Google (77.9%). פוסטי השוואה מציינים של-Argon אין תאריך שחרור פומבי, בעוד שאת המודל של DeepSeek אפשר להוריד כבר היום. הניגוד הזה מזין את הוויכוח של השבוע על שחרור מוגבל מול שחרור פתוח. ההכרזה של Alibaba, באותו זמן, ש-Qwen 4 נמצא באימון, מחזקת את התחושה שחברות ה-AI הסיניות סוגרות פערים בכמה חזיתות. עם זאת, שוויון ב-benchmark הוא לא שוויון ב-deploy, והאשמות ב-'benchmaxxing' עפות השבוע לשני צידי האוקיינוס. גם החששות ממודלים סיניים פתוחים לא נעלמו: מחקר שדווח ב-CBS מצא הטיה פרו-בייג׳ינגית ב-Qwen, ו-Ethan Mollick ציין בעקיצה שאפילו המודל ה'ריבוני' החדש של אירופה עבר fine-tune על נתונים שנוצרו ב-GLM וב-Qwen. מה לבדוק בהמשך: האם חברות ה-AI האמריקאיות יגיבו במחיר, והאם לחץ מגבלות הייצוא, שכבר ניכר בניירת הרכישה של RTX 5090, יחריף.