חזרה
DeepSeekSeptember 11, 20262 מקורות

DeepSeek משיקה את V4.1-Flash עם context של מיליון tokens — ונערכת ל-IPO של 75 מיליארד דולר בשנגחאי

ניתוח AI

לפי Reuters, SiliconAngle ו-The Register, V4.1-Flash הוא הקטן ביותר במשפחת ארכיטקטורה חדשה אך טוען שהוא מנצח את V4-Pro הגדול יותר. הטריק המרכזי של העיצוב הוא אסימטריה: הוא מפעיל הרבה פחות מחשוב לקריאה (input) מאשר לייצור (output), ומכווץ את ה-KV cache ל-כ-890 בייט ל-token — קטן פי 4 בערך מ-V4-Flash — מה שמאפשר חלון native של מיליון token ו-throughput של 400+ token בשנייה. התמחור מתחיל בסביבות 0.003 דולר למיליון token קלט מ-cache, ומרחיב את שיטת שיבוש העלויות של DeepSeek.

ספירת הפרמטרים הפכה לנקודת המחלוקת בקהילה. DeepSeek מציינת 552B סה"כ (8B פעילים), אך משתמשי r/LocalLLaMA טענו שהמספר האמיתי הוא 748B ('748B, לא 552B', 309 upvotes), ומקור אחד העמיד אותו על 763B — מה שמשקף בלבול מתמשך לגבי אופן ספירת הסכומים ב-MoE. התגובה המובילה ב-HN הזהירה שנתון הפרמטרים הפעילים הנמוך הוא 'טריק שיווקי — עדיין צריך את ה-VRAM כדי לטעון את המודל'. השבחים התמקדו בטיפול ב-long-context וב-tool-calling ולא ב-MMLU גולמי, עם חיכוך סביב הרישיון המותאם של DeepSeek לעומת Apache 2.0.

ההשקה שלטה ב-r/LocalLLaMA (thread הגיע ל-1,538 upvotes) וב-r/DeepSeek, שם משתמשים דיווחו על הצלחות coding ב-one-shot תמורת 0.07 דולר ובירכו על כך ש-DeepSeek מעבירה משתמשים אוטומטית למודל הזול-אך-הטוב-יותר — בניגוד חיובי ל'חברות ה-AI האמריקאיות הסגורות והחמדניות'. זה גם נוחת בעיצומן של האשמות ארה"ב ו-Anthropic ש-DeepSeek ביצעה distillation למודלים מערביים, ענן שמעיב על עלייתה.

פיננסית, DeepSeek שכרה את CITIC Securities להנפקה מקומית בבורסת STAR Market בשווי של כ-75 מיליארד דולר, מה שמסמן שאיפות לממן כוח מחשוב מוביל בקנה מידה. שווה לעקוב אחר benchmarks עצמאיים, טביעת הרגל האמיתית בזיכרון, והאם האשמות ה-distillation יסבכו את ה-IPO או את הזמינות הבינלאומית שלה.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog