DeepSeek מעלה את V4-Flash-Vision-Exp — מודל vision פתוח — ל-Hugging Face

DeepSeek המשיכה את המומנטום שלה במודלים פתוחים כשהעלתה בשקט את DeepSeek-V4-Flash-Vision-Exp ל-Hugging Face ולפלטפורמת ה-API שלה, מודל multimodal ניסיוני להבנת vision שהצית מיד את r/LocalLLaMA עם 641 upvotes בזמן שהקהילה ניתחה את יכולותיו. DeepSeek אומרת שהמודל מקרב יכולות agent מסוג multimodal לרמת Opus-4.8 תוך שמירה על ביצועי טקסט-טהור בקנה אחד עם DeepSeek-V4-Flash הרשמי.
מבחינה טכנית, המודל מרחיב את סדרת V4 של DeepSeek, שהוסיפה context נייטיבי של מיליון token דרך Compressed Sparse Attention, אל תוך vision — תחום שבו מודלים פתוחים פיגרו אחרי מערכות מובילות קנייניות. סימון ה-'Exp' מסמן שחרור ניסיוני, בהתאם לדפוס של DeepSeek לשלוח מודלים יכולתיים באופן פתוח ולשכלל בפומבי.
השחרור משתלב באסטרטגיית ה-AI הרחבה יותר של סין — פתוחה וזולה — שממשיכה להגביר את הדיון בין פתוח לסגור. DeepSeek Harness, שנפתחה כ-open-source ב-13 באוגוסט, משכה כמעט 200,000 כוכבי GitHub עם ארכיטקטורת ה-plugin-first שלה, ו-ETF חדש מכוון עכשיו ל'נמרי' ה-AI של סין בתזה ש-AI מוביל אולי לא דורש הוצאות בסגנון אמריקאי. הניגוד עם המעבר הבו-זמני של Meta למודלים סגורים הוא חד — ככל שחברות ה-AI המערביות מסתגרות, החברות הסיניות נפתחות. הקוראים צריכים לעקוב אחר benchmarks עצמאיים שמאמתים את ההשוואה ל-Opus-4.8, וריאנטים קהילתיים מקוונטזים ל-inference מקומי, והאם המודל הניסיוני יתקדם לשחרור יציב.