DeepSeek משיקה את V4.1 Flash עם vision — ואז מחזירה את V4 Pro

V4.1 Flash הוא הכניסה של DeepSeek המותאמת לעלות ולזמן תגובה, כעת עם הבנה ויזואלית multimodal מובנית ו-inference מהיר יותר. במחיר של 0.15/0.60 דולר למיליון input/output tokens בשעות שפל, הוא חותך דרמטית את מחירי המתחרים המובילים — בודקים עצמאיים ב-Reddit טענו שהוא מספק כ-98% מהיכולת של GPT-6 Astra בכ-1.4% מהעלות (כ-18 דולר למיליארד tokens), בתוספת קפיצה של 10.4 נקודות ב-benchmark לזיהוי CVE. (הערה: המקורות חלוקים על הסקאלה, כאשר דיווח אחד מציין גרסה של 763B פרמטרים — ספירת הפרמטרים המדויקת של DeepSeek אינה מאושרת.)
הסיפור המעניין יותר הוא ההיפוך. DeepSeek הכריזה שהחל מ-14 בספטמבר כל בקשות deepseek-v4-pro ינותבו מחדש ל-V4.1 Flash בתעריפי Flash, ובכך תוציא למעשה את V4 Pro מהשירות. לאחר לחץ מצד המשתמשים, היא חזרה בה, והמשיכה את שירות ה-API של V4 Pro בחיוב ללא שינוי — מקרה נדיר של חברת AI שמבטלת הוצאה משימוש בעקבות דרישת הקהילה.
התגובה ב-r/DeepSeek הייתה מעורבת: התלהבות מיחס עלות-ביצועים ('שימוש היום 4.1 flash', 161 הצבעות) ישבה לצד תלונות ('למה אנשים כל כך מרוצים? בשבילי זה בלגן', 182 הצבעות) ותהליך שכינה אותו 'רשמית לא שמיש לעבודה פסיכולוגית/מופשטת עמוקה' בגלל התנהגות סירוב. התבנית קלאסית ל-DeepSeek: תמחור אגרסיבי ואיטרציה מהירה שכובשים מפתחים מודעי-עלות, בזמן שמשתמשי-על מתווכחים אם היכולת שומרת על הקצב.