כל כתבות ה-AI שפרסמנו על DeepSeek — 66 כתבות לאורך 18 אפר׳ 2026 – 5 אוג׳ 2026. עקבו אחר השקות המודלים, המחקר, המוצרים והשותפויות של DeepSeek בתעשיית ה-AI, בעדכון יומי.
66 כתבות · 18 אפר׳ 2026 – 5 אוג׳ 2026
28 סנט למיליון tokens: DeepSeek V4-Flash זורק את המחירים לרצפה וכובש את השימוש הגלובלי
DeepSeek השיקה את V4-Flash במחיר 0.14$ למיליון token קלט ו-0.28$ למיליון token פלט — מה שחברת מחקר מצאה שזול פי 100 להרצה מ-Claude Fable 5 של Anthropic, וקובע benchmark חדש של עלות נמוכה בתעשייה. עד ה-4 באוגוסט, V4-Flash הוביל בשימוש ה-token העולמי עם 7.1 טריליון token בשבוע, כשתשעה מתוך עשרת המודלים המובילים הם כעת סיניים.
2026-08-05

0.14 דולר למיליון tokens: DeepSeek V4-Flash זול פי 100 מ-Claude Fable 5
DeepSeek שחררה רשמית את V4-Flash-0731, מודל של 284 מיליארד פרמטרים במחיר של 0.14$ למיליון tokens בקלט ו-0.28$ בפלט — זול פי 100 ויותר מ-Claude Fable 5 של Anthropic. למרות גודלו הקטן יותר הוא עולה ב-14% על V4-Pro של DeepSeek בן 1.6 טריליון הפרמטרים בטבלאות האינטליגנציה, רץ בכ-142GB ב-FP4, וקיבל ציון 82.7 ב-Terminal Bench 2.1. ה-API שלו נכנס ל-public beta ב-31 ביולי.
2026-08-04

DeepSeek מציתה מלחמת מחירים: V4-Flash-0731 מנצח את V4-Pro ב-0.14 דולר למיליון token
DeepSeek השיקה רשמית את V4-Flash-0731, מודל MoE עם 284B פרמטרים כוללים / 13B פעילים, במחיר של 0.14$/0.28$ למיליון tokens ועם context של מיליון tokens. הודות לשיפורי post-training הוא רשם 82.7% ב-Terminal-Bench 2.1 (עלייה מ-61.8%), עקף את 72.1% של V4-Pro-Preview והשתווה ל-Gemini 3.6 Flash — מהלך משמעותי במלחמת מחירי ה-inference, שלדברי מפתחים זול פי 18 עד 28 מ-Claude.
2026-08-03

DeepSeek משחררת את V4-Flash-0731 ומאיצה את ה-"race to zero" של AI
DeepSeek השיקה את V4-Flash-0731, מודל MoE בגודל 284B/13B שקלע 82.7% ב-Terminal-Bench ו-50 ב-ArtificialAnalysis Index — נקודה אחת בלבד מתחת ל-GLM-5.2 ו-GPT-5.6 Luna — במחירי flash של כ-0.14$ למיליון input ו-0.28$ למיליון output. הוא תומך ב-Responses API של OpenAI ובפורמט ההודעות התואם-Claude של Anthropic, ו-r/LocalLLaMA כבר מכנה אותו טלטלה נוספת בשוק.
2026-08-02

DeepSeek משלימה מעבר ל-V4: context של מיליון tokens, פי 50 יותר זול
DeepSeek הוציאה משימוש את המזהים הישנים deepseek-chat ו-deepseek-reasoner ב-24 ביולי, ועברה במלואה ל-V4 Pro (1.6 טריליון פרמטרים, 49 מיליארד פעילים) ול-V4 Flash (284 מיליארד), ששניהם מציעים חלונות הקשר של מיליון tokens ותמחור שחותך את Anthropic בפי 50 בערך ל-token. המעבר האגרסיבי מאיץ את אימוץ המודלים הפתוחים. בנפרד, DeepSeek עצרה סבב גיוס שני אחרי שתדריך משקיעים חסוי של המייסד Liang Wenfeng דלף לרשת.
2026-07-31
DeepSeek מתכננת data center של גיגה-וואט במונגוליה הפנימית
DeepSeek הכריזה על תוכניות לבנות מרכז נתונים עצום להספק גיגה-וואט ב-Ulanqab שבמונגוליה הפנימית, אולי תוך שימוש במעבדי Blackwell של NVIDIA. הבנייה מסמנת התרחבות תשתית אגרסיבית ומקדימה שמועות על IPO, בעקבות סבב מימון מדווח של 7 מיליארד דולר שמעריך את החברה בקרוב ל-50 מיליארד דולר.
2026-07-31

DeepSeek פורשת משמות המודלים הישנים לטובת V4 ועוצרת סבב גיוס של 74 מיליארד דולר
DeepSeek הוציאה משירות ב-24 ביולי את ה-aliases הישנים deepseek-chat ו-deepseek-reasoner ב-API, והעבירה את כל התעבורה ל-V4 Pro (1.6 טריליון פרמטרים, 49 מיליארד פעילים) ול-V4 Flash (284 מיליארד), ששניהם מציעים context בן מיליון tokens תחת רישיון MIT. היא גם השהתה גיוס Series B בהיקף 74 מיליארד דולר לאחר שהערות שדלפו מהמייסד על נחיתות כוח המחשוב של סין והתלות ב-Nvidia הפכו לויראליות.
2026-07-30

DeepSeek V4 יוצא ל-GA, מוציא לגמלאות aliases ישנים ומוסיף surge pricing
DeepSeek הכריזה על זמינות כללית של משפחת מודלי V4, וגמלה את הכינויים הישנים `deepseek-chat` ו-`deepseek-reasoner` (שמפנים כעת ל-`deepseek-v4-flash` או `deepseek-v4-pro`), ואישרה תמחור surge לפי שעות היום שמגיע בקרוב. V4 Flash מכוון למהירות ויעילות עלות בצ'אט ובסיווג, בעוד V4 Pro מטפל ב-reasoning מורכב ובמשימות long-context עד מיליון tokens.
2026-07-27

מייסד DeepSeek בוחר AGI על פני רווח — באמצע גיוס של 71-74 מיליארד דולר
DeepSeek מגייסת סבב חדש לפי שווי יעד של $71-74 מיליארד (עלייה מ-$50B ביוני) ומתכוננת ל-IPO אפשרי בשוק STAR של שנגחאי בסוף 2026. המייסד Liang Wenfeng אמר שהחברה תעדיף AGI לטווח ארוך על פני רווח וקרוב לוודאי תשמור את המודלים המתקדמים ביותר שלה open-source. DeepSeek גם בונה שבב inference ייעודי שמטרתו לחצות את ה-latency, וקרובה להשקה מלאה של מודל V4.
2026-07-26

DeepSeek מגייסת לפי 74 מיליארד דולר: 'AGI לפני רווח, והמודלים נשארים open-source'
DeepSeek מגייסת הון חדש לפי שווי של כ-74 מיליארד דולר (עלייה מ-50 מיליארד ביוני), ומכוונת לגייס עד 50 מיליארד יואן לקראת הגשת בקשה אפשרית ל-IPO בבורסת STAR Market בשנגחאי עוד השנה. המייסד Liang Wenfeng אמר שהחברה מתעדפת AGI לטווח ארוך על פני רווח, וסביר שתשמור את המודלים המתקדמים ביותר שלה open-source, בטענה שפיתוח פתוח ומונטיזציה אינם סותרים. תאריך יעד נוקשה של 24 ביולי מוציא משימוש את מזהי המודלים הישנים deepseek-chat ו-deepseek-reasoner.
2026-07-24

המודלים הפתוחים הסינים Kimi K3 ו-DeepSeek מציתים 'רגע ספוטניק' נוסף
המודל הפתוח Kimi K3 של Moonshot AI מתחרה במערכות של OpenAI ו-Anthropic בשבריר מהעלות, מה שאילץ את Moonshot להשעות מנויים חדשים על רקע ביקוש עצום ומחדד מחדש את הדיון על עלייתו של ה-AI הסיני. הסיקור מיסגר זאת כעוד 'רגע Sputnik', בעוד סין שוקלת לפי דיווחים להדק את בקרות הייצוא על מודלים, שבבים ומודלים פתוחים של חברות כמו Alibaba ו-ByteDance.
2026-07-24

DeepSeek V4 יוצא לכולם: חלון מיליון tokens ותמחור שמזנק בשעות העומס
DeepSeek V4 עברה מתצוגה מקדימה לזמינות כללית עם חלון context של מיליון token כסטנדרט בכל הרמות, לצד שיפורים בביצוע agent, בהיסק מתמטי ובכתיבת קוד. זו הופכת ל-API הראשון ברמה המובילה שמפורמל תמחור surge לשעות שיא/שפל, ומכפיל את המחירים בשעות העבודה בבייג'ין. הכינויים הישנים deepseek-chat ו-deepseek-reasoner יורדים ב-24 ביולי בשעה 15:59 UTC ללא תקופת חסד, ומכריחים מפתחים לעבור ל-deepseek-v4-flash או deepseek-v4-pro.
2026-07-23

DeepSeek V4 זמין לכולם — Flash של 284 מיליארד רץ מקומית ומתחרה ב-GPT-5.6 Sol בקוד
משפחת המודלים V4 של DeepSeek עברה מתצוגה מקדימה לזמינות מלאה, ושוחררה תחת רישיון MIT בשני גדלים: V4 Pro עם 1.6 טריליון פרמטרים ו-V4 Flash עם 284 מיליארד. בזכות ארכיטקטורת mixture-of-experts שמפעילה רק כ-13 מיליארד פרמטרים בכל רגע, המודל הקטן רץ מקומית ובכל זאת מתחרה במודלים המובילים בענן. בדיקות ראשוניות ממקמות את V4 קרוב ל-Opus של Anthropic ול-GPT-5.6 Sol במשימות קוד, בעלות נמוכה בהרבה. DeepSeek מתכננת IPO לפי שווי של 74 מיליארד דולר ב-2027.
2026-07-21

DeepSeek במגעים לגייס 1.5 מיליארד דולר, שוקלת IPO — ובונה שבב inference משלה
החברה הסינית DeepSeek מנהלת לפי הדיווחים מגעים עם משקיעים חדשים לגיוס של כ-1.5 מיליארד דולר, ועשויה להגיש IPO כבר השנה בשווי שמתקרב ל-69 מיליארד דולר ומעלה — אחרי סבב ראשון שגייס כ-7 מיליארד דולר. במקביל היא מפתחת שבב inference משלה כדי לצמצם את התלות ב-Nvidia וב-Huawei, כשגרסת DeepSeek-V4 היציבה יוצאת ב-17 ביולי ומזהי המודלים הישנים ייעלמו ב-24 ביולי.
2026-07-15

DeepSeek בונה chip inference ומגייסת 7 מיליארד דולר; מחירי V4 Flash נשארים בתחתית
DeepSeek מפתחת שבב AI ממוקד inference ומחפשת שותפי foundry וזיכרון כדי להפחית תלות ב-NVIDIA וב-Huawei על רקע מגבלות הייצוא האמריקאיות, במקביל לגיוס של 7 מיליארד דולר לפי שווי של 52-59 מיליארד דולר. שמות ה-API הישנים deepseek-chat ו-deepseek-reasoner ייפסקו ב-24 ביולי; תמחור V4 Flash של 0.09 דולר input ו-0.18 דולר output למיליון tokens נשאר נמוך בסדר גודל מ-GPT-5.6, כש-V4 צפוי באמצע יולי.
2026-07-14

DeepSeek משיקה V4 באמצע July — אחרי גיוס של 7.4 מיליארד דולר וקדחת תמחור
DeepSeek הכריזה על השקה באמצע יולי של V4 (1.6T פרמטרים, 49B פעילים) ושל V4-Flash (284B/13B פעילים), שניהם עם context של מיליון token באמצעות DSA sparse attention, לצד תמחור בשעות שיא בכפול מהמחיר בשעות רגילות. החברה סגרה סבב חיצוני ראשון של 7.4 מיליארד דולר בשווי של יותר מ-50 מיליארד דולר; שמות המודלים הישנים ייצאו משימוש ב-24 ביולי 2026.
2026-07-07

DeepSeek משחררת את DSpark בקוד פתוח להאצת V4; השקה באמצע יולי וגיוס של 7.4 מיליארד דולר
DeepSeek השיקה את DSpark, טכנולוגיה open-source שמאיצה משמעותית את ה-deploy של מודלי V4 שלה, שמשתמשים בארכיטקטורת MoE וחלון קונטקסט של מיליון tokens. V4 ישוחרר רשמית באמצע יולי עם תמחור לפי שעות היום שמכפיל את התעריפים בשעות השיא, והחברה סגרה סבב של 7.4 מיליארד דולר בשווי של יותר מ-50 מיליארד דולר בהובלת CATL, Tencent, NetEase ו-JD.com. המזהים הישנים deepseek-chat ו-deepseek-reasoner יופסקו ב-24 ביולי.
2026-07-06

הגרסה המקדימה של DeepSeek-V4 מתמחרת פי 10 מתחת למתחרים — שמות ה-API הישנים נעלמים ב-July 24
DeepSeek-V4 עדיין ב-preview, עם V4-Pro (1.6T פרמטרים, 49B מופעלים) ו-V4-Flash (284B פרמטרים, 13B מופעלים), ששניהם תומכים בחלון הקשר של מיליון token דרך DSA sparse attention. V4-Flash עולה 0.28 דולר למיליון output token — בערך פי 10 זול יותר מהמודלים המובילים במערב — והשמות הישנים deepseek-chat ו-deepseek-reasoner יוצאו משימוש ב-24 ביולי, כשהשקה מלאה צפויה באמצע יולי.
2026-07-05

DeepSeek קובעת 24 ביולי כמועד מוות לשמות מודלים ישנים ב-API — לקראת השקת V4
DeepSeek אישרה שהמזהים הישנים deepseek-chat ו-deepseek-reasoner יהפכו לבלתי נגישים אחרי ה-24 ביולי 2026 בשעה 15:59 UTC. מפתחים חייבים לעבור ל-deepseek-v4-flash ($0.14/$0.28 למיליון tokens) או ל-deepseek-v4-pro ($0.435/$0.87), שניהם עם חלונות הקשר של מיליון tokens ו-endpoint API בפורמט Anthropic. השחרור המלא של V4 מתוכנן לאמצע יולי עם תמחור peak/off-peak חדש.
2026-07-03

DeepSeek V4 מביא תמחור API לפי שעות עומס — כמו חברת חשמל, באמצע יולי
DeepSeek תשיק את V4 באמצע יולי עם מודל תמחור API חדש שמכפיל את העלויות בשעות השיא (9:00-12:00 ו-14:00-18:00 שעון בייג'ין), שינוי מתמחור אחיד שנועד לרכך קפיצות ביקוש ולהבטיח יציבות. V4 מציע context window של מיליון tokens וביצועים משופרים במשימות agentic, בהיסק מתמטי ובכתיבת קוד.
2026-07-02

DeepSeek משחררת את DSpark: inference של V4 מהיר יותר בעד 85%
DeepSeek חשפה את DSpark, framework פתוח (ברישיון MIT) ל-speculative decoding עבור משפחת מודלי V4 שלה, שמאיץ את ה-inference ב-60%-85% ומאפשר ל-GPU יחיד לטפל בכ-185 שאילתות במקום 100. השחרור מגיע כש-DeepSeek מתכננת להכפיל לפחות את כוח האדם שלה, בגיבוי 7.4 מיליארד דולר שגייסה ביוני לפי שווי של מעל 50 מיליארד דולר.
2026-07-01

DeepSeek פותחת את DSpark ל-open-source — וטוענת לזירוז של עד 85%
DeepSeek השיקה את DSpark, framework open-source ברישיון MIT לאופטימיזציית inference שמאיץ את יצירת המודלים בעד 85% ללא שדרוג חומרה או אימון מחדש. בעזרת speculative decoding מתקדם, הוא כבר פעיל במודלי V4-Flash ו-V4-Pro של DeepSeek (האצה של 60%–85%) ותומך במודלים מספקים אחרים, כולל Qwen של Alibaba ו-Gemma של Google. הוא מגיע עם DeepSpec, codebase full-stack לאימון מודלי draft מותאמים אישית.
2026-06-30

DSpark של DeepSeek: speculative decoding שמאיץ את יצירת V4 בעד 85%
סטארטאפ ה-AI הסיני DeepSeek השיקה את DSpark, framework של speculative decoding שמגדיל את מהירות הייצור למשתמש במודל הדגל V4 ב-60%-85% לעומת MTP-1. בעזרת מודל draft קליל לצד אימות באצווה, הוא מצמצם את התלות בתשתית שבבים חזקה ומוזיל את עלויות ההגשה.
2026-06-29

DeepSeek מתכננת להכפיל כוח אדם אחרי גיוס של 7.4 מיליארד דולר בשווי 50 מיליארד+
DeepSeek, חברת ה-AI הסינית שהמודלים זולי-העלות שלה זעזעו את התעשייה, מוערכת כעת בלמעלה מ-50 מיליארד דולר אחרי שגייסה 7.4 מיליארד דולר בסבב הראשון שלה, ומתכננת להכפיל בערך את כוח האדם שלה. ההתרחבות מדגישה כמה חברות המודלים הפתוחים הסיניות ממומנות היטב ומתקדמות, בעוד המודלים המובילים של ארה"ב מתמודדים עם הגבלות ממשלתיות.
2026-06-29

DeepSeek מכפילה כוח אדם ב-27 תפקידים אחרי גיוס של 7.4 מיליארד דולר
DeepSeek מתכננת להכפיל את כוח האדם שלה ב-27 תפקידים טכניים בעקבות סבב גיוס ראשון של 7.4 מיליארד דולר לפי שווי של מעל 50 מיליארד דולר. בין המשקיעים שתמכו בגיוס: Tencent, CATL וקרן ההשקעות הלאומית של סין לתעשיית ה-AI, כשהמייסד Liang Wenfeng נותר עם כ-84% מההון, סעיף אי-חטיפת עובדים, ומשקיעים שנותרו ללא זכויות הצבעה תחת lockups של חמש שנים.
2026-06-28

DeepSeek מגייסת כ-7.4 מיליארד דולר לפי שווי 60 מיליארד — עם סעיף אי-חטיפה
DeepSeek השלימה את סבב הגיוס החיצוני הראשון שלה בכ-7.4 מיליארד דולר (50 מיליארד יואן), בשווי של 50–60 מיליארד דולר — הסטארטאפ הסיני בעל השווי הגבוה ביותר שעוסק אך ורק ב-AI. המייסד Liang Wenfeng השקיע אישית כ-3 מיליארד דולר והטיל סעיף איסור גיוס שמונע ממשקיעים, כולל Tencent ו-CATL, לגייס את עובדיו.
2026-06-25
DeepSeek V4 Flash מזניקה את סין לראש צריכת ה-token העולמית
DeepSeek V4 Flash דווח כמודל הנפוץ בעולם עם 4.63 טריליון token, ועזר למצב את סין כמובילה בשימוש ב-token של AI גלובלית. המודל ממנף אנרגיה זולה יותר ועיצוב יעיל במיוחד כדי להוזיל מחירים מתחת לחברות ה-AI המובילות בארה"ב, סימן ליתרון תחרותי הולך וגדל של חברות סיניות.
2026-06-21

DeepSeek מגייסת שיא של 7.4 מיליארד דולר בשווי 52 מיליארד — וארה״ב נמנעת מרשימה שחורה
חברת ה-AI הסינית DeepSeek סגרה סבב גיוס ראשון שיא של 7.4 מיליארד דולר מ-Tencent (כ-10 מיליארד יואן), CATL (כ-5 מיליארד יואן) וקרן ה-AI הלאומית של סין, כשהמייסד Liang Wenfeng הוסיף 20 מיליארד יואן באופן אישי — שווי של 52–59 מיליארד דולר. ב-16 ביוני ארה"ב בחרה שלא להוסיף את DeepSeek לרשימה השחורה למסחר למרות אישור בין-משרדי, במטרה להפחית מתחים עם בייג'ינג.
2026-06-18

DeepSeek חותכת מחירים ב-75%: מלחמת מחירי ה-AI הסינית יוצאת לדרך
DeepSeek חתכה את מחיר הדגל V4 Pro ב-75% — ל-0.0036 דולר למיליון input tokens ו-0.87 דולר למיליון output tokens — ומיצבה אותו כמוביל עולמי בביצועים-לדולר, מה שמכריח מתחרים וספקי ענן סיניים לכייל מחדש את התמחור על רקע סבב גיוס מתקרב.
2026-06-15

חיתוך מחיר של 75% ל-V4 Pro הופך את DeepSeek למלך הביצועים-לדולר
DeepSeek הכריזה על הוזלת מחיר קבועה של 75% למודל הדגל V4 Pro, והורידה את מחיר ה-API ל-0.0036$ למיליון input tokens. המהלך, שמתאפשר הודות לשרשרת אספקת שבבי ה-AI המקומית של סין, הופך את V4 Pro למוביל העולמי ב'יעילות ביצועי AI לדולר' לפי Artificial Analysis, חותך מתחת ל-GPT-5.5 ודוחף את DeepSeek לראש טבלת השימוש השבועי ב-tokens של OpenRouter.
2026-06-12

DeepSeek עוקפת את Nvidia: אימון ענק הושלם כולו על שבבי Huawei
חוקרים סיניים, בשיתוף Huawei ומוסדות בשנזן, השלימו לפי הדיווחים post-training מלא של כל הפרמטרים במודל V4-Pro של DeepSeek — מודל של כ-1.6 טריליון פרמטרים — באמצעות יותר מ-1,000 שבבי Huawei Ascend 910C, בלי חומרה של Nvidia כלל. ההישג מסמן ששבבים מתוצרת מקומית יכולים לתמוך בעומסי אימון אינטנסיביים של AI — צעד משמעותי לעצמאות החומרה של סין.
2026-06-11

DeepSeek בראש מדד הספקים החמים של Ramp — חברות אמריקאיות זורמות ל-API הזול V4
DeepSeek דורגה במקום הראשון במדד ספקי התוכנה החמים של Ramp ליוני 2026, סימן לקפיצה באימוץ בקרב עסקים בארה"ב. הזינוק מונע מהמחיר: DeepSeek V4 מציעה תמחור API נמוך בהרבה מהמתחרות, מה שגורם לחברות אמריקאיות לשלם לה ישירות ולנתב דרכה נתונים — למרות אזהרות אבטחה.
2026-06-09

DeepSeek בראש רשימת הספקים החמים — וחברות בארה״ב מתחילות לשלם ישירות
DeepSeek הובילה את רשימת ספקי התוכנה החמים של Ramp ליוני 2026, כשחברות אמריקאיות לראשונה משלמות ישירות עבור שירותי ה-AI שלה במקום לארח בעצמן את המודלים ה-open-source שלה. המעבר מסמן ביקוש עסקי גובר לחלופות AI זולות, גם אם מודל ה-V4 של DeepSeek מפגר אחרי המערכות המערביות המובילות בביצועים כוללים. משתלמות-העלות היא המשיכה הדומיננטית.
2026-06-08

שבבי Ascend של Huawei השלימו post-training מלא של DeepSeek-V4
צוות מחקר שכולל את Huawei טוען שהשתמש בשבבי Ascend 910C כדי להשלים post-training מלא של מודל DeepSeek-V4-Pro בן 1.6 טריליון פרמטרים על cluster של לפחות 1,000 שבבים של Huawei — צעד משמעותי לעצמאות ה-AI של סין, שעוברת מ-inference למשימה הקשה יותר של אימון תחת הסנקציות האמריקאיות.
2026-06-07

DeepSeek לקראת סבב של 7.4 מיליארד דולר מ-Tencent ו-CATL, סגירה ב-11 ביוני
DeepSeek משלימה גיוס של 50 מיליארד יואן (כ-7.4 מיליארד דולר) ממשקיעים שכוללים את Tencent ואת יצרנית הסוללות CATL, שמיועד לפיתוח מודלי frontier ולהרחבת תשתית. הסבב צפוי להיסגר ב-11 ביוני, וממצב את DeepSeek בין מקבלות ההון הגדולות במרוץ ה-AI.
2026-06-06

הדגמה: מודל DeepSeek עם 1.6 טריליון פרמטרים רץ על MacBook M5 Max דרך SSD
מודל DeepSeek עם 1.6 טריליון פרמטרים, ככל הנראה גרסה של DeepSeek v4 PRO, הודגם רץ על MacBook M5 Max באמצעות זיכרון מגובה SSD. ההדגמה מדגישה את הניידות הגוברת של מודלים בקנה מידה חזיתי על חומרה צרכנית, ואת ההתקדמות באופטימיזציה של מודלים גדולים ל-inference מקומי יעיל ללא תשתית ענן.
2026-06-05

הונג קונג משיקה את HKGAI-V3 מבוסס DeepSeek, ממוטב לשבבים מקומיים
ה-Hong Kong Generative AI R&D Centre השיק את HKGAI-V3, מודל שפה גדול הבנוי על DeepSeek V4 ומותאם לריצה על שבבים מקומיים. הוא טוען ליותר מפי-עשרה דחיסת token ולפי-מאה כמעט בזמן ריצה רצוף של agent, עם פלטפורמת AI agent שרצה ביציבות עד 28 שעות.
2026-06-04

DeepSeek חותכת לצמיתות 75% ממחיר ה-API של המודל המוביל שלה
סטארטאפ ה-AI הסיני DeepSeek הכריז על הוזלה קבועה של 75% במחיר ה-API של מודל הדגל שלו, החל מ-1 ביוני. התמחור האגרסיבי מייצר דיון בכל תעשיית ה-AI הגלובלית, כשאנליסטים מעריכים שהוא עלול ללחוץ על פיתוח תשתיות AI ולהצית מחדש את מלחמת ה-price-performance בין ספקי המודלים.
2026-06-02

DeepSeek קובעת עובדה: הנחת 75% הפכה קבועה, ועוד 90% על cached tokens
DeepSeek הפכה את הנחת ה-API הזמנית של 75% על V4-Pro לקבועה, והוסיפה מעליה הנחה של 90% על cached tokens. התוצאה: מודל ה-reasoning המוביל שלה עולה בערך רבע ממחיר ה-tokens המקבילים של OpenAI או Anthropic — הסלמה חדה במלחמת המחירים הגלובלית לקראת גל ההשקות האמריקאי של הקיץ.
2026-05-28

DeepSeek חותכת 75% במחיר ה-API — ומציתה מחדש את דיון "בועת ה-AI האמריקאית"
DeepSeek הכריזה על הורדת מחיר קבועה של 75% למודל V4-Pro שלה, והורידה את גישת ה-API ל-0.0036 דולר למיליון cached input tokens ו-0.87 דולר למיליון output tokens — מהלך cost-leadership ישיר נגד OpenAI, Anthropic ו-Meta. הקיצוץ החייה את הנרטיב של 'בועת ה-AI האמריקאית' ברדיט וב-HN, עם thread אחד ב-r/OpenAI שצבר 1,222 upvotes.
2026-05-27

DeepSeek מקבעת את הנחת ה-75%: מלחמת המחירים ב-AI עולה הילוך
DeepSeek אישרה שההנחה של 75% על דגל V4-Pro היא קבועה ולא מבצע, עם תמחור API שיורד עד 0.003625 דולר למיליון tokens — בערך פי 100 זול מ-GPT-5.5 שעולה 30 דולר למיליון output tokens. החברה מייחסת את ההפחתה לשיפורי efficiency אמיתיים ב-long-context inference, ולפי הדיווחים נערכת לסבב גיוס חדש.
2026-05-26
DeepSeek קובעת מחיר חדש: הפחתת 75% ב-V4-Pro הופכת קבועה ומתמחרת מחדש את ה-intelligence-per-dollar
סטארטאפ ה-AI הסיני DeepSeek אישר שיותיר באופן קבוע הנחה של 75% על מודל הדגל V4-Pro, ויוריד את תמחור ה-API לטווח של 0.025 עד 6 יואן למיליון tokens. המהלך ממצב את V4-Pro בין הטובים בעולם ביחס אינטליגנציה-לדולר, ומשקף מגמה רחבה של הפחתת תלות בחומרת NVIDIA לטובת חלופות מקומיות.
2026-05-25
DeepSeek הופכת את ההנחה ב-V4-Pro/Flash לקבועה
DeepSeek הודיעה שההנחה ב-API הופכת לקבועה, ומקבעת תמחור נמוך עבור DeepSeek-V4-Pro (1.6T סך הכל / 49B active params, context של 1M) ו-V4-Flash (284B סך הכל / 13B active params). המהלך מבסס את DeepSeek כמוביל המחיר בשכבת ה-API ברמת frontier, בדיוק כש-Alibaba מסתירה את המודלים החזקים של Qwen מאחורי paywall.
2026-05-23

DeepSeek משיקה מוצרי agent — ומכפילה הימור על agentic AI
DeepSeek נערכת להשיק מוצרי agent חכמים, ומאמצת את הגישה שהנדסת AI נעה לעבר בניית סביבות הפעלה שלמות ל-agents. החברה שחררה ב-24 באפריל preview של מודל V4 שלה, עם ביצועים חזקים ב-benchmarks של agentic coding — ועכשיו הופכת את היכולת הזו למוצר.
2026-05-21

DeepSeek V4 Flash ו-V4 Pro יוצאים עם שכבת agentic-coding בגודל 1.6 טריליון פרמטרים
DeepSeek שחררה את V4 Flash ו-V4 Pro וממשיכה במהלך מחיר-ביצועים. V4 Flash הוא MoE מאופטם ליעילות, מותאם למהירות ול-pipelines בנפח גבוה; V4 Pro מגיע עם 1.6 טריליון פרמטרים בסך הכל ומכוון ל-reasoning עמוק ולקוד agentic רב-שלבי. הפיצול תואם את מגמת התעשייה של רמות Pro/Flash במקום מודל בסיס יחיד.
2026-05-20

DeepSeek-V4-Flash ו-V4-Pro שוחררו כמודלים open-weight עם hybrid attention ו-13B פרמטרים פעילים
DeepSeek שחררה את V4-Flash (284B סה"כ / 13B פעילים) ואת V4-Pro כמודלים open-weight על Hugging Face. שניהם מותאמים ל-agentic coding וליעילות long-context, עם חידושים מבניים כמו hybrid attention ו-DeepSeek Sparse Attention להפחתת compute וזיכרון. V4-Flash ממוצב כאופציה חסכונית למפתחים שבונים workflows מבוססי long-context ו-agents.
2026-05-18

DeepSeek-V4 Pro (MoE של 1.6T-A49B) ו-V4 Flash שוחררו כ-open weights
DeepSeek שחררה את סדרת V4 ב-Hugging Face, כולל גרסת Pro של MoE בגודל 1.6T-A49B וגרסת Flash של 284B-13B. מודל ה-Flash בולט בביצועים חזקים יחסית לגודלו ובשינויים ארכיטקטוניים שמשפרים ומוזילים יכולות long-context.
2026-05-17

DeepSeek חושפת תצוגה מקדימה של V4: 1.6T פרמטרים, context של 1M, חיתוך 75% במחיר ה-API
DeepSeek-V4 preview יוצא עם 1.6T פרמטרים סה"כ ו-49B פעילים בארכיטקטורת MoE, חלון context של מיליון tokens, ו-KV cache קטן פי 10 שמכוון ל-workloads של agents. גרסת V4-Flash מציעה 284B/13B. מחירי ה-API ירדו ב-75% ועלויות ה-cache ב-90%; ה-benchmarks לא ממש סוגרים את הפער מהחזית.
2026-05-17

DeepSeek V4 רץ על שבבי Huawei, Stanford HAI קובע שפער ה-AI בין ארה״ב לסין "נסגר למעשה"
תצוגה מקדימה של DeepSeek V4 רצה על שבבים של Huawei במקום של Nvidia, סימן לירידה בתלות סינית ביצרניות שבבים אמריקאיות. דוח של Stanford Institute for Human-Centered AI קובע שהפער בין מודלי ה-AI המובילים בארה\"ב לסין 'נסגר כמעט לחלוטין', כש-DeepSeek V4 ממוטב במפורש ליעילות עלות על חומרה זמינה.
2026-05-15

DeepSeek V4 מתקרב לרמת GPT-5 לפי הערכת CAISI האמריקאית
המודל DeepSeek V4 (1.6T פרמטרים, רישיון MIT) הוערך על ידי ה-U.S. AI Standards and Innovation Center כמתפקד דומה ל-GPT-5 של OpenAI (אוגוסט 2025), מה שהופך אותו למודל ה-AI הסיני הטוב ביותר — אם כי עדיין מפגר אחרי המודלים האמריקאים החדשים בכ-8 חודשים. cost efficiency צוין כחוזקה.
2026-05-14

DeepSeek V4-Pro: 1.6 טריליון params, context של מיליון tokens, עלות inference נמוכה משמעותית — מאלץ לפי הדיווחים הורדת מחיר של Anthropic
DeepSeek שחררה את V4 דרך API ב-24 באפריל 2026, עם וריאנט Pro שכולל 1.6 טריליון פרמטרים ו-context window של מיליון tokens. V4-Pro דורש משמעותית פחות inference FLOPs ו-KV-cache מ-V3.2, מה שהופך אותו לתחרותי ללולאות agent-יות ועבודה על codebases גדולים. ההשקה הסעירה את כלכלת ה-AI — לפי הדיווחים Anthropic הורידה את מחירי Opus 4.7 בתגובה, ו-DeepSeek גם מבצעת אופטימיזציה של המודל לשבבי Huawei.
2026-05-13

DeepSeek V4-Pro חוצה 150+ tok/sec/user על GB200 NVL72, מתחרה ב-frontier בשבריר מהעלות
DeepSeek V4-Pro, ששוחרר דרך API ב-24 באפריל, אורז 1.6 טריליון פרמטרים בסך הכול וחלון context של מיליון tokens, ומספק יותר מ-150 tokens/sec למשתמש על פלטפורמת GB200 NVL72 של NVIDIA. לפי הדיווחים הוא משתווה ל-Claude Opus 4.7 ול-GPT-5.5 ב-workflows אג'נטיים כבדי-קוד, בעלות שולית בלבד, ו-V4 אומן לפי הדיווחים ב-7.8 מיליון דולר.
2026-05-11

DeepSeek V4 שוברת את המתמטיקה של 500 מיליארד דולר capex ב-AI; Anthropic חותכת את התמחור של Opus 4.7 ב-67%
DeepSeek V4 Pro (1.6T פרמטרים בסך הכל, 49B פעילים לכל token דרך MoE, context של 1M tokens) הושק דרך API ב-24 באפריל ודורש רק 27% מה-inference FLOPs ל-token יחיד של V3.2 ו-10% מה-KV cache שלו ב-context מלא. שיפורי היעילות דוחפים את תמחור ה-API כלפי מטה בכל התעשייה — Anthropic הורידה את מחירי Claude Opus 4.7 ב-67% לאחר השקת V4.
2026-05-11
יצרניות שבבים סיניות משלבות את DeepSeek V4 לרוחב חומרה מקומית
יצרניות שבבים סיניות, כולל Huawei ו-Cambricon, משלבות במהירות את ה-LLM בשם V4 של DeepSeek בפלטפורמות מקומיות. Huawei התאימה את V4 לשבב Ascend 950PR שלה, ולפי הדיווחים השיגה ביצועי inference פי 2.87 ב-card יחיד ביחס ל-H20 של NVIDIA, ושיפור של 60% ביעילות יצירה מולטי-מודלית בעלות deploy נמוכה יותר.
2026-05-09

DeepSeek מתקרבת לשווי 45 מיליארד דולר בסבב בהובלת Big Fund הסיני עם Tencent ו-Alibaba
DeepSeek סוגרת סבב גיוס בשווי של כמעט 45 מיליארד דולר — בערך פי 4 מהשווי שלה לפני שבועיים — בהובלת China Integrated Circuit Industry Investment Fund ('Big Fund') ובהשתתפות Tencent ו-Alibaba. החברה מתכננת להגדיל compute, לגייס באגרסיביות ולהעמיק תאימות ל-chips של Huawei כדי להפחית תלות ב-NVIDIA.
2026-05-07

DeepSeek V4 משיקה עם context של מיליון tokens ו-open weights בזמן שהשווי קופץ ל-45 מיליארד דולר
DeepSeek שחררה את V4 בגרסאות 'Pro' (1.6T פרמטרים) ו-'Flash' (284B) עם חלון context של מיליון tokens ו-open weights, שעבר אופטימיזציה ל-coding agentic, מחקר וניתוח מסמכים. FT ו-Bloomberg מדווחים ש-DeepSeek במו"מ לסבב VC ראשון בשווי 45 מיליארד דולר — קפיצה מ-20 מיליארד לפני שבועות בלבד — ו-V4 כוונן ל-inference על שבב 950PR של Huawei, אם כי האימון עצמו עדיין רץ על NVIDIA.
2026-05-07

DeepSeek סוגרת סבב גיוס של 50 מיליארד דולר בהובלת קרן ה-AI הלאומית של סין
DeepSeek סוגרת סבב גיוס שצפוי לתמחר את מעבדת ה-AI הסינית בכ-50 מיליארד דולר (מעל 300 מיליארד יואן), כשקרן ה-AI הלאומית של סין במגעים להוביל את הסבב, ו-Alibaba ו-Tencent מוזכרות כמשקיעות אפשריות. הגיוס מדגיש את הגיבוי האסטרטגי של בייג'ינג ל-AI מקומי, על רקע שבבי Huawei 950PR שמפעילים את ה-inference של V4.
2026-05-06

DeepSeek V4 (1.6T פרמטרים) הושק ב-97% מתחת למחיר GPT-5.5, בנוי על Huawei Ascend ו-Cambricon
DeepSeek שחררה את מודל ה-V4 שלה, כשהווריאנט V4-Pro מציג 1.6 טריליון פרמטרים וחלון context של מיליון tokens, בנוי בעיקר על סיליקון סיני מקומי (Huawei Ascend, Cambricon) ולא על NVIDIA. V4 הושק עם תמחור אגרסיבי — 97% מתחת ל-GPT-5.5 של OpenAI — עם תאימות API שמורידה את עלויות המעבר למינימום. NIST CAISI פרסמה הערכה, וה-NYT טוען ש-DeepSeek משנה את המבנה של מירוץ ה-AI הגלובלי.
2026-05-05

NYT: ההשקה האחרונה של DeepSeek משנה את מירוץ ה-AI בין ארה״ב לסין
ה-NYT טוען שהמודל החדש של DeepSeek לא רק יישר את סין מול ארה\"ב, אלא שינה את אופי המרוץ עצמו, באמצעות reasoning חסכוני. CAISI דירגה במקביל את DeepSeek V4 Pro כמודל הסיני החזק ביותר, אם כי עדיין מפגר בכ-8 חודשים אחרי החזית האמריקאית.
2026-05-04

DeepSeek חשפה V4-Pro (1.6T) ו-V4-Flash עם context של מיליון טוקנים
DeepSeek חשפה preview של V4 בשתי גרסאות: V4-Pro עם 1.6T פרמטרים ו-V4-Flash עם 284B, שתיהן עם context של 1M tokens. open-source ברישיון MIT, עם תמיכת vLLM מהיום הראשון ותמחור נמוך משמעותית מהמעבדות האמריקאיות. ביצועים חזקים ב-benchmarks של agents וקוד שמתחרים במערכות closed-source.
2026-05-01
DeepSeek V4 משיק עם context של מיליון, open weights ברישיון MIT — אבל השווקים מגיבים באדישות
DeepSeek שחררה ב-24 באפריל את מודלי ה-preview של V4-Pro ו-V4-Flash תחת open weights ברישיון MIT עם 1M context, בתמחור API נמוך באורדר של גודל מהמתחרים המערביים. השוק הגיב בקרירות — Lian Jye Su מ-Omdia הגדיר את ההכרזה כצפויה, מאחר ששיפורי ארכיטקטורה ויעילות הפכו לנחלת הכלל.
2026-04-30

DeepSeek V4 (1.6T פרמטרים, 1M context) רץ על שבבי Huawei עם חיתוכי מחיר אגרסיביים
DeepSeek חשפה preview של V4, המודל החזק ביותר שלה עד היום — 1.6 טריליון פרמטרים, חלון context של מיליון tokens, אומן על שבבי Huawei — וגזרה את המחיר של הדגל החדש כדי לחתוך מתחת למתחרים מערביים וסיניים. השוק הגדיר את ההתקדמות הארכיטקטונית כ-'צפויה' וההשקה לא הרשימה אנליסטים.
2026-04-29

DeepSeek V4 משיקה עם 1.6 טריליון פרמטרים, תמיכת day-0 ב-Blackwell והפחתות מחיר אגרסיביות
DeepSeek השיקה ב-24 באפריל את V4 ב-preview בשתי גרסאות: V4-Pro עם 1.6 טריליון פרמטרים ו-V4-Flash עם 284 מיליארד, שתיהן תומכות ב-context של עד מיליון tokens ומשתמשות ב-27% בלבד מ-FLOPs של inference לכל token וב-10% מ-KV cache בהשוואה למודלים מובילים קודמים. NVIDIA סיפקה תמיכת Blackwell ביום ההשקה עם 3,500 tokens בשנייה על מודל ה-1.6T דרך NVFP4, ו-DeepSeek קיצצה דרסטית את התמחור הדגל כדי ללחוץ על המתחרים האמריקאים — אם כי Reuters מציינת שהשווקים כבר לא מתרשמים.
2026-04-28

תצוגה מקדימה של DeepSeek V4: 1.6T MoE, 1M context, Apache 2.0 — וצעד לכיוון Huawei Ascend
DeepSeek חשפה גרסת preview של V4-Pro-Max (1.6T פרמטרים) ו-V4 Flash (284B) — מודלי MoE עם חלון של 1M tokens, open-weighted תחת Apache 2.0, בתמחור API של $1.74/$3.48 למיליון tokens. השחרור מציג Compressed Sparse Attention יחד עם Heavily Compressed Attention, שחותכים את ה-KV cache פי ~10 בהקשר של 1M ומשתמשים רק ב-27% מ-FLOPs של inference לכל token לעומת V3.2. חשוב לא פחות — DeepSeek הוכיחה שניתן להריץ fine-grained Expert Parallelism על Huawei Ascend NPUs בהאצה של 1.5–1.73x, מתווה שעמיד מול בקרת היצוא האמריקאית.
2026-04-27

השקת DeepSeek V4 צפויה השבוע עם טריליון פרמטרים
השקת DeepSeek V4 צפויה מאוד השבוע בעקבות ציוצים של אנשי פנים בתעשייה, עם ציפיות ל-1 טריליון פרמטרים כוללים ו-32-37 מיליארד פרמטרים אקטיביים דרך ארכיטקטורת MoE. המודל מותאם לשבבי Huawei בעקבות הגבלות יצוא אמריקניות ומתחים גיאופוליטיים.
2026-04-20
DeepSeek V4 צפוי בסוף April עם טריליון פרמטרים מותאמים לצ'יפים של Huawei Ascend
DeepSeek V4 צפוי בסוף אפריל 2026 עם כ-1 טריליון פרמטרים סה"כ באמצעות ארכיטקטורת Mixture-of-Experts עם רק 32-37 מיליארד פרמטרים פעילים לכל token. המודל החמיץ שני חלונות השקה קודמים אבל מייצג את המודל מהחזית הראשון המותאם לשבבים מקומיים סיניים אחרי חודשי שיתוף פעולה עם Huawei ו-Cambricon.
2026-04-18