חזרה
DeepSeekOctober 01, 20261 מקורות

חיים בלי CUDA: DeepSeek ו-Huawei משחררות את TileLang וספריות Ascend 950

ניתוח AI

החפיר החזק ביותר של NVIDIA מעולם לא היה רק השבבים. זה CUDA – האקוסיסטם שכמעט כל תוכנת AI נכתבת עבורו. DeepSeek ו-Huawei תוקפות עכשיו את החפיר הזה ישירות. הן שחררו כ-open-source תמיכה ב-Ascend עבור TileLang, framework לכתיבת kernels ל-AI בביצועים גבוהים, יחד עם שישה מודולים, ביניהם DeepGEMM-Ascend ו-DeepEP-Ascend. ההסבות האלה מביאות את ספריות כפל המטריצות והתקשורת בין experts המוערכות של DeepSeek, שכוונו במקור לחומרה של NVIDIA, אל מעבדי Ascend 950 של Huawei.

המטרה הטכנית היא להפוך אשכולות Ascend ליעד ריאלי לאימון ול-inference של מודלים מובילים. הספריות תומכות ב-supernodes של 128 כרטיסים – תצורת האשכול הגדולה של Huawei – ו-Huawei מציינת ש-supernodes של Ascend 950 תומכים במלואם ב-DeepSeek V4. DeepSeek כבר אימנה על חומרת Ascend את מודלי V4-Flash שלה, ומתכננת מתקן במונגוליה הפנימית עם 160,000 מאיצי Ascend. השחרור כ-open-source מאפשר גם לחברות AI סיניות אחרות להשתמש בכלים, כך שכל האקוסיסטם המקומי מתחזק ולא רק DeepSeek.

זה חלק ממהלך רחב יותר לעבר כוח מחשוב ריבוני בסין. Alibaba חשפה באותו שבוע את המעבד Zhenwu V900 שלה בכנס Apsara, ומשתמשים ב-r/LocalLLaMA כבר מפרסמים benchmarks של Qwen3.8-Flash-Next שרץ על שני כרטיסי Ascend של 96GB עם vLLM. מגבלות הייצוא דחפו את חברות ה-AI הסיניות לכיוון הזה. השאלה הפתוחה הייתה אם התוכנה תעכב את השבבים המקומיים יותר מהחומרה עצמה – והסבה רצינית של TileLang מצמצמת את הפער.

ההסתייגויות: מאחורי CUDA עומדות יותר מ-15 שנה של כלים, ספריות והרגלי פיתוח, והסבה של framework אחד לא מחליפה את כל זה. נתוני ביצועים מול תצורות NVIDIA מקבילות עדיין מעטים. משתמשי DeepSeek גם דיווחו השבוע שוב על שרתים עמוסים או מושבתים – תזכורת לכך שהקיבולת עדיין מוגבלת. כדאי לעקוב אחרי benchmarks עצמאיים של Ascend 950 מול Blackwell על DeepSeek V4, ואחרי אימוץ מצד חברות AI מעבר ל-DeepSeek.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog