חזרה
AlibabaOctober 3, 20261 מקורות

Qwen 4 כבר באימון: Alibaba חושפת שבב Zhenwu V900 ב-Apsara 2026 והולכת על כל ה-stack

ניתוח AI

Alibaba ניצלה את כנס Apsara 2026 כדי למצב את עצמה כחברת AI מקצה לקצה: מודלים, שבבים, קיבולת ענן וכלים. הבשורה המרכזית בצד המודלים היא ש-Qwen 4 כבר באימון. מפת הדרכים שמאחוריו מזכירה גם את Qwen 4.5 ואת Qwen 5, ולפי Alibaba הם יגיעו ל-5 עד 10 טריליון פרמטרים. לשם השוואה, מודל הדגל הנוכחי Qwen3.8-Max עומד על 2.4 טריליון. במקביל השיקה Alibaba את Qwen3.8-LiveTranslate לתרגום סימולטני, ואת הכלים Smart Studio, Smart Fusion ו-Smart Video ב-Alibaba Cloud.

בצד החומרה, חטיבת T-Head חשפה את Zhenwu V900, מעבד לאימון ול-inference עם 216GB זיכרון ותמיכה מובנית ב-FP4. זה חשוב כי FP4 הוא פורמט הדיוק הנמוך ש-NVIDIA משתמשת בו בדור Blackwell כדי להגדיל את תפוקת ה-inference. Alibaba הציגה גם מה שהיא מכנה אבני דרך בשיפור עצמי רקורסיבי: Qwen3.8-Max ביצע 10,000 פעולות EDA בתכנון שבבים וצמצם את שטח ה-bus ב-42%. בקיצור, המודל עוזר לתכנן את השבבים שיאמנו את הדורות הבאים שלו. בצד הענן, Alibaba מכוונת ליותר מ-20GW של קיבולת מרכזי נתונים עד 2032, ופותחת אזורים בטורקיה, בפינלנד ובהולנד.

התמונה התחרותית היא מרוץ לכוח מחשוב סיני עצמאי. באותו שבוע DeepSeek ו-Huawei שחררו כ-open-source כלים ל-Ascend שנועדו להחליף את CUDA. Alibaba מהמרת על סיליקון משלה ולא על זה של Huawei, אבל שני המהלכים מכוונים לאותו יעד: פחות תלות ב-NVIDIA. בינתיים המודלים הפתוחים של Qwen ממשיכים להתפשט במערב. מפתח הריץ השבוע את Qwen3.8-Flash-Next, מודל MoE של 125B, על RTX 3090 Ti בודד, ו-Ethan Mollick ציין שהמודל הריבוני החדש של אירופה עבר fine-tune חלקי על נתונים שיצרו Qwen ו-GLM.

יש גם הסתייגויות. יעדי הפרמטרים הם הבטחות במפת דרכים, לא מודלים שיצאו, ו-Alibaba לא נתנה תאריך השקה ל-Qwen 4. מחקר שפורסם השבוע מצא ב-Qwen הטיה פרו-בייג'ינגית ותשובות מצונזרות, מה שעלול להאט את האימוץ אצל חברות אמריקאיות שבונות על מודלים סיניים. כדאי לעקוב אחרי benchmarks עצמאיים של Zhenwu V900, ולראות אם Qwen 4 יישאר מודל פתוח.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog