Alibaba מאשרת: Qwen 4 באימון — ושבב Zhenwu V900 מהיר פי 3 נחשף ב-Apsara

Alibaba ניצלה את כנס Apsara כדי להציג מפת דרכים לכל ה-stack. במודלים: Qwen 4 נמצא באימון, Qwen 4.5 ו-Qwen 5 מתוכננים בהיקף של 5–10 טריליון פרמטרים, וה-Qwen3.8-Max הנוכחי עומד על 2.4 טריליון פרמטרים עם יותר מ-33 מחזורי שיפור עצמי אוטומטיים. בשבבים: ה-Zhenwu V900 של T-Head מגיע עם 216GB זיכרון וטוען לביצועים פי שלושה מה-Zhenwu M890, עם ייצור המוני ברבעון הראשון של 2027. בתשתית: Alibaba חזרה על התוכנית ל-20 GW של מרכזי נתונים עד 2032.
Alibaba Cloud השיקה גם שלושה מוצרים: Smart Studio ו-Smart Video לתהליכי תוכן, ו-Smart Fusion שטוען לחיסכון של כ-50% בעלויות token. מודל Qwen3.8-LiveTranslate החדש משלים את הסל, ו-Qwen3.8-27B זמין עכשיו דרך Nebius.
האסטרטגיה דומה למהלך של DeepSeek ו-Huawei להפחית את התלות ב-NVIDIA. חברות ה-AI הגדולות בסין בונות שבבים ו-stack תוכנה משלהן, ומגבלות הייצוא הופכות עם הזמן לכלי לחץ חלש יותר.
אבל העין הבוחנת חדה. מחקר שדווח ב-CBS מצא סינון גיאופוליטי שיטתי במודלי Qwen, וגם שיטות לעריכת המודל שמנטרלות אותו. בנפרד, התגלה אתר של ממשלת ארה"ב שמשתמש ב-Qwen, זמן קצר אחרי שה-FBI האשים את Alibaba בהעתקה מ-Anthropic. ארגונים שלפי הדיווחים מריצים Qwen, ובהם Airbnb ו-Uber, יצטרכו להתמודד עם שאלות. כדאי לעקוב אם סוכנויות בארה"ב יגבילו את השימוש ב-Qwen, והאם ה-V900 יעמוד בלוח הזמנים.