Briefing
חזרה
AlibabaAugust 26, 20262 מקורות

Qwen4 בדרך: Alibaba משיקה MoE של 125B שמתאמן בעשירית מהעלות — והמניה קופצת

ניתוח AI

Qwen3.8-Flash-Next, ששוחרר ב-26 באוגוסט, הוא MoE דליל שמפעיל כ-6B מתוך 125B הפרמטרים שלו per token, ומספק יחס מחיר-לביצועים חזק ל-workloads של coding ומשרד. הוא מגיע כמודל פתוח, עם native context window של 262K שניתן להרחיב למיליון tokens, ותמיכה multimodal — ו-Alibaba ממסגרת אותו כ-preview ניסיוני של ארכיטקטורת Qwen4 הקרובה. הטענה המרכזית היא יעילות: האימון דורש לכאורה כתשיעית מהעלות של מודלים דומים.

ההשקה משכה תמיכה מיידית מהאקוסיסטם. NVIDIA בירכה את Alibaba והכריזה על fine-tuning מ-Day 0 דרך NeMo AutoModel ו-NeMo RL, בתוספת recipes ל-SGLang, vLLM ו-LightLLM; המודל גם נחת ב-OpenCode Go. החשבון של Alibaba עצמה התהדר ב-'125B/6B, 1M context, multimodal'. Muse-Glimmer-30B של Meta ווריאנט Qwen 3.8-27B הופיעו במקביל ב-Amazon SageMaker JumpStart, מה שממחיש כמה מהר מודלים פתוחים מתפשטים כיום בין עננים.

תחרותית, זה מחדד את מלחמת העלויות בין ספקי המודלים הפתוחים — נושא שחוצה את השבוע לצד התמחור האגרסיבי של Gemini 3.7 Flash ושחרור המודל הפתוח GLM-5.3. אנליסטים ב-AI Business הזהירו ארגונים להסתכל מעבר למחירי token בכותרות אל מדדים בעולם האמיתי כמו דיוק, latency ואמינות tool-use. הזינוק של 2% בנתח שוק מרמז שהמשקיעים מתגמלים את סיפור העלות, אך העמידות של טענות היעילות של Alibaba — והאם Qwen4 עצמו יעמוד ב-preview — נותרת הדבר שכדאי לעקוב אחריו.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog