Briefing
חזרה
AlibabaAugust 27, 20262 מקורות

Alibaba משיקה את Qwen3.8-Flash: מודל MoE פתוח בגודל 125B שעולה תשיעית מכוח המחשוב

ניתוח AI

צוות Qwen של Alibaba השיק את Qwen3.8-Flash, מודל multimodal פתוח עם 125 מיליארד פרמטרים הבנוי על ארכיטקטורת Mixture-of-Experts, ופרסם את המודל ב-26 באוגוסט. הטענה המרכזית של Alibaba היא יעילות: המודל זקוק לכעשירית מהמשאבים של training ו-inference בהשוואה לקודמו Qwen3.7-Plus, תוך שהוא נשאר תחרותי מול Opus 4.6 של Anthropic ו-V4-Flash של DeepSeek.

המודל תומך בחלון context מקורי של 262,144 token, ניתן להרחבה עד מיליון, ומציג טכנולוגיה המיועדת לסדרת Qwen 4 הקרובה. וריאנט קטן יותר, Qwen 3.8-27B, הופיע גם ב-Amazon SageMaker JumpStart, מה שהרחיב את הנגישות לארגונים. מניית Alibaba עלתה בעקבות השחרור כשהמשקיעים התמקדו בסיפור העלות.

ההשקה משתלבת בנושא הדומיננטי של השבוע — מרוץ עלויות במודלים פתוחים — והגיעה באותו יום שבו הופיע GLM-5.3-Flash של Z.ai ועל רקע התמחור האגרסיבי של DeepSeek. הנהלת Hugging Face טענה שסין כבר מנצחת בזירת המודלים הפתוחים, וחשבון Qwen נשען על כך כשפרסם 'Open models, open science' תוך שהוא מודה לקהילת המחקר.

רווחי היעילות של ה-MoE חשובים במיוחד למפתחים שמריצים עומסי agent ו-context ארוך, שם הכלכלה לכל token דומיננטית. הסתייגויות: טענות ה-benchmark הפתוחות דורשות אימות עצמאי, ו'תחרותי מול Opus 4.6' משתרע על טווח איכות רחב תלוי משימה. שווה לעקוב אחר הערכות צד שלישי ואימוץ אצל ספקי inference כדי לראות האם טענות היעילות מחזיקות תחת עומס פרודקשן.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog