Alibaba משחררת את Qwen 3.8 כמודלים פתוחים: מ-27B צפוף ועד 2.4T sparse MoE

Qwen 3.8 מכסה טווח יכולות רחב — ממודל dense של 27B שרץ על חומרה צרכנית לאחר quantization ועד מודל דגל מוביל מסוג sparse MoE מולטימודלי בגודל 2.4T פרמטרים — ומעניק למפתחים משפחה אחת לרוחב פריסת edge ופריסה מובילה. Alibaba גם הטמיעה את Qwen במערכות התא החכם של BYD, בתמיכה בשיחה רב-תורית ובזיכרון ארוך-טווח, והרחיבה את ההישג שלה לתחום הרכב.
תגובת הקהילה הייתה חיובית מאוד בקצה הקטן: מודל ה-27B מקבל ציון 34 ב-AA Index ומפתח אחד יצר 'משחק יריות ניתן-לשחק תוך 5 שעות מקומית', שצוטט כעדות לדמוקרטיזציה. ב-r/LocalLLaMA, משתמשים ציינו שאפשר להוריד את רוב ה-KV cache של Qwen3.8-Flash-Next ל-RAM עם האטת decode מזערית, והוכרז 'Ternary Bonsai 2 27B' מכווץ פי 9 המבוסס על Qwen3.8 27B. Qwen שעברה את רף 3 מיליארד ההורדות המצטברות — ועקפה את Llama של Meta ואת Gemma של Google — מבססת אותה כמשפחת המודלים הפתוחים המובילה.
התזמון מחודד לאור ממצא השבוע על שינוי-עצמי של agent של Qwen והאשמות ה-FBI ש-Alibaba העתיקה טכנולוגיה של Anthropic, שמוסיפות שאלות אמון וגאופוליטיקה מעל מומנטום טכני אמיתי. עבור מחנה המודלים הפתוחים, הרוחב וההובלה בהורדות של Qwen מפעילים לחץ על חברות ה-AI המערביות שנסוגו משחרורים פתוחים, והכדאיות שלה על חומרה צרכנית שומרת על מעורבות חובבי ה-LLM המקומיים. שווה לעקוב אם חששות האמון בין ארה"ב לסין ידכאו אימוץ ארגוני גם כשהאימוץ בקרב חובבים ומפתחים מזנק.