Alibaba זורקת פצצה: Qwen3.8-Max עם 2.4 טריליון פרמטרים, מיליון tokens context — ותוכנית חלוקת הכנסות

Alibaba שחררה את Qwen3.8-Max, מודל מוביל בן 2.4 טריליון פרמטרים עם חלון context של מיליון tokens, במחיר של 2/6 דולר למיליון input/output tokens — זול בכ-40% ב-input מ-Claude Opus 5. החברה הבטיחה גם אח בגרסת open weights בגודל 27B ל-10-12 באוגוסט, וגם השיקה את CosyVoice Studio, פלטפורמת קול AI חינמית.
סיפור ה-benchmark המרכזי הוא מיצוב תחרותי: Qwen3.8-Max מדורג #1 ב-Artificial Analysis Agentic Index — לפני Opus 5 של Anthropic — ו-#5 ב-Intelligence Index הכולל, לפי חשבון Qwen הרשמי של Alibaba. הדירוג הזה הצית את r/LocalLLaMA (1,236 upvotes), שם מפתחים התווכחו אם מודל סיני פתוח שמוביל את טבלת ה-agentic מסמן נקודת מפנה.
הטוויסט במודל העסקי משמעותי: Alibaba מתכננת להכניס חלוקת הכנסות למשתמשים מסחריים גדולים של Qwen3.8-Max, במעבר מרישוי ה-Apache 2.0 הנוכחי שלה. זה משקף מתחרות כמו Kimi K3 של Moonshot, שלוקחת עד 30% מההכנסות ממשתמשים מסחריים גדולים. זה מסמן אסטרטגיית מונטיזציה מתבגרת עבור מובילי המודלים הפתוחים שבעבר חילקו מודלים בחינם כדי לבנות נתח מהאקוסיסטם.
מבחינה תחרותית, זה מוסיף לחץ על חברות ה-AI המובילות במערב שכבר מתמודדות עם DeepSeek ומלחמות מחירים. מודל בן 2.4T פרמטרים עם context של 1M ב-2/6 דולר חותך את התמחור הפרימיום תוך שהוא טוען לביצועי agentic מובילים — שילוב שאם ה-benchmarks יחזיקו מעמד ב-deployments אמיתיים, קשה למובילות הוותיקות לענות עליו. ספקנים יעקבו האם תנאי חלוקת ההכנסות ירתיעו את קהילת ה-open-source שהפכה את Qwen לפופולרי מלכתחילה.