חזרה
AlibabaSeptember 08, 20262 מקורות

Qwen3.8-Max-0902 עוקף את Claude Opus 5 בראש טבלת Code Arena

ניתוח AI

החלק המעניין ב-Qwen3.8-Max-0902 של Alibaba אינו ארכיטקטורה חדשה — אלא checkpoint של post-training שדחף מודל פתוח שכבר היה חזק אל מעבר למערכת סגורה מובילה בתחום הקוד. ב-Code Arena, 0902 הופיע לראשונה עם 1,691 נקודות, שלוש לפני Claude Opus 5 Max (1,687) ו-17 לפני Kimi K3 Max. מודל ה-mixture-of-experts הבסיסי בגודל 2.4 טריליון פרמטרים מפעיל כ-95 מיליארד פרמטרים לכל token, והשיק במקור דרך QwenCloud API ב-2 באוגוסט כשהגרסה הפתוחה עוקבת ב-13 באוגוסט, וכעת ממורכזת ל-Hugging Face ול-ModelScope תחת רישיון Apache 2.0.

מכנית, הסיפור הוא שכוונון הדרגתי — ולא scale — סגר את הפער. זה מזין דיון קהילתי חי לגבי כמה מרווח נותר ב-checkpoints של post-training לעומת ריצות pretraining חדשות, ומחזק את הנושא הדומיננטי של השבוע: חברות AI סיניות דוחפות מודלים תחרותיים באמת אל מרכזי המודלים הפתוחים בשבריר מהתמחור של החברות הסגורות.

מבחינה תחרותית, זה נוחת לצד המשמעת התמחורית של DeepSeek V4-Pro וההשקה של Qwen-Drive-1.0 כעדות למומנטום של המודלים הפתוחים. עבור מהנדסים שבונים coding agents, מודל שמוביל ב-leaderboard וזמין תחת רישיון מתירני שניתן להריץ מ-ModelScope הוא שינוי מהותי — אם כי יתרון של שלוש נקודות ב-Code Arena נמצא בתוך הרעש, ומיקום ב-leaderboard לעיתים רחוקות ממופה נקי לאמינות בסביבת production. האזהרה ששווה לעקוב אחריה: יתרון מתמשך על פני evals עצמאיים, ולא ציון בכורה של checkpoint בודד. ובכל זאת, הסמליות של מודל פתוח שמוביל על Opus 5 בכל לוח קוד היא מה שמדובר עליו בקרב המפתחים.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog