Qwen3.8-Max-0902 כובשת את ראש Code Arena WebDev ועוקפת את Claude Opus 5

"תצלום 0902" (qwen3.8-max-2026-09-02) זמין דרך שירותי Qwen וערוצי ה-API של עליבאבא. מה שהופך אותו לראוי לציון הוא המנגנון: עליבאבא טיפסה לראש טבלת דירוג תחרותית בתחום הקוד לא באמצעות מספר גרסה חדש, אלא באמצעות מעבר ממוקד של אימון-על (RL post-training) על מודל קיים — קפיצה של 22 נקודות ב-CodeArena ל-1,691, שלוש נקודות מעל Claude Opus 5 (Max). המודל הבסיסי, Qwen3.8-Max, הוא מודל בן 2.4 טריליון פרמטרים שהגיע לזמינות כללית ב-3 באוגוסט 2026 עם משקלים פתוחים. מעבר למדד הכותרות, עליבאבא מציינת עומק קידוד משופר לפיתוח אוטונומי ארוך-טווח, יכולות סוכן-משתף-פעולה חזקות יותר לתזמור רב-כלי, ושדרוג מקיף של ההבנה החזותית לניתוח תרשימים ותפיסה רב-מודלית — הכול תוך שמירה על חלון הקשר של מיליון טוקנים. האגרוף התחרותי הוא המחיר: בעלות משולבת של כ-5$ למיליון טוקנים, Qwen חותכת משמעותית את מחירם של מודלים מערביים חד-קרן תוך טענה לביצועי קידוד שווים-עד-טובים-יותר. אתר Wccftech תפס את קריאת הקהילה — "משתווה ל-Fable 5 ביכולות באמצעות עדכון בלבד ומבלי לקפוץ לגרסה חדשה" — וזה בדיוק "הפלקס המוזר ביותר" שמפתחים נאחזו בו. הסתייגויות חשובות כאן. התוצאה היא טבלת דירוג WebDev יחידה, לא סקירת יכולות רחבה, והסיקורים סימנו שוב ושוב שיקולי עמידה בחוק הסיני על "כל קריאה" עבור ארגונים השוקלים מודל המתארח בסין. עם זאת, בשילוב עם החדירות הארגוניות של DeepSeek ו-Muse Spark של Meta, הדבר מחזק את הנושא הדומיננטי של השבוע: החזית הפתוחת-משקלים והזולה מתקרבת למודלים הקנייניים היוקרתיים במהירות מספקת כדי שקידוד בדרג-הביניים יהפוך למוצר מדף. שווה לעקוב האם הישגי 0902 יחזיקו מעמד על פני מדדים עצמאיים ורב-תחומיים מעבר ל-WebDev.