Briefing
חזרה
AlibabaSeptember 2, 20261 מקורות

Alibaba משדרגת את Qwen3.8-Max עם snapshot 0902 — וכובשת את פסגת CodeArena

ניתוח AI

גרסת ה-0902 של Qwen3.8-Max מבית Alibaba היא שדרוג post-training ממוקד שמכוון לקוד ולמשימות agentic בסגנון 'Cowork'. התוצאה הקונקרטית: קפיצה של 22 נקודות ב-CodeArena אל 1,691, מספיק כדי לתפוס את המקום הראשון ב-leaderboard. המודל שומר על חלון context של עד מיליון token והוא זמין דרך שירותי Qwen וה-API של Alibaba.

השדרוג מאריך רצף חזק של המודלים המובילים הסיניים. צוות Qwen של Alibaba מתהדר גם בהובלה ב-CommerceAgentBench, שם הוא טוען ש-Qwen3.8-Max מספק 'את הביצועים הכוללים החזקים ביותר בקרב מודלים פתוחים', ומזמין בדיקה ב-workflow אמיתי. הדחיפה ממקמת את Qwen ישירות מול Fable, Gemini ו-GPT-5.6 על ציר סוכני הקוד שהפך לזירת הקרב הכי שנויה במחלוקת בתעשייה.

המומנטום מתפרש על פני כל ה-ecosystem של Qwen: r/LocalLLaMA היה פעיל סביב קוונטיזציות GGUF של Qwen3.8-Flash ושחרורי MTP, וסקירת הקיץ של Hugging Face ציינה את הדומיננטיות של Qwen בהורדות GGUF. ההקשר הרחב הוא קצב שחרורים סיני שמאיץ — מודל הראייה V4 של DeepSeek ברישיון MIT, GLM-5.3 Flash ואחרים — שמנוגד למהלך של חברות ה-AI האמריקאיות לעבר שחרורים סגורים ומגודרים. ספקנים מציינים שהמיקום ב-leaderboard תנודתי לנוכח קצב של כ-11 ימים בין שחרורי המודלים המובילים, ושהתוצאות ב-CodeArena וב-CommerceAgentBench זקוקות לאימות בפרודקשן אמיתי. ובכל זאת, מקום ראשון ב-CodeArena עם חלון של מיליון token בתמחור של Alibaba הוא הצעת ערך משמעותית ל-workloads של agent רגישי-עלות.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog