מודל שמשפר את עצמו? Alibaba: Qwen3.8-Max עבר 33+ סבבי שיפור עצמי וקפץ ל-45 ב-Artificial Analysis

Alibaba מציגה את אחת הטענות הנועזות של השבוע. לפי הסיקור של HPCwire על ההתקדמות של ה-AI הסיני, Qwen3.8-Max עבר יותר מ-33 מחזורים של שיפור עצמי רקורסיבי, כלומר המודל עזר לייצר שיפורים לעצמו. לפי הדיווח, התהליך העלה את ציון האינטליגנציה שלו ב-Artificial Analysis מ-40 ל-45. עלייה של חמש נקודות במדד המצרפי הזה משמעותית, ו-Alibaba מייחסת אותה ללולאת השיפור העצמי ולא לאימון pretraining חדש.
בצד הפתוח, צוות Qwen של Alibaba מודיע ש-Qwen3.8-27B זמין עכשיו דרך Nebius Token Factory. הוא מוצג כמודל dense ל-workflows של agents ולמחקר רב-שלבי. מודלי dense בגודל בינוני כאלה פופולריים בצוותים שמריצים בעצמם או עושים fine-tune.
Qwen עוברת גם למכשירים. Alibaba השיקה את Qwen Intelligence, מסגרת agents שרצה על המכשיר עצמו ועולה לראשונה בטלפונים מסדרת Magic9 של HONOR. המסגרת כוללת את ה-agents Mobile Planner, Mobile-Use ו-Mobile Creative, שמבצעים משימות בין אפליקציות. זו תחרות ישירה ב-Siri AI של Apple וב-Gemini של Google ב-Android.
בהקשר התחרותי, חברות ה-AI הסיניות מתקדמות בכמה חזיתות במקביל:
- DeepSeek מובילה את OpenRouter בנפח.
- DeepSeek ו-Huawei משחררות כ-open-source כלים לשבבי Ascend.
- Alibaba טוענת לשיפורים מתוך שיפור עצמי.
כדאי לקבל את הטענות בספקנות. "שיפור עצמי רקורסיבי" הוא מונח טעון, והמקורות לא מפרטים מה כלל כל מחזור, כמה פיקוח אנושי היה, והאם השיפור מחזיק גם ב-benchmarks שהמודל לא כוונן אליהם. המבחן האמיתי יהיה שחזור עצמאי ב-Artificial Analysis ובהערכות של agents.