מאסק דוחה את Grok 4.7 לכיוונון RLHF נוסף בגלל נטישת משימות מוקדמת

הדחייה של Musk היא הודאה ציבורית נדירה במצב כשל ספציפי של RLHF: המודל העניש יתר על המידה את אורך התשובה במהלך ה-reinforcement learning, מה שגרם לו לנטוש משימות בטרם עת — לקצץ עבודה כדי לשמור על תשובות קצרות. זהו באג אימון קונקרטי ובר-אבחון, והניסוח של Musk 'עוד כמה ימים להתבשל' מרמז ש-xAI תפסה אותו ב-evals לפני השילוח.
לצד הדחייה, xAI קידמה את מהלך ה-agent הארגוני שלה: Grok Bot מתחבר כעת ל-Salesforce, HubSpot ו-Gong, וממקד ישירות תהליכי עבודה של מכירות. אירוע 'Grok Bot Galaxy' ב-15-17 בספטמבר בסן פרנסיסקו מאתגר צוותים לבנות חברה תוך שימוש ב-Grok Bot כעובד היחיד שלהם — גימיק שיווקי שמשמש גם כהדגמה של יכולת agentic.
הדחייה עומדת בניגוד למתחרים שמשלחים באגרסיביות השבוע (GPT-6 Astra GA, השקת Meta Muse), ושימו לב לבלבול בשמות במקורות — Grok 4.6 שוחרר ב-12 באוגוסט עם context של 500K, בעוד 4.7 הוא השחרור הבא שנדחה. xAI שמעכבת לצורך כוונון איכות היא מהלך אופייני לרגע ה'האטו את הקצב' ש-Musk בדיוק תמך בו, אם כי ספקנים יקראו את זה פשוט כ-xAI שמפגרת מאחורי לוח הזמנים.