Briefing
חזרה
xAIAugust 14, 20261 מקורות

Grok 4.6 מדביק את GPT-5.6 Sol: context של 500K וציון 61 ב-AAI Index

ניתוח AI

xAI שחררה את Grok 4.6, וממקמת אותו כמודל ברמת המובילים בחצי ממחיר יריבים דומים. בנוי כשדרוג post-training על בסיס Grok 4.5, הוא מותאם להתמדה במשימות agent אוטונומיות, קוד ועבודה חזותית, עם חלון context של 500,000 tokens. במדד Artificial Analysis Intelligence Index הוא קיבל 61, משתווה ל-GPT-5.6 Sol ועוקף את Kimi K3 של Moonshot כדי לדרג כמודל השלישי הטוב בעולם לפי ה-benchmark. xAI ציטטה גם ציון ELO של 1753 ומקום ראשון ב-leaderboard של Databricks.

התמחור הוא הזרוע האגרסיבית: 2 דולר למיליון tokens קלט ו-6 דולר למיליון tokens פלט, בערך חצי מהמודלים המובילים המתחרים. המודל נשלח מיד ברחבי Cursor, Grok Build, ה-Grok Bot וה-API של xAI. יומיים אחרי ההשקה הוא נכנס ל-GitHub Copilot בשמונה משטחי פיתוח, כאשר GitHub הדגישה תוצאות חזקות בקוד מבוסס-terminal בתוך VS Code ו-Copilot CLI למשימות agentic ארוכות-טווח. אילון מאסק אישר בקצרה 'Grok 4.6 עכשיו ב-Copilot,' וארווינד סריניוואס, ה-CEO של Perplexity, אמר שהצוות שלו מדד אותו כ-orchestrator ש'יושב בדיוק על ה-Pareto frontier של ביצועים מול עלות.'

מבחינה תחרותית, Grok 4.6 נכנס לשבוע צפוף במיוחד — Gemini 3.7 Flash, DeepSeek V4-Pro ו-Qwen 3.8 כולם נשלחו לצידו — ומיצוב המחיר/ביצועים שלו לוחץ ישירות על OpenAI ו-Anthropic בעלות.

הקריאה הספקנית, שהושמעה ב-r/singularity (810 הצבעות, 338 תגובות): Grok 4.6 הוא כוונון post-training על אותו מודל בסיס, לא ארכיטקטורה מובילה חדשה, כך שהשוואה ל-Sol ב-benchmark יחיד עשויה שלא להכליל. מבקרים מתפצלים בין מעריצים שמציינים את אורך ה-context שלו וההתמדה ה-agentic לבין ספקנים שחוששים מבחירה סלקטיבית של תוצאות benchmark. כדאי לעקוב אחר אימוץ בעולם האמיתי ב-Copilot לאות היציב.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog