Grok 4.6 מתפרש ל-Vertex, Bedrock ו-Cursor — ומטפס לראש CursorBench

Grok 4.6, היורש של xAI ל-Grok 4.5, מבצע תפיסת-קרקע אגרסיבית בהפצה. הוא הגיע ל-Google Cloud Vertex AI עם חלון הקשר של 500K tokens ומאמצי reasoning ניתנים-להגדרה, בעקבות הוספתו ב-19 באוגוסט ל-Amazon Bedrock עם ניתוב cross-region inference ברחבי אזורי US וגלובליים, והוא גם פעיל על Cursor, OpenRouter, Vercel ו-Cloudflare. על Bedrock הוא מחויב כמודל coding ו-agentic עם הקשר של 500K.
טענת ה-benchmark המרכזית היא מקום #1 ב-CursorBench במצב 'Extra High Thinking' — תוצאה שמפתחים קיבלו הן בהתלהבות והן בחשדנות לגבי עיתוי ה-benchmark. התמחור הוא המשיכה הנוספת: בכ-2/6 דולר למיליון input/output tokens (כ-8 דולר משולב), Grok 4.6 מוזיל משמעותית ביחס לטווח 30–60 דולר של Opus ו-Sonnet, וממקם את עצמו כמשבש-עלויות למשימות agent. נקודת החיכוך שמפתחים סימנו היא מדרגת חיוב על הקשר ארוך שמכפילה את המחיר ב-200K tokens.
xAI שילבה את השקת המודל עם גישה רחבה יותר ל-Grok Bot, שירות agent ענן מתמשך (מדווח על 300 דולר לחודש) שמציע כעת ניסיון חינם של שבעה ימים. השילוב — מודל זול כמעט-מוביל בתוספת agent אוטונומי ממוצר — הוא ההימור של xAI לזכות בתשומת לב המפתחים בכל ענן ו-IDE מרכזי בו-זמנית, ולא דרך ערוץ דגל יחיד.
הקריאה האסטרטגית היא שרוחב ההפצה, לא מנהיגות גולמית ב-benchmark, הוא הנשק האמיתי של xAI כאן: על ידי שילוח ל-Vertex, Bedrock, Cursor, OpenRouter, Vercel ו-Cloudflare בבת אחת, היא ממקסמת את הסיכוי לאימוץ ברירת-מחדל לפני שארגונים משלימים הערכות. השאלות הפתוחות הן עמידות ה-benchmark בבדיקות עצמאיות, והאם מדרגת החיוב ב-200K מערערת את סיפור העלות עבור בדיוק אותן משימות agent ארוכות-טווח שחלון ה-500K נועד לשרת.