Briefing
חזרה
xAIJuly 21, 20261 מקורות

Grok 4.5 מוביל ב-agentic coding — בזמן ש-Gemini 3.6 נגרר מאחור

ניתוח AI

Grok 4.5 של xAI התברר כמוביל בולט ב-agentic coding, לפי סיקור ה-benchmark של Gizmodo, וכביכול עוקף את Gemini 3.6 Flash שהושק לאחרונה על ידי Google במשימות האלה. הדיווח ממסגר את Gemini 3.6 כמפגר אחרי Claude Sonnet 5 ו-GPT-5.6 ברוב ה-benchmarks המרכזיים, וכעת נופל מאחורי Grok 4.5 ספציפית ב-agentic coding — יתרון שהכתבה מייחסת בחלקו לקלט מצוות Cursor, מה שמרמז על שיתוף פעולה הדוק עם יצרנית מובילה של כלי AI לכתיבת קוד.

המנוע, אם הקשר ל-Cursor מחזיק מים, הוא שלולאות משוב מעולם האמת של coding agents — נתונים על איך מפתחים באמת משתמשים ב-AI בתוך IDE — יכולות לשפר משמעותית את הביצועים ה-agentic של מודל, מעבר לכיוונון ל-benchmarks בלבד. זה יהיה template תחרותי: לשתף פעולה עם הכלים שבהם העבודה ה-agentic מתרחשת בפועל.

מבחינה תחרותית, זה ממסגר מחדש את טבלת המובילים של המודלים עבור מפתחים: במקום מודל 'הכי טוב' יחיד, היכולת מחודדת לכל משימה בנפרד — הד לתובנה הוויראלית של François Chollet ש'הטריק השיווקי הבסיסי של תעשיית ה-AI הוא לגרום לך להאמין שהחוד הגבוה ביותר הוא רצפה'. העוצמה של Grok ב-agentic coding, יחס העלות-ביצועים של Claude Sonnet 5, וכושר ה-reasoning של GPT-5.6 — כל אחד מנצח בפרוסה אחרת. Elon Musk גם התהדר בקלות שבה אפשר לבנות עם Grok משחקי וידאו. הספקנים מציינים שמדובר בפרשנות של benchmark מצד שלישי ולא בשחרור רשמי של xAI, ושהמובילות ב-benchmarks מתחלפת מדי שבוע. כדאי לעקוב אחר הערכות agentic-coding בלתי-תלויות, והאם הקשר של Grok ל-Cursor יהפוך לאינטגרציה רשמית.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog