חזרה
OpenAIAugust 13, 20261 מקורות

OpenAI משיקה מצב ׳Ultrafast׳ ל-GPT-5.6 Sol: 750 tokens בשנייה על Cerebras

ניתוח AI

OpenAI השיקה את 'Ultrafast', מצב הפעלה חדש ל-GPT-5.6 Sol שמספק כ-750 token פלט בשנייה — בערך פי 14 מהר יותר מהמצב הרגיל — ורץ על שבבי wafer-scale של Cerebras במקום GPU. המצב נמצא בגישה מוקדמת מוגבלת ומכוון ישירות לשימושים ארגוניים רגישים ל-latency: תגובה לאירועים, שירות לקוחות, ניתוח פיננסי ו-e-commerce.

המשמעות היא ארכיטקטונית. בכך שהיא מנתבת מודל מוביל אל סיליקון של Cerebras, OpenAI מאותתת שהיא תשתמש במאיצים שאינם NVIDIA היכן שהם מנצחים ב-throughput, ושמהירות ה-inference — לא רק אינטליגנציה — היא כעת ציר מוצר ששווה SKU נפרד. עבור workflows של agents ששרשרים קריאות מודל רבות, האצה פי 14 יכולה להיות ההבדל בין agent שימושי בזמן אמת לבין כזה שאי אפשר להשתמש בו.

ההשקה הגיעה על רקע תחלופת בכירים מתמשכת ב-OpenAI: החברה החליפה את ה-CRO דניז דרסר בנשיא Wiz דאלי רג'יץ', ובנפרד שילחה תכונות צרכניות כולל 'Computer History' (ChatGPT שזוכר פעילות ב-Mac, מגיע ל-Pro/Business/Enterprise) וחיפוש הזמנות שגרג ברוקמן חשף בטיזר. אלה הכרזות נפרדות; Ultrafast היא הכותרת הפונה לארגונים.

מבחינה תחרותית, Ultrafast מעמידה את OpenAI בניגוד ישיר ל-Groq ולמתחרים המתארחים על Cerebras ששיווקו throughput קיצוני של token, ומול מיצוב המהירות-והעלות של Grok 4.6 ו-Gemini 3.7 Flash באותו שבוע. ההסתייגות היא זמינות — זו גישה מוקדמת מוגבלת עם תמחור וקיבולת לא מוצהרים, ואספקת Cerebras מוגבלת. שווה לעקוב האם Ultrafast תתקדם לזמינות כללית וכיצד הכלכלה לכל token שלה תשתווה ל-Sol המוגש על GPU רגיל.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog