חזרה
OpenAIAugust 14, 20261 מקורות

OpenAI חושפת את Ultrafast: GPT-5.6 Sol רץ פי 14 מהר על Cerebras

ניתוח AI

Ultrafast של OpenAI מוכר latency, לא יכולת. השכבה מריצה את GPT-5.6 Sol במהירות של עד פי 14 מהרגיל — בערך 750 output tokens בשנייה על חומרה של Cerebras — ומכוונת ל-agents בזמן אמת ולאפליקציות קוליות, שם צוואר הבקבוק הוא זמן התגובה ולא האינטליגנציה הגולמית. הדיון ב-Hacker News (220 נקודות, 75 תגובות) נחת בדיוק על הקריאה הזו: 'מוכרים latency, לא יכולת'.

הסיגנלים העסקיים סביב המוצר גדולים אולי מהמוצר עצמו. ה-CFO דאלי פראיר סיפר למשקיעים שהכנסות ה-enterprise עקפו את ההכנסות מהצרכנים — אבן דרך לחברה שנבנתה על הוויראליות הצרכנית של ChatGPT, ועדות לכך שמרכז הכובד של המונטיזציה עובר לעסקים שמשלמים על agents ועל נפחי API. במקביל, OpenAI קיצצה את ערבויות המימון ל-NVIDIA עבור מרכז הנתונים שלה באוהיו מ-250 מיליארד דולר לפחות מ-120 מיליארד — נסיגה בולטת על רקע קדחת מימון המחשוב של השבוע.

השותפות עם Cerebras מעניינת אסטרטגית: הישענות על מאיץ שאינו NVIDIA עבור שכבת המהירות, בדיוק כשהיא מקצצת את המחויבויות שלה למרכזי נתונים של NVIDIA, מרמזת על גיוון ספקים. הערבות המצומצמת מנוגדת לנרטיב ה-capex המקסימליסטי שכולם דוחפים השבוע. שווה לעקוב אחר שני דברים: האם עדיפות ה-enterprise על הצרכני תחזיק כמגמה יציבה לקראת IPO שמדובר עליו, והאם התלות של Ultrafast ב-Cerebras מסמנת גידור חומרתי אמיתי או רק מוצר latency נישתי. ב-Reddit הופץ גם סיכום של עובד OpenAI על שיפורי מהירות צפויים ב-ChatGPT (490 upvotes), מה שמרמז שהמהירות היא מהלך רוחבי בחברה.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog