מרוץ ה-AI עובר ממודלים גדולים למערכות זולות וחכמות יותר, מאותת Sun Valley

סיפור-העל של השבוע, שהתגבש ב-Sun Valley ובכיסוי של CNBC: מרוץ ה-AI מסיט את הפוקוס מקנה מידה גולמי של מודלים לעבר עלות, שליטה ויעילות מחשוב. Sam Altman מ-OpenAI הודה שהמודלים הפתוחים הסיניים 'נעשים טובים מאוד', מנכ"ל Palo Alto Networks ניקש ארורה טען שתמחור ה-AI זקוק לחשיבה מחדש מהיסוד, ויו"ר SK Group צ'י טאה-וון הוסיף את דעתו למסגור מחדש של כלכלת המחשוב.
הסימנים נמצאים בכל מקום בתמצית הזו. GPT-5.6 מוביל עם טענות יעילות (Luna בעלות נמוכה פי 25); xAI מתהדרת בתמחור הזול של Grok 4.5 וביעילות ה-reasoning שלו; AWS דוחפת את Claude Sonnet 5 בתמחור של Sonnet; Hugging Face מדווחת שארגונים בורחים מ-API שכורים לעבר מודלים פתוחים; ו-SambaNova גייסה מיליארד דולר בהימור שתשתית ה-inference היא זירת הקרב החדשה. אפילו Goldman Sachs פתחה כיסוי על מודלים סיניים כולל Zhipu עם יעדי אפסייד משמעותיים — אישור של וול סטריט לתזת המודל הזול.
ההשלכה האסטרטגית: שיפורי היכולת ממש בקדמת הטכנולוגיה מאבדים ערך נתפס יחסית לעלות. אם מודל זול פי 6 מספק 95% מאיכות הדגל (כפי ש-LlamaIndex מצאה עבור Luna), ארגונים ימטבו לפי מחיר. זה שוחק את כוח התמחור של חברות ה-AI המובילות ומרומם תשתית, מודלים פתוחים ומתחרים סיניים.
הנגד הספקני — שהושמע בפוסט הוויראלי של geohot 'אני אוהב LLMs, אני שונא הייפ' (339 נקודות) וב'תפסיקו לומר לי לשאול LLM' — טוען שהשיח מפריז לשני הכיוונים. וטענת r/singularity ש'GPT-5.6 פותר עוד בעיה לא-פתורה' (1,292 הצבעות) מראה שיכולת קדמת הטכנולוגיה עדיין שובה את הדמיון. שווה לעקוב אם לחץ התמחור יאלץ את חברות ה-AI המובילות למאבק העלויות, או לזינוק יכולת דרמטי.