Anthropic משיקה את Claude Opus 5: ביצועים כמעט כמו Fable 5 — בחצי מחיר

Anthropic השיקה את Claude Opus 5 כחודשיים בלבד אחרי שדרוג ה-Opus הקודם, והפעם המיצוב ברור: חיסכון בעלויות. מדובר במודל שמתקרב לרמת האינטליגנציה של Fable 5 בערך בחצי מהמחיר. הוא רושם ציוני SOTA במשימות coding ובעבודת ידע, ולפי François Chollet אף קבע שיא חדש ב-ARC-AGI-3 עם 30.2% — נתון מעניין במיוחד, כי ARC-AGI מודד פתרון בעיות חדשות, בדיוק התחום שבו scaling היסטורית תרם הכי פחות. Opus 5 הוא כעת מודל ברירת המחדל ב-Claude Max, זמין ב-Claude Pro, וזמין באופן כללי גם על Amazon Bedrock עם תאימות ל-zero-data-retention (ZDR).
מבחינה מעשית, Swami Sivasubramanian מ-AWS מספר ש-Opus 5 מפעיל agents שרצים שעות ארוכות או לאורך כל הלילה, מתאוששים משגיאות, מנווטים בקוד כמו מהנדס מנוסה, ואפילו מתעקשים כנגד הוראות שגויות במקום לבצע אותן בעיוורון — תוך פירוק משימות מורכבות ל-sub-agents שדורשים פחות פיקוח. Boris Cherny מ-Anthropic הדגיש ש-Opus 5 הוא המודל הכי עמיד של החברה בפני prompt injection עד היום לרוחב מבחני ה-PI שלה — טענת אבטחה משמעותית בשבוע שבו כותרות ה-agents הסוררים היו בכל מקום.
מבחינה תחרותית, Opus 5 מגיע בדיוק כשהמודלים הסינים (Qwen 3.8-Max, Kimi K3, DeepSeek V4) סוגרים את הפער במחיר נמוך יותר, ו-Anthropic משיבה על כך ישירות בזירת המחיר. אבל הספקנים לא הרפו: thread ב-r/singularity עם 1,528 upvotes האשים את Anthropic ב-'benchmaxxing' של ציון ה-ARC-AGI, ו-Jerry Liu מ-LlamaIndex מדד את Opus 5 כשווה ערך בלבד ל-Opus 4.8 בפענוח מסמכים — וגרוע יותר מ-Gemini 3.6 Flash הזול יותר בטבלאות צפופות. שווה לקוראים לעקוב אם הורדת המחיר תחזיק מעמד מול גל המודלים הפתוחים, ואם האמינות של ה-agents בעולם האמיתי אכן תואמת את מספרי ה-benchmark.