Anthropic משיקה את Claude Opus 5: אינטליגנציה כמעט בדרגת Fable 5 — בחצי מהמחיר

Anthropic מיצבה את Claude Opus 5 סביב כלכלה ולא סביב יכולת גולמית: הוא מתקרב לאינטליגנציה המובילה של Claude Fable 5, אבל בחצי מהעלות, ומכוון ישירות ל-agents ולתהליכי עבודה ארגוניים. המודל כולל context window של מיליון tokens, output מקסימלי של 128k tokens, ויכולות beta חדשות — בהן החלפת כלים באמצע שיחה ו-fallback אוטומטי ב-API לבקשות שסומנו כרגישות מבחינת בטיחות. גם Anthropic וגם AWS הדגישו שימוש agentic ממושך: Opus 5 יכול להפעיל agents שעובדים שעות ואפילו לילה שלם, לנווט בקוד 'כמו מהנדס מנוסה', להתאושש משגיאות, ולערער על הוראות שגויות במקום לבצע אותן בעיוורון.
בתחום ה-benchmarks ציין François Chollet ש-Opus 5 קבע state-of-the-art חדש ב-ARC-AGI-3 עם 30% — מבחן של פתרון בעיות ללא חשיפה מוקדמת, בדיוק ההגדרה שבה scaling היסטורית קנה הכי מעט. Boris Cherny, מוביל Claude Code, הדגיש ש-Opus 5 הוא 'המודל הכי עמיד ל-prompt injection של Anthropic עד היום', תוך שהוא מצביע על שיפורים בכל מבחני ה-prompt-injection ב-system card. ההשקה הגיעה במקביל ב-AWS Bedrock (עם תאימות ZDR), ב-Kiro ב-GovCloud, וב-API של Anthropic עצמה.
מבחינה תחרותית, Opus 5 נוחת בתוך מלחמת עלויות: החיסכון של 89% ש-Microsoft טוענת לו ב-MAI, מחיר הרצפה של Qwen 3.8 Max מבית Alibaba, והתמחור האגרסיבי של Grok — כולם מצביעים על כך שהחזית עוברת מיכולת לכלכלה. הספקנים ריסנו את ההתלהבות: Jerry Liu מ-LlamaIndex בדק את Opus 5 על ניתוח מסמכים ומצא שהוא 'בערך באותה רמה של Opus 4.8', מעט גרוע יותר בטבלאות צפופות, והזהיר שב-8 סנט לעמוד 'אל תשתמשו בו כדי לנתח מסמכים בקנה מידה גדול'. במקביל, מנויי Max התלוננו ששימוש ברמת Fable שורף במהירות את המכסות השבועיות, ותהו על ערך המנוי.