Anthropic משיקה את Claude Opus 5: המודל היכולתי והמיושר ביותר שלה — בחצי מחיר

Anthropic השיקה את Claude Opus 5, ותיארה אותו כמודל ה-Opus היכולתי ביותר שלה והכי פחות חשוף להטעיה לשימוש לרעה. המודל מתקרב ליכולות של Claude Fable 5 בערך בחצי מהמחיר, ומספק את הביצועים החזקים ביותר של החברה עם שיפורים בולטים ב-coding, מדע, אוטונומיה, תיקון עצמי והתאוששות משגיאות. הוא כעת מודל ברירת המחדל ב-Claude Max והאופציה החזקה ביותר ב-Claude Pro, עם יכולות חדשות למפתחים שכוללות החלפת כלים באמצע שיחה ו-fallback אוטומטי דרך ה-API.
ב-AWS, Opus 5 הגיע ל-Amazon Bedrock עם תאימות ל-zero data retention. Swami Sivasubramanian מ-AWS הדגיש את החוזקות ה-agentic שלו: agent-ים ארוכי-טווח ש'עובדים במשך שעות ואפילו לאורך הלילה', מנווטים בין codebases כמו מהנדס מנוסה, מתאוששים משגיאות, ומתעמתים עם הוראות פגומות במקום לבצע אותן בעיוורון — ומפרקים משימות מורכבות ל-sub-agents שדורשים פחות פיקוח.
התגובות ל-benchmarks היו חזקות. François Chollet ציין ש-Opus 5 קבע state of the art חדש ב-ARC-AGI-3 עם 30% — benchmark שמודד פתרון בעיות ללא חשיפה מוקדמת, שבו scaling היסטורית קנה הכי מעט — וכינה זאת 'קפיצה מרשימה'. Boris Cherny מ-Anthropic הדגיש ש-Opus 5 הוא המודל 'הכי פחות חשוף ל-prompt injection עד כה' של החברה, טענה שנחתה בעוצמה בהינתן חשיפת בריחת ה-sandbox של OpenAI באותו שבוע.
ההכרזה הרשמית של Anthropic שלטה ב-Hacker News (1,346 נקודות, 730 תגובות), והפכה לסיפור שחרור המודל המוביל של היום. ספקנים הציעו הסתייגויות: Jerry Liu מ-LlamaIndex בחן את Opus 5 בפענוח מסמכים דרך ParseBench ומצא אותו רק 'בערך באותה רמה כמו Opus 4.8' ובינוני ב-OCR — והמליץ לא להשתמש בו לפענוח מסמכים בקנה מידה גדול ב-8 סנט לעמוד. שווה לעקוב אחר לחץ המחירים מול DeepSeek V4 ו-Qwen של Alibaba.