חזרה
AnthropicJune 10, 20263 מקורות

Anthropic משיקה את Claude Fable 5 ואת Mythos 5 המוגבל בסייבר — המודלים החזקים שלה אי פעם

ניתוח AI

Anthropic מיצבה את Fable 5 כקפיצת דרך דורית: בנוי לעבודת agent אוטונומית ארוכת-טווח שיכולה 'להוביל פרויקטים מורכבים במשך ימים' ללא התערבות, עם יכולת להבין דיאגרמות, גרפים וטבלאות המקוננים בתוך מסמכים ולוודא באופן יזום את הפלט של עצמו. התמחור שדווח במקורות שונים נע בין $10 למיליון token בקלט ו-$25–$50 למיליון token בפלט, והמודל נושא חלון context של מיליון token. את Mythos 5 — אותו מודל בסיס עם הסרת מנגנוני הבטיחות בתחום ה-cyber — תיארו כמודל ה-cybersecurity החזק בעולם, המוגבל לקבוצה מבוקרת בלבד.

מבחינה מכניזמית, Fable 5 מנתב בקשות מסומנות בתחומי cyber, ביולוגיה וכימיה אל Claude Opus 4.8, guardrail שנועד למנוע שימוש לרעה תוך שמירה על זמינות רחבה של המודל המרכזי. Swami Sivasubramanian ו-Matt Wood מ-AWS פרסמו שניהם שההשקה מביאה 'יכולות ברמת Mythos לכל הלקוחות' על Bedrock עם בקרות האבטחה, הפרטיות והנתונים שארגונים כבר מפעילים.

תחרותית, זה מעלה את הרף מול GPT-5.5 ו-Gemini 3, בעיקר ב-agentic coding: תגובת המפתחים (כשמנגנוני הבטיחות לא נדלקו) הייתה 'כמעט פה אחד ולעיתים מופתעת', עם דיווחים על שיפור של 10–20 נקודות מעל Opus 4.8 ב-refactors מרובי-קבצים ובריצות agent ארוכות. Jerry Liu מ-LlamaIndex הזהיר שהמודל חלש בפענוח מסמכים — שווה ערך בערך ל-Gemini 3 Flash בעלות token גבוהה פי 10–15 — ונופל מספקי OCR ייעודיים.

אטימות ה-benchmark ספגה ביקורת: Code Newsletter ציין שטבלאות ההשקה הציגו 'ציונים גבוהים בלבד' בעוד שכ-21% מניסויי Terminal-Bench סירבו ונפלו חזרה ל-Opus 4.8, מה שיצר פער בין הפרסום לבין המציאות. התנהגות הסירוב הזו וניתוב הבטיחות הם שהציבו את הבמה למחלוקת האמון שפרצה תוך ימים.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog