Claude Sonnet 5.5 כאן: מהיר ב-30%, זול יותר — וזמין בחינם

Claude Sonnet 5.5 של Anthropic מצטרף ל-Opus 5.5 כמודל השני במשפחת 5.5, והמספרים המרכזיים מרשימים:
- מהיר ביותר מ-30% לעומת Sonnet 5;
- עלויות ה-API ירדו בעד 30%;
- 70.6% ב-benchmark ה-agentic coding של Terminal-Bench 4.0, לעומת 10.3% בלבד ל-Sonnet 5;
- פער של עד שתי נקודות מ-Opus 5.5 ב-benchmarks של תהליכי עבודה אמיתיים כמו GDPval-AA.
Anthropic ממצבת אותו כמודל הביניים החזק ביותר שלה לקוד ולעבודת ידע יומיומית.
ההפצה הייתה רחבה כבר מהיום הראשון. AWS הנגישה את Sonnet 5.5 ב-Amazon Bedrock וב-Claude Platform on AWS, לצד הנחיות מתי לבחור ב-Sonnet ומתי ב-Opus, והוא זמין גם ב-AWS GovCloud (US) לעומסי עבודה מוסדרים במגזר הציבורי. Simon Willison הצביע על מה שלדעתו הפרט החשוב ביותר: Sonnet 5.5 מפעיל עכשיו את השכבה החינמית ב-claude.ai, כך שגם משתמשים שלא משלמים מקבלים את היכולות האלה. השכבה החינמית של ChatGPT, לעומת זאת, עדיין רצה על GPT-5.6 Luna, ש-Willison תיאר כ'הרבה פחות מסוגל'.
מבחינה תחרותית, ההשקה נוחתת בשבוע מוזר. OpenAI משכה את GPT-6.1 Astra בגלל כשלי בטיחות, ו-Anthropic קיבלה מרחב פנוי לדחוף מוצר שכבר זמין. הלחץ על המחיר, עם זאת, כבד. הורדת המחיר של כ-70% ב-DeepSeek V4.1-Flash ממשיכה לכווץ את התמחור של מודלי הביניים המערביים, ובקהילה ציינו במפורש את Sonnet 5.5 כמודל שנמצא תחת הלחץ הזה. במקביל, משתמשי r/LocalLLaMA ממשיכים להראות מודלים בסדר הגודל של Qwen 27B שעושים עבודה מרשימה על כרטיס 4090 יחיד.
השאלות הפתוחות למפתחים:
- האם הקפיצה ב-Terminal-Bench תחזיק גם ב-harness עצמאי, כשוויכוח ה'ה-harness משנה' רועש במיוחד השבוע;
- האם החיסכון בעלות לכל משימה ישרוד עומסי agent כבדים;
- איך תשקיף ה-IPO של Anthropic, שלפי Reuters מראה עלויות מזנקות, מתיישב עם חלוקה חינמית של מודל ברמה מובילה.