דוח Anthropic: Claude נוצל לתוכנת הכוונת טילים ולריגול מדינתי

הדוח מכסה פעילות שנחסמה בין דצמבר 2025 לאוגוסט 2026 בשבע קטגוריות נזק: פעולות cyber, פעולות השפעה, מעקב, הונאות ותרמיות, שימוש לרעה ביולוגי, פיתוח נשק קונבנציונלי, ו-distillation. צוות ה-Threat Intelligence של Anthropic מספר שזיהה את הפעולות, חסם אותן, חיזק את מנגנוני ההגנה ושיתף מודיעין עם הרשויות. Claude Haiku, Sonnet ו-Opus היו מעורבים; ראוי לציין שאף אחד מהמקרים לא השתמש במודלים ממחלקת Fable או Mythos, למעט מקרה אחד של distillation בלתי חוקי.
הגילויים המדאיגים ביותר — פיתוח תוכנת הכוונת טילים וריגול מדינתי — הם הפריטים המרכזיים שהכתבים תפסו, לצד תיעוד של שבע חברות AI מבסיס סין שניסו לחלץ את היכולות של Claude. Anthropic ממסגרת את הפרסום כאחריות לחשיפה: 'ככל שהמודלים נעשים מסוגלים יותר, הסיכונים שלהם יגדלו, אלא אם מפתחי ה-AI ומגיני החברה' יסתגלו.
הדוח נוחת באותו שבוע של מאמר ההאטה של Amodei, ומעניק לטיעון שלו עיגון אמפירי. ב-r/LocalLLaMA, השרשור 'התמודדות עם שימוש לרעה ב-AI' אסף 126 הצבעות ודיון ספקני בשאלה אם חברת AI מובילה כלשהי יכולה באמת למנוע משחקנים מדינתיים נחושים לחמש מודלים — שאלה שחותרת תחת ההרגעה שהדוח אמור לספק. הוא גם מזין את הנרטיב החוזר של Anthropic סביב אירועי cyber-eval, אך העובדות החדשות בפרק הזה הן מקרי השימוש הספציפיים של הטילים והריגול ושבעת ניסיונות החילוץ שהוזכרו בשמם.