Briefing
חזרה
AnthropicAugust 19, 20262 מקורות

Anthropic מטביעה watermark סמוי ב-Claude — ומפתחים עקפו אותו תוך ארבע שעות

ניתוח AI

המהלך של Anthropic להטמיע watermark בכל טקסט וקובץ שנוצרים על ידי Claude הוא תגובה ישירה לכללי שקיפות חדשים של האיחוד האירופי, שדורשים שפלטי AI יהיו ניתנים לזיהוי. ה-watermarks בלתי נראים, מוטמעים גם בטקסט וגם בפלטי קבצים, ונועדו לאפשר למערכות במורד הזרם לזהות תוכן שנוצר על ידי AI.

ההשקה נתקלה מיד בבעיה היסודית של watermarking בטקסט: תוך ארבע שעות מאישור ההכרזה, מתכנתים כבר התהדרו ב-overrides ובעקיפות שעובדות, כפי שדיווח Wired. בניגוד ל-watermarks בתמונות, אותות טקסטואליים ניתן לעיתים קרובות להסיר באמצעות ניסוח מחדש, פורמט מחדש או טרנספורמציות טריוויאליות — מה שהופך זיהוי אמין לקשה במיוחד.

מבחינה תחרותית, זו תכונה מונעת-רגולציה ולא מהלך של יכולת, והיא ממצבת את Anthropic כמי שמנסה להוביל ב-alignment רגולטורי מול האיחוד האירופי — עקבי עם המיתוג הבטיחותי הרחב שלה השבוע (חשיפת קצב הכנסות של 65 מיליארד דולר, העלאת הסיכון ל'נמוך'). אבל שחרור מנגנון זיהוי שנשבר תוך שעות מסתכן להיראות ראוותני.

תגובת הקהילה הייתה מיידית וספקנית: שרשורים טענו שהפרשה מוכיחה שזיהוי טקסט-AI אולי בלתי אפשרי טכנית בכלל, ומתחו ביקורת על הכלל של האיחוד האירופי כבלתי-אכיף. עבור ארגונים שמסתמכים על provenance מבוסס-watermark לצורך עמידה ברגולציה, המסקנה היא זהירות — אל תתייחסו ל-watermark כאל חסין-שיבוש. שווה לעקוב אם האיחוד האירופי יקבל watermarking שנשבר בקלות כעומד בדרישות, ואם Anthropic תחזק את השיטה.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog