חזרה
AnthropicAugust 19, 20263 מקורות

Anthropic מטביעה watermarks נסתרים ב-Claude; מפתחים שברו אותם תוך שעות

ניתוח AI

Anthropic הכריזה שמודלי Claude יטמיעו גלובלית watermarks בלתי נראים בטקסט ובקבצים שנוצרו על ידי AI, ושותלים אותות הניתנים לזיהוי מכונה בלי לשנות באופן גלוי את הפלט. המהלך ממוסגר במפורש כעמידה ברגולציות חדשות של האיחוד האירופי, בהן דרישות ה-provenance והשקיפות של ה-EU AI Act, ומתיישר עם תקני content-authenticity בסגנון C2PA. ה-watermarking נפרס על פני משטחי הפלט של Claude.

הגישה הטכנית ל-watermarking של טקסט בדרך כלל מטה את בחירת ה-tokens באופן שניתן לזיהוי סטטיסטי אך בלתי נראה סמנטית, ומאפשרת ל-Anthropic (ולצדדים שלישיים, דרך detector) לאמת שקטע נוצר על ידי Claude. עבור קבצים ותמונות, מטא-דאטה של provenance ואותות מוטמעים נעים יחד עם הפריט.

הפריסה התנגשה מיד במציאות: תוך ארבע שעות מאישור הפיצ'ר על ידי Anthropic, מפתחים כבר שיתפו בפומבי דרכים לעקוף ולהסיר את ה-watermarks. זה מהדהד ביקורת ותיקה על watermarking של טקסט AI — ניסוח מחדש, סבבי תרגום ועריכה קלה יכולים לפגוע באות או להסירו, וטכניקות פתוחות לביטולו מתפשטות מהר. הפרשה הציתה מחדש את הוויכוח האם watermarking שנכפה על ידי האיחוד האירופי בכלל ניתן לאכיפה טכנית, או שהוא בעיקר מספק תיבת סימון של compliance ואות לשחקנים בתום לב.

מבחינה תחרותית, התזמון מחודד: OpenAI במקביל שיווקה לארגונים דווקא אי-שמירה של נתוני לקוח כבידול פרטיות מול Anthropic, וראש צוות Claude Code, Boris Cherny, ציין שמודלים ממחלקת Mythos דורשים אמצעי בטיחות נוספים כשהלקוחות מחזיקים בנתונים של עצמם, 'שמגיעים בסתיו'. שווה לעקוב אם Anthropic תגיב לעקיפות בחיזוק ה-detector, ואם רגולטורים באיחוד האירופי יראו ב-watermarks שקל להסיר compliance מספק.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog