Hugging Face מציגה את Open Alignment Initiative: מתנדבת לבדוק את חברות ה-AII

Hugging Face השיקה את Open Alignment Initiative, בהובלת המייסד-שותף קלמאן דלאנג ותומאס וולף, כשהיא ממצבת את החברה לשמש כמבקר חיצוני ו-'מעריך מוטמע' עבור חברות ה-AI המובילות. ההכרזה הגיעה זמן קצר אחרי שדריו אמודיי מ-Anthropic הציע בדיוק תוכנית כזו של מעריך מוטמע במאמרו 'Pace the Frontier', ודלאנג ביקש במפורש להיות חלק ממנה. 'עכשיו ברור ש-alignment הוא קריטי ולא ייפתר מאחורי הדלתות הסגורות של קומץ חברות AI מובילות', כתב דלאנג.
היוזמה ממסגרת מחדש את Hugging Face — הידועה בעיקר כ-hub של מודלים open-source ומאגרי נתונים — כשחקן בטיחות ניטרלי וצד שלישי. לתפקיד הזה יש משקל בהינתן מרכזיות הפלטפורמה במחנה המודלים הפתוחים, אך הוא מגיע גם על רקע שני קווי עלילה מסבכים: Hugging Face נמצאת בתהליך רכישה על ידי NVIDIA תמורת 12.93 מיליארד דולר (עסקה שאושרה ב-3 בספטמבר), והפלטפורמה שלה עצמה אירחה השבוע forks 'abliterated' לא-מצונזרים של V4.1-Flash של DeepSeek בתוך שעות מהשחרור — המחשה חיה של כמה קשה לאכוף alignment על פלטפורמה פתוחה.
המהלך משך מעורבות חוצת-תעשייה: אנדריי קרפתי שיבח את דחיפת ההאטה הרחבה יותר, והתחייבות דלאנג להצטרף לתוכנית המעריכים איתתה שרעיון המעריך המוטמע צובר אימוץ וולונטרי מעבר ל-Anthropic ו-OpenAI. מבקרים, לעומת זאת, תהו האם חברה שמפיצה בו-זמנית forks לא-מצונזרים של מודלים ונבלעת על ידי יצרנית שבבים יכולה לשמש באמינות כמבקר alignment עצמאי.
מה לעקוב: האם חברות ה-AI המובילות אכן יעניקו ל-Hugging Face גישת מעריך, איך הבעלות של NVIDIA משפיעה על עצמאותה, והאם היוזמה תפיק מתודולוגיות ביקורת קונקרטיות ולא הצהרת כוונות.