ה-Open ASR Leaderboard של Hugging Face מוסיף את שפת ה-Global South הראשונה שלו

Hugging Face הכריזה ב-28 באוגוסט שה-Open ASR Leaderboard שלה — ה-benchmark הקהילתי למודלים של זיהוי דיבור אוטומטי — הוסיף את שפת ה-Global South הראשונה שלו, והרחיב הערכת ASR סטנדרטית לשפות ולקהילות שהיו מיוצגות בחסר באופן כרוני ב-benchmarking של speech-AI.
המשמעות נוגעת לייצוג ולמדידה. benchmarks של ASR התמקדו היסטורית באנגלית ובקומץ שפות אירופאיות ומזרח-אסיאתיות עתירות-משאבים, כלומר המודלים עברו אופטימיזציה והושוו על נתונים שמותירים בחוץ מיליארדי דוברים. הוספת שפת Global South יוצרת אמת-מידה ציבורית וניתנת להשוואה שמתמרצת את בוני המודלים לשפר בה את הביצועים — האפקט הקלאסי של leaderboard: מה שנמדד עובר אופטימיזציה.
התזמון בולט לאור הידיעה שלפיה NVIDIA רוכשת כביכול את Hugging Face. יוזמות לתועלת הקהילה כמו benchmarking מכליל-שפות הן בדיוק סוג העבודה הפתוחה ומונעת-המשימה שמשקיפים חוששים שסדרי העדיפויות שלה עלולים להשתנות תחת בעלות תאגידית — חשש שהושמע בתגובת 'Goodbye Uncensored models' ב-r/huggingface. שחרור ההרחבה הזו דווקא עכשיו מדגיש את המשך התפקיד הקהילתי של Hugging Face בתקופת הרכישה.
מבחינה תחרותית וחברתית, הכללת שפות ב-AI היא תחום מיקוד גובר, שמתיישר עם מאמצי AI ריבוניים ואזוריים (שאיפות המודל הערבי של Mistral עם HUMAIN, למשל) ועם קריאות רחבות יותר להפחית את המרכזיות של האנגלית ב-foundation models. שווה לעקוב אחרי איזו שפה ספציפית נוספה, האם Hugging Face תתחייב ל-roadmap של שפות Global South נוספות, כיצד מודלי ASR קיימים מדורגים עליה, והאם היוזמה תשרוד ותתרחב תחת הבעלות של NVIDIA.