חזרה
MistralAugust 9, 20262 מקורות

Mistral משיקה Shieldstral 1.0 3B — classifier בטיחות פתוח ומותאם-מדיניות

ניתוח AI

Mistral השיקה את Shieldstral 1.0 3B, מסווג בטיחות מולטימודלי במודל פתוח שמחשב מחדש את מיתון התוכן כמשימת שאלות-תשובות גמישה, במקום טקסונומיית נזק קבועה. המודל, שנבנה על Ministral-3-3B-Base עם Pixtral vision, מאפשר למפעילים להגדיר מדיניות בשפה חופשית בזמן ה-inference — לספק את המדיניות כשאלת כן/לא — כך שניתן לכוון אותו מחדש להקשרים וכללים חדשים בלי retraining.

ב-benchmarks, Shieldstral מקבל ממוצע F1 של 84.9% בבטיחות טקסט (משתווה ל-GPT-OSS-Safeguard-20B הגדול פי 20) ו-83.8% בבטיחות מולטימודלית, ומתעלה על מודלים גדולים ממנו פי שבעה בערך. קריטי לא פחות, הוא רץ ביעילות על GPU בודד של NVIDIA בנפח 16GB ומשוחרר תחת Apache 2.0, מה שהופך מיתון ברמת enterprise לבר-deploy באתר הלקוח בלי תלות בענן או עמלות per-call.

התכנון המסתגל למדיניות זכה לשבחים בקהילות מפתחים מודעות-בטיחות כי הוא מתאים לצרכי מיתון אמיתיים — לפלטפורמות ותחומי שיפוט שונים יש כללים שונים, וממשק מדיניות בשפה חופשית נמנע מהשבירות של טקסונומיות קבועות. זה נוחת בתוך נושא רחב יותר השבוע של בטיחות-AI-כתשתית, לצד מסווג Auto Mode של Anthropic ומודל ה-cyber המגודר של OpenAI.

הספקנים ירצו לראות איך ממשק המדיניות בשפה חופשית מחזיק מול prompts יריביים ומקרי קצה שטקסונומיות קבועות תוכננו לתפוס, והאם ציוני ה-F1 יחזיקו בהתפלגויות של העולם האמיתי לעומת מערכי benchmark. מה לעקוב: אימוץ על ידי פלטפורמות שכיום משלמות על API סגור למיתון, והאם Mistral תרחיב את הגישה לוריאנטים גדולים או מתמחים יותר.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog