OpenAI עוצרת את Astra: לראשונה חברה מסמנת שהמודל שלה חצה 'סף סייבר קריטי'

ההשהיה היא חשיפה תקדימית: אף אחת מחברות ה-AI המובילות לא אמרה בעבר בפומבי שאחד המודלים שלה חצה סף סכנה פנימי 'קריטי' ליכולת cyber. לפי OpenAI, ההערכות של Astra הצביעו על כך שהוא מסוגל לגלות ולנצל פרצות באופן אוטונומי ברמה שמצדיקה זהירות יוצאת דופן, מה שהוביל לעצירת פיתוח נוסף בזמן שנבנים אמצעי הגנה.
מבחינה טכנית, מסגרת המוכנות של OpenAI מדרגת יכולות מנמוך ועד קריטי; הגעה ל-'critical cyber' מפעילה מעקב מוגבר, גישה מוגבלת ותיאום עם סוכנויות ממשלתיות בנוגע לבדיקות. החברה אומרת שהיא מיישמת את האמצעים האלה לפני שתחליט אם וכיצד להמשיך עם Astra.
התזמון בולט — זה נוחת באותו שבוע שבו OpenAI השיקה את מודלי ה-cyber ההגנתיים Daybreak Red ו-Daybreak Blue ב-Bedrock, מה שמדגיש את מתח השימוש הכפול: אותן יכולות שמסייעות למגנים יכולות לחמש תוקפים. זה גם מתלכד עם תחלופת בכירים, כולל עזיבת ה-COO Brad Lightcap.
התגובה ב-r/artificial הייתה מאשרת בזהירות — שבחים על היותה החברה הראשונה שמסמנת את עבודתה שלה בסף הקריטי, מרוסנים בשאלות אם ההשהיה היא בדיקת בטיחות אמיתית או דרך לקנות זמן בזמן שהמתחרים משלימים פערים. ספקנים גם שואלים עד כמה ניתן לאמת את ההערכה הפנימית, בהיעדר audit חיצוני. מה לעקוב: האם OpenAI תחדש את Astra, והאם המתחרים יחשפו ספים דומים.