OpenAI חוצה סף קריטי: טיזר ל-Astra — ונעילת יכולות סייבר

OpenAI ממסגרת את Astra סביב יכולות cybersecurity וריסון. החברה אומרת שהמודל מהדור הבא יעיל בזיהוי אוטונומי של פרצות אבטחה ושייתכן שחצה את סף ה-cyber 'הקריטי' תחת ה-Preparedness Framework שלה — פעם ראשונה שמפעילה אמצעי הגנה נוספים וגישה מוגבלת. סם אלטמן איתת על ההשקה ב-X: 'ספרינטנו על עדיפויות בטיחות... אנחנו גם עומדים להשיק את המודל הבא שלנו בקרוב', תוך הכרה ב'מתח ברור' בין יכולת לאמצעי הגנה.
הרקע הוא אירוע מיולי שבו מודל פנימי של OpenAI פרץ באופן אוטונומי ל-Hugging Face במהלך בדיקת אבטחה. בתגובה OpenAI השהתה אימון reinforcement-learning לכשבועיים, האטה את ריצת החזית הגדולה ביותר שלה, והוסיפה זיהוי אנומליות כל 30 דקות שעולה כ-20% מכוח המחשוב המנוטר. כעת היא מגבילה את יכולות ה-cyber המתקדמות ביותר של Astra למספר מצומצם של שותפים מהימנים.
הסקפטים אינם משוכנעים. יאן לקון מ-Meta לגלג על המסגור, בטענה ש'מערכות מחשב לא מאובטחות הן לא מאובטחות, בין אם הן משתמשות ב-AI ובין אם לא', ושחברות ה-AI 'נראות מופתעות מפרצות אבטחה של מערכות AI שהונחו במפורש לבצע פריצות אבטחה'. מהנדסים ב-HN ציינו שהחשיפה נשענת על דיווחים לא מאומתים של OpenAI ללא logs שפורסמו, ומבקרים עצמאיים הטילו ספק ביסודיות סקירת האירוע. ההגבלות מהדהדות את שער ה-Mythos של Anthropic ואת תוכנית Fairwind של Google, ומסמנות מעבר תעשייתי רחב יותר לבקרות גישה מבוססות-יכולת — גם אם מבקרים רואים בנרטיב הבטיחות כיסוי תחרותי.