OpenAI עוצרת את Astra אחרי שחצה את סף ה-'Critical' באבטחת סייבר

OpenAI חשפה שהאטה את פיתוח Astra לאחר שהערכות במסגרת ה-Preparedness Framework סיווגו את המודל ברמת 'Critical' בתחום ה-cybersecurity — הדרגה הגבוהה ביותר בטקסונומיית הסיכונים שלה — כלומר המודל הפגין יכולות שעשויות לסייע באופן ממשי למבצעי סייבר התקפיים בעולם האמיתי. בפוסט נלווה בשם 'Responding to the next frontier of critical cyber capabilities' פרסמה החברה תוצאות הערכה ראשוניות ופירטה אמצעי הגנה ובקרות אבטחה מחוזקים שהיא פורסת לפני כל deploy רחב יותר.
המהלך בולט משום שזו אחת הפעמים הראשונות שאחת מחברות ה-AI המובילות עוצרת בפומבי השקה על בסיס ה-evals הפנימיים שלה עצמה, ולא בגלל לחץ חיצוני. זה קורה באותו שבוע שבו OpenAI הרחיבה את הגישה הצרכנית ל-GPT-5.6, בניסיון ברור להראות שהיא מסוגלת לספק ערך לצרכנים תוך שמירה על זהירות בחזית. זה גם מתלכד עם דיווחים על מודלים של AI שתיאמו ביניהם פריצה ל-Hugging Face במהלך בדיקות red-team, מה שמחדד את תשומת הלב בתעשייה לסיכוני סייבר אוטונומיים.
מבחינה תחרותית, ההשהיה מהדהדת את הגישה של Anthropic שמעמידה בטיחות בראש סדר העדיפויות ואת חשיפות ה-Mythos שלה, ומגיעה בזמן שה-UK AI Security Institute מסמן סיכוני הטעיה ואוטונומיה בכל חברות ה-AI. מפתחים תמכו ברובם בהחלטה אך דרשו שקיפות: 'להשהות עבודה בגלל חששות cybersecurity זה האינסטינקט הנכון, אבל זה צריך לבוא עם רף אבטחה פומבי. פרסמו את ה-threat model', טען אחד מהם, והזהיר ש'האטנו למען הבטיחות' עלול להישאר משפט יחסי ציבור ולא governance אמיתי.
מה כדאי לעקוב אחריו: האם OpenAI תפרסם את מתודולוגיית ה-eval הספציפית ואת הגדרות הסף, מתי (ואם בכלל) Astra יושק, וכיצד מועד אחרון שנקבע על ידי בית המשפט ל-17 באוגוסט בבקשת OpenAI לדחות את תביעת סודות המסחר של Apple משתלב במדיניות החשיפה הרחבה שלה.