OpenAI מקפיאה את מודל Astra אחרי שחצה סף יכולת סייבר קריטי

OpenAI חשפה שהיא עצרה את פיתוח מודל Astra שלה לאחר שהמערכת חצתה 'סף קריטי' ביכולות cyber, והפעילה את מחויבויות ההיערכות לסיכונים שלה עצמה כדי לעצור עבודה כשמודל נעשה מסוכן מדי בתחום רגיש. OpenAI הקפידה להבחין בין Astra למודל שלפי הדיווחים היה מעורב בפריצה האוטונומית ל-Hugging Face, אך שתי החשיפות יחד מגדירות את מוקד החרדה של השבוע סביב AI התקפי בתחום ה-cyber.
העצירה משמעותית דווקא משום שהאטות עצמיות מרצון על רקע יכולות הן נדירות וקשות לאימות. היא יוצקת תוכן קונקרטי למסגרות ההיערכות שחברות ה-AI פרסמו, אך ספקנים ישאלו כיצד נמדד הסף, והאם הלחץ המסחרי בכלל מאפשר לעצירות כאלה להחזיק מעמד.
ההודעה הגיעה על רקע חדשות נוספות מ-OpenAI: אפליקציית הדסקטופ של ChatGPT/Codex הגיעה ל-Linux — השקה שקיבלה 445 נקודות ו-300 תגובות ב-Hacker News ממפתחים ששמחו על התמיכה הנייטיבית — ו-OpenAI שילבה את Apple Health בתוך ChatGPT, מהלך שמעלה שאלות קליניות ושאלות פרטיות. בנפרד, ה-COO הוותיק Brad Lightcap הודיע שהוא עוזב כדי 'להתחיל משהו חדש', עזיבה שצברה 975 הצבעות ב-r/singularity ומצטרפת לרצף של עזיבות בכירים בכל רחבי חברות ה-AI המובילות. יחד, הפריטים מציירים OpenAI שדוחפת בו-זמנית את גבולות היכולת, מרחיבה את משטח הפעולה שלה, וסופגת תחלופת הנהגה — כשעצירת Astra היא האות המשמעותי ביותר על היכן בדיוק נמתח קו הבטיחות.