OpenAI משיקה את סדרת GPT-5.6 (Sol, Terra, Luna) וגם GPT-Live קולי, אחרי אישור פדרלי

GPT-5.6 הגיעה כמשפחה מדורגת ולא כמודל דגל יחיד: Sol הוא מודל ה-reasoning המוביל, Terra דרג ביניים בעל יכולת גבוהה, ו-Luna אופציה מהירה וזולה במיוחד. הטענה המרכזית של OpenAI היא יעילות — Luna מנצחת את GPT-5.5 בהגדרת ה-reasoning הגבוהה ביותר שלה תוך שהיא עולה פי 25 פחות, והחברה מיצבה את GPT-5.6 כ'צעד גדול קדימה לאינטליגנציה בתחום הבריאות' עם ביצועים חזקים יותר בעלות נמוכה יותר לכל אורך השורה.
לצד מודלי הטקסט, OpenAI השיקה את GPT-Live-1 ו-GPT-Live-1 mini, מודלי קול שתוכננו להרגיש אנושיים יותר וניתנים להפרעה, וכעת הם ברירת המחדל ל-ChatGPT Voice בכל הדרגים. הנשיא Greg Brockman הגדיר את הקול כ'עידן חדש של ממשק טבעי,' וחזה שמשתמשים יבלו פחות זמן בבהייה במסכים.
benchmarks ראשוניים מצד שלישי מצננים את ההתלהבות. הרצת ParseBench של LlamaIndex ביום ההשקה מצאה 'אין שינוי בין GPT-5.6 Sol ל-GPT-5.5' בהבנת מסמכים — חזק בטבלאות ובטקסט, עדיין חלש בגרפים ובפריסה — וציינה ש-Luna זולה פי 6 בערך מ-Sol עם הידרדרות מינורית בלבד, מה שמרמז שיותר reasoning tokens לא קונים הבנה ויזואלית טובה יותר. אנקדוטות מיגרציה היו ורודות יותר: פוסט אחד ב-HN דיווח על העברת agent בפרודקשן ל-GPT-5.6 שהניבה '2.2 מהיר יותר, 27% זול יותר.'
מסגור אישור-הביטחון הפדרלי בולט לנוכח הרקע הרגולטורי — אותו לחץ ממשלתי שאילץ את Anthropic להשבית את Fable 5. בחינת ה-safety באה מיד: לפי הדיווחים, UK AISI מצא jailbreaks אוניברסליים תוך שעות למרות ה'robust safety stack' של OpenAI, מה שהחיה מחדש את הוויכוח האם ניצחונות ב-benchmark חשובים יותר מעמידות ה-guardrails.