אחרי חודשים של עיכובים: Gemini 4 Argon יוצא — אבל רק לשותפי סייבר

Google השיקה סוף סוף את מודל הדגל שהתעכב. Gemini 4 Argon פותח את דור Gemini 4 ומכוון לשלושה תחומים: פיתוח תוכנה, cybersecurity ותפעול פיננסי. לפי הדיווחים, Argon מסוגל לייצר עד מיליון token בפלט, מה שמאפשר שרשראות חשיבה ארוכות מאוד ושכתוב קוד בהיקפים גדולים. בנוסף הוא מזהה ומתקן חולשות אבטחה באופן אוטומטי. כדי לרכז משאבים במודל הזה, Google ביטלה את Gemini 3.5 Pro.
ההפצה צרה בכוונה. רק שותפי cybersecurity מאומתים מקבלים גישה, דרך תוכנית Fairwind של Google, במסגרת הליך הבדיקה האמריקאי הוולונטרי למודלים מובילים לפני שחרור. ה-New York Times תיאר אותו כמודל דגל ששוחרר "עם מגבלות". Reuters מיקמה את Argon כמתחרה ישיר ל-Astra של OpenAI ול-Opus של Anthropic ב-benchmark של קוד ואבטחה. VentureBeat כתב ש-Google חזרה להוביל ב-benchmark, אבל רק בהפצה מוגבלת. Artificial Analysis פרסמה ניתוח עצמאי של האינטליגנציה, המהירות והמחיר של Argon.
התזמון הופך את Argon לחלק משבוע עמוס: Anthropic השיקה ביום שני את Sonnet 5.5, ו-OpenAI גנזה את GPT-6.1 Astra בגלל חששות בטיחות והשיקה ב-DevDay את GPT-6.1 Sol הזול יותר. ייתכן ש-Argon מוביל כרגע, אבל ההשהיה של Astra וההפצה המבוקרת של Google מצביעות על אותה מגמה: חברות ה-AI מצמידות שערי בטיחות רשמיים למודלים החזקים ביותר שלהן בתחום הסייבר, לפני הפצה רחבה.
לספקנים יש טיעונים ברורים. דיווחים מהקהילה טוענים ש-Argon מאכזב במשימות קוד אמיתיות למרות ציון של 77.9% ב-DeepSWE, ומפתחים שלא יכולים לבדוק את המודל בעצמם מאשימים את Google ב"תיאטרון בטיחות". שלושה דברים שכדאי לעקוב אחריהם:
- **לוח זמנים לזמינות כללית:** מתי מפתחים מחוץ לתוכנית האבטחה יקבלו גישה.
- **תמחור:** האם הטענה ל"מחיר הנמוך בתעשייה" תחזיק כש-Argon יגיע ל-API הציבורי.
- **הערכות עצמאיות:** האם בדיקות חיצוניות יאששו את הטענות של Google לשוויון ב-benchmark.