Google DeepMind משיקה Gemini 3.6 Flash, 3.5 Flash-Lite ו-3.5 Flash Cyber — ועדיין בלי 3.5 Pro

לפי הבלוג של DeepMind מבית Google ו-TechCrunch, Gemini 3.6 Flash הוא סוס העבודה של השחרור, שחותך את השימוש ב-token עד 17% תוך שיפור ה-benchmarks בקידוד ובמולטימודאליות; התמחור דווח סביב 1.50$ למיליון token קלט / 7.50$ למיליון token פלט, כש-3.5 Flash-Lite זול בהרבה בכ-0.30$ / 2.50$. המודל 3.5 Flash Cyber מכוון לחוקרי cybersecurity ולצוותי red team דרך pilot בגישה מוגבלת שקשור ל-CodeMender.
Jeff Dean הגביר את זווית היעילות ב-X עם הדגמת token זו לצד זו, והשחרור משך דיון כבד ב-Hacker News. אבל ההיעדרות הבולטת — Gemini 3.5 Pro, שה-GA שלו נדחה שוב ושוב — הפכה לסיפור עצמו עבור הספקנים שרואים דפוס של שילוח רענוני שכבת Flash בזמן שהדגל נותר מעוכב.
הקשר: TechCrunch דיווחה גם ש-Google מפתחת שבב AI פנימי ממוקד יעילות בכינוי 'Frozen v2', המיועד ל-2028 ונטען שהוא יעיל פי 6-10 באנרגיה לכל token, מה שמדגיש את הדחיפה הכפולה של Google על יכולת המודל ועל שכבת המחשוב/האנרגיה שמתחתיה. Logan Kilpatrick חשף בנפרד ש-Google החלה את 'ריצת ה-pre-training השאפתנית ביותר שלה עד כה, עבור Gemini 4'.
גרסת ה-cyber נוחתת בשבוע טעון: כשה-guardrails של המודלים המובילים חסמו את המגנים במהלך אירוע Hugging Face, מודל של Google שנבנה במפורש לעבודת אבטחה — אך חסום מאחורי pilot — מזמין את השאלה המתבקשת מי מקבל גישה ותחת איזו מדיניות סירוב.