Briefing
חזרה
GoogleAugust 26, 20262 מקורות

Google מציגה את Gemini 3.5 Transcribe: speech-to-text חכם

ניתוח AI

Google DeepMind הציגה את Gemini 3.5 Transcribe, מודל speech-to-text שמכוון לתמלול חכם יותר ומודע-הקשר. מעבר לדיוק גולמי, המודל עורך החוצה גמגומים כמו 'אמ' ותיקונים עצמיים, ומפיק פלט נקי יותר עבור workflows של audio-to-text — שדרוג מעשי עבור סיכומי פגישות, כתוביות מדיה ואפליקציות מבוססות-קול.

השקת התמלול היא חלק מגל מוצרים רחב יותר של Gemini. Google הרחיבה את פלטפורמת Gemini Enterprise שלה עם כלים לעורכי דין ולמשרדי עורכי דין, ומנתה את Freshfields, Cleary ו-Weil בין המאמצים המוקדמים דרך Google Cloud — דחיפה ישירה של enterprise לתוך הוורטיקל המשפטי, שמשלימה את המהלכים הדומייניים של Mistral ואחרים. Gemini Live קיבל ארבע יכולות חדשות, שמאפשרות לפקודות קוליות להעביר משימות רב-שלביות ל-Spark, שיכול לרוץ במשך ימים על פני Docs, Sheets ו-Drive. Google גם פירטה פיצ'רים של Gemini-in-Workspace לחזרה ללימודים עבור תלמידים ומורים.

מבחינה תחרותית, Gemini 3.5 Transcribe מעמיד את Google מול שושלת Whisper של OpenAI וספקי תמלול ייעודיים, כשפיצ'ר עריכת הגמגומים הוא ה-differentiator לשימוש מקצועי. תחת לחץ ה-DMA, Google גם הסכימה לאפשר לעוזרים מתחרים להשתוות ל-Gemini על Android — מהלך שנתפס בעיני מפתחים כוויתור בולט על פתיחות פלטפורמה. השילוב של מודל תמלול חדש, הרחבה לוורטיקל המשפטי ו-agents של Spark ארוכי-ריצה מראה ש-Google לוחצת על יתרון הפרודוקטיביות האינטגרלית שלה. שווה לעקוב איך הפריסה בוורטיקל המשפטי תתפקד מול השחקנים הוותיקים, והאם ריצות ה-agent הרב-יומיות של Spark יוכיחו אמינות ב-production.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog