2.3 שניות בלבד: Qwen3.8-LiveTranslate חותכת את השהיית התרגום בזמן אמת ל-60 שפות

Qwen3.8-LiveTranslate מכוון לבעיה הקשה ביותר בתרגום מכונה — לעשות אותו בזמן אמת. על ידי קיצוץ ההשהיה הממוצעת מקצה לקצה ל-2.3 שניות על פני 60 שפות, המודל מכוון לתרחיש התרגום הסימולטני (פגישות, שידורים, שיחות חוצות-גבולות) שבו ה-latency, ולא רק הדיוק, קובע אם הכלי שמיש בכלל.
המספר 2.3 שניות הוא המדד המרכזי: מתורגמנים סימולטניים אנושיים עובדים עם השהיה של כמה שניות, כך שמודל בטווח הזה כבר מתחיל להרגיש שיחתי ולא מגומגם. השגת זה על פני 60 שפות רומזת על ארכיטקטורת streaming שמתחילה לתרגם עוד לפני שהמשפט הסתיים, ומאזנת את הטרייד-אוף בין דיוק ל-latency שמפיל גישות נאיביות שחותכות למקטעים.
LiveTranslate הוא הרגל השלישית במטח השחרורים של Alibaba השבוע, לצד Omni-Flash עם זיהוי דיבור ב-74 שפות ויצירה ב-29 שפות, ו-Qwen-Image-2.1 הפתוח. יחד הם מראים ש-Qwen תוקפת יכולת רב-לשונית ורב-מודלית באגרסיביות, ולוחצת על Google Translate, הקול בזמן אמת של OpenAI, וספקי תרגום סימולטני ייעודיים גם ברוחב וגם במהירות.
המבט הספקני אומר ש-latency ודיוק נמצאים במתח מובנה — השהיה של 2.3 שניות מרשימה רק אם איכות התרגום מחזיקה, ומספרים שספקים מדווחים בעצמם ממעטים ללכוד דיבור אמיתי, רועש, עם מבטא ותלוי-תחום. נדרשת הערכה עצמאית על פני צמדי שפות ותנאי אודיו. שווה לעקוב אחרי תמחור ה-API (בהתחשב בקיצוצים האגרסיביים של Omni-Flash) ואחרי benchmarks של צד שלישי על נאמנות התרגום, לא רק על מהירות.