חזרה
NVIDIASeptember 16, 20261 מקורות

NVIDIA Vera Rubin NVL72 מובילה את מבחני MLPerf Inference v6.1

ניתוח AI

NVIDIA תפסה את המקום הראשון ב-MLPerf Inference v6.1 עם Vera Rubin NVL72 שלה, ומיסגרה את התוצאות סביב יעילות tokens-per-watt — המדד שהכי חשוב ל'מפעלי AI', שבהם המחסום המחייב הוא חשמל, לא סיליקון. מהנדסי תשתית הגיבו לשיפורי throughput מדווחים של פי 2.5 עד 3.7 לעומת דור ה-GB300 הקודם, קפיצת דור משמעותית אם היא מחזיקה בחומרה שתישלח בפועל.

לצד ה-benchmark, NVIDIA הכריזה על ברית עם Google ו-Emerald AI סביב מרכזי נתונים חסכוניים באנרגיה, הרחיבה את פלטפורמת CUDA-Q שלה עם CUDA-Q Logical לתזמור quantum עמיד-תקלות, והבליטה את ה-Portable Computer של Perplexity על Windows המונע על ידי RTX. חוט השני הוא ש-NVIDIA מרחיבה את החפיר שלה משבבים גולמיים ל-stack מלא שמשתרע על יעילות אנרגטית, תזמור quantum ו-inference מקומי.

ההסתייגות החשובה ביותר מגיעה מהקהילה עצמה: מהנדסים סימנו ש-Vera Rubin NVL72 נמצא בסטטוס 'preview', כלומר קונים לא באמת יכולים להזמין אותו עדיין. הפער הזה בין הובלה ב-benchmark לזמינות הוא דפוס חוזר אצל NVIDIA — להכריז על שליטה מוקדם כדי להקפיא את החלטות הרכש של המתחרים בזמן שהמוצר מטפס. תחרותית, התזמון נוקב. Samsung זה עתה הובילה במשותף סבב Series A של 231 מיליון דולר לסטארטאפ שבבי ה-inference Euclyd, מתחרה של NVIDIA, ו-Meta פורסת את שבבי ה-MTIA 450 הביתיים שלה — שני סימנים לכך שהיפרסקיילרים ומשקיעים מממנים באופן פעיל חלופות כדי להפחית את התלות ב-NVIDIA. יתרון היעילות של Vera Rubin הוא התשובה של NVIDIA: להפוך את חומרת השחקן המבוסס לחסכונית כל כך שסיליקון מותאם לא יוכל להצדיק את עלות המעבר. הקריאה הספקנית היא שתוצאות MLPerf על חומרת preview, מכווננות על ידי הספק, תמיד מחמיאות; ה-tokens-per-watt בעולם האמיתי במרכזי נתונים של לקוחות הוא המספר שחשוב. שווה לעקוב אחר זמינות כללית ומדידות יעילות עצמאיות.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog