NVIDIA מוסיפה שכבת quantum ו-2 מיליון GPU מ-AWS; הואנג צופה צמיחה של 70%

CUDA-Q Logical מוסיף שכבת orchestration אגנוסטית לחומרה לעומסי עבודה קוונטיים עמידים בתקלות, ומרחיב את ה-stack הקוונטי-קלאסי ההיברידי של NVIDIA; חוקרים קוונטיים בירכו על שיפור מהירות נטען של פי 7. עסקת AWS מתחייבת ל-2 מיליון GPUs נוספים כדי לתמוך בעומסי AI agentic ופיזי, ומעמיקה שותפות שגם עומדת בבסיס מהלך תשתית ה-AI הרחב יותר של AWS. תחזית הצמיחה של 70% מפי Huang מגיעה לאחר רבעון של 96.2 מיליארד דולר בהכנסות, עלייה של 106% משנה לשנה.
חישוב קהילתי של מהנדס אחד הפך ויראלי: '70% על בסיס של ~200 מיליארד דולר = ~140 מיליארד דולר הכנסה חדשה — הגורם המגביל הוא קיבולת CoWoS של TSMC ו-HBM, לא הביקוש'. הדבר לוכד את התפיסה הרווחת שהתקרה של NVIDIA היא ההיצע ולא ההזמנות, כאשר האריזה המתקדמת והזיכרון בעל רוחב הפס הגבוה הם צווארי הבקבוק האמיתיים. עמדתו של Huang בנוגע לממשל גם עוררה דיון — thread ב-r/Anthropic סימן את הערתו 'אנחנו לא צריכים רגולציה על AI, השאירו את הבטיחות לנו' (85 upvotes).
לצד חדשות הפלטפורמה, NVIDIA דוחפת את microservices בשם NIM עמוק יותר לארגונים: Salesforce הרחיבה את Missionforce עם NIM, Cloudera הטמיעה NIM ל-inference on-prem, ו-NDI אימצה LipSync NIM לדיבוב בזמן אמת. הקו המנחה הוא ש-NVIDIA נועלת את ה-stack המלא — סיליקון, orchestration קוונטי, ותוכנת inference — בזמן שמתחרים כמו AMD וסיליקון מותאם אישית (MTIA של Meta, שרתי M8 Ultra של Apple, AWS Trainium) מכרסמים בשוליים. שווה לעקוב אם ההתחייבות של 2 מיליון GPUs מ-AWS מסמנת ש-hyperscalers מכפילים את ההימור על NVIDIA גם כשהם בונים חלופות פנימיות.