AWS מרחיבה קיבולת NVIDIA Blackwell ב-EC2 עם P6-B200 ו-P6-B300 באזורים חדשים באסיה-פסיפיק

AWS הרחיבה את נוכחות ה-NVIDIA Blackwell שלה על פני שני אזורי Asia-Pacific חדשים בו-זמנית. מופעי ה-P6-B200 שמגיעים ל-Hyderabad אורזים 8 Blackwell GPUs עם 1,440 GB זיכרון GPU מצטבר ורוחב-פס זיכרון גבוה ב-60%, ומספקים עד פי 2 ביצועי training ו-inference של AI לעומת דור ה-P5en הקודם. מופעי ה-P6-B300 מסוג Blackwell Ultra ב-Jakarta מרחיקים לכת עם 8 GPUs, 2.1 TB זיכרון GPU ו-6.4 Tbps רשת EFA — פי 2 רוחב-פס רשת ופי 1.5 זיכרון GPU לעומת הדור הקודם.
הזווית האזורית היא הסיפור: הבאת קיבולת training ו-inference מובילה ל-Hyderabad ו-Jakarta מפחיתה latency ומטפלת בצורכי data-residency של שוקי ה-AI הצומחים במהירות בהודו ובדרום-מזרח אסיה, במקום לאלץ לקוחות לנתב לאזורי ארה"ב או אירופה. תקרות הזיכרון הגבוהות יותר (2.1 TB ב-B300) חשובות ספציפית להגשת מודלים גדולים מאוד ו-inference בהקשר-ארוך בלי לפצל (sharding) בין nodes.
תחרותית, זו AWS שממהרת לפרוס קיבולת Blackwell כשהביקוש לכוח מחשוב ל-training נשאר חד, ו-NVIDIA ממנת אגרסיבית בנייה על פני התעשייה. זה גם מחזק את הקשר בין AWS ל-NVIDIA גם כש-AWS דוחפת את סיליקון ה-Trainium שלה עצמה. עבור לקוחות, זמינות Blackwell אזורית רבה יותר משמעה יותר בחירה על היכן להריץ workloads תחת משטרי compliance מקומיים, ושדרוגי הזיכרון/הרשת מאפשרים ישירות deployments גדולים יותר של agentic ו-מולטימודלי. הפריט המעשי לעקוב אחריו הוא זמינות קיבולת — מופעי GPU באזורים חדשים משיקים לעיתים קרובות במגבלה, והאם ההיצע יעמוד בביקוש המזנק של האזור יקבע את ההשפעה בעולם האמיתי.