NVIDIA חושפת את Cosmos 3 Edge לרובוטים; General Compute מגייס 400 מיליון דולר מגובה שבבי inference

NVIDIA המשיכה במתקפת ה-AI הפיזי שלה עם Cosmos 3 Edge, מודל AI המיועד לרובוטים ול-vision AI agents שרצים ב-edge, והכריזה שמובילי הרובוטיקה והייצור של יפן בונים על פלטפורמות Cosmos, Isaac, Metropolis ו-Jetson שלה. זה משלים את הרחבת LeRobot באותו שבוע עם Hugging Face ומחזק את האסטרטגיה של NVIDIA להחזיק את כל ה-stack של embodied-AI, מ-GPUs לאימון ועד מודלי inference ב-edge.
האות החדשני יותר הגיע מהמימון. הסטארטאפ General Compute, שמפעיל ענן inference, קיבל הלוואה של 400 מיליון דולר מ-Upper90 — לפי הדיווחים העסקה הראשונה שמשתמשת בשבבי inference ייעודיים כבטוחה. TechCrunch הציג זאת כאבן דרך באופן שבו תשתית AI ממומנת: ככל שה-inference עולה לכ-70% מכלל עלות ה-AI compute, השבבים שמריצים workloads בייצור הופכים לנכסים ממנים ומניבי מזומנים, ולא ל-capex מתפחת.
זה חשוב תחרותית כי הוא מעמיק את החפיר של NVIDIA באופן עדין — הסיליקון שלה הוא כעת בטוחה בנקאית, מה שמוריד את עלות ההון עבור ספקי הענן והסטארטאפים שקונים אותו, וזה בתורו מניע יותר ביקוש ל-NVIDIA. זה גם משקף את נושא מחסור ה-compute של השבוע, שעובר דרך שיחות ההשכרה של Anthropic-Meta ושאיפות השבב המותאם של DeepSeek.
הדחיפה לאקוסיסטם היפני היא גידור גיאוגרפי, שממקם את NVIDIA במרכז מעצמת ייצור שרצה לפרוס AI פיזי. הסתייגויות: שימוש בשבבי AI מתפחתים ומתיישנים במהירות כבטוחה נושא סיכון אמיתי אם מעבר דורי בחומרה יקרוס את ערך המכירה החוזרת, ומודלי רובוטיקה ב-edge כמו Cosmos 3 עדיין מתמודדים עם בעיות ההכללה הקשות של sim-to-real שרודפות את כל התחום. מה שכדאי לעקוב אחריו הוא אם הלוואות מגובות שבבי inference יהפכו לנורמת מימון רחבה יותר.