Bedrock AgentCore ב-GA: סוף סוף כוח מחשוב מתמשך ל-agents בפרודקשן

AWS הכריזה על זמינות כללית של runtime instances ב-Amazon Bedrock AgentCore: תשתית EC2 מנוהלת ומתמשכת שנבנתה במיוחד עבור AI agents בפרודקשן. היכולות המרכזיות כוללות שיתוף פעולה בין מספר agents, תמיכת GPU ו-sessions הנמשכים עד 14 ימים — צעד משמעותי מעבר ל-inference הזמני של בקשה-תגובה, המכוון ל-agents אוטונומיים ארוכי-טווח שצריכים לשמר state וכוח מחשוב לאורך משימות ממושכות.
ההשקה היא חלק מהרחבה רחבה של AgentCore השבוע. AWS גם הביאה את יכולות ה-memory, policy ו-harness של AgentCore ל-AWS GovCloud (US-West) עבור עומסי עבודה מפוקחים, ומאפשרת לצוותים ממשלתיים וכפופי-רגולציה לבנות agents מודעי-הקשר. AgentCore Memory מספק הקשר מתמשך, בעוד בקרות ה-policy וה-harness מסייעות לצוותים להתרחב מאבטיפוס לפרודקשן.
סגן הנשיא של AWS, Swami Sivasubramanian, הדגיש בקרות חדשות נוספות: temporal policies המופעלות על ידי Dogwood, שפת policy חדשה ו-open-source ל-AI agents, בתוספת rate limiting ב-gateway. הניסוח שלו לכד את הבעיה המתהווה: 'רוב כשלי ה-agent אינם תוצאה של פעולה אסורה יחידה, אלא של רצף פעולות מותרות' — agent שמבצע הזמנות רכש רבות, כל אחת לגיטימית בפני עצמה, שיחד מפוצצות את התקציב. temporal policies סוגרות את הפער הזה בכך שהן מנתחות רצפי פעולות לאורך זמן.
אימוץ בעולם האמיתי כבר נראה לעין: Cohere Health בנתה ארכיטקטורה אגנטית מרובת-דיירים על בידוד ה-MicroVM של AgentCore כדי לדגֵט מדיניות קלינית, ו-TReNDS של Georgia State קיצרה ניתוח שורש-בעיה מ-15-30 דקות לפחות מ-60 שניות באמצעות AgentCore וה-Strands Agents SDK בקוד פתוח. מבחינה תחרותית, AWS מתחרה בפלטפורמת ה-agent של Google Vertex וב-stack של agents של Microsoft Copilot — הבידול כאן הוא התמשכות ברמת פרודקשן וממשל, בהימור שארגונים דואגים בעיקר לשלוט ב-agents בקנה מידה גדול.