Briefing
חזרה
AWSJuly 30, 20261 מקורות

מודלי GPT-5.6 של OpenAI נוחתים על Amazon Bedrock עם prompt caching מפורש

ניתוח AI

הזמינות ב-Bedrock הופכת את GPT-5.6 Sol, Terra ו-Luna לאזרחים מהשורה הראשונה בפלטפורמת ה-inference המנוהלת של AWS, והפיצ'ר המרכזי הוא prompt caching מפורש — מנגנון, מתועד במשותף על ידי AWS ו-OpenAI, שמאפשר למפתחים לציין בדיוק אילו חלקים ב-prompt נשמרים ב-cache וממוחזרים בין קריאות. עבור workloads עם system prompts גדולים ויציבים או context משותף, זה מפחית מהותית את העלות per-request כשמהגרים workloads קיימים של GPT ל-Bedrock.

ההשקה חפפה לקיצוצי המחיר של OpenAI ב-80%/20% ל-Luna ו-Terra, ש-Bedrock שיקפה באותו יום, ומגדילה את החיסכון בעלות ללקוחות AWS. AWS גם הדגישה נקודת הוכחה מלקוח: AUMOVIO השתמשה ב-AI מרובה-agents על Bedrock כדי לתפוס פגמים ב-embedded-code של רכב בקנה מידה, המדגימה את השימושים ה-agentic שהמודלים הזולים והניתנים ל-cache מכוונים אליהם.

מבחינה תחרותית, זה מעמיק את אסטרטגיית ריבוי המודלים של Bedrock — OpenAI, Anthropic (Claude Opus 5), DeepSeek, Meta ואחרים תחת קורת גג אחת — שעליה AWS נשענה בכבדות ברבעון של צמיחה של 37%. הצעת מודלי OpenAI על Bedrock גם מטשטשת את נרטיב הבלעדיות הישן של Azure-OpenAI. מה לעקוב: איך caching מפורש משתווה ל-prompt caching של Anthropic עצמה על Bedrock בחיסכון עלות אמיתי, והאם ארגונים יאחדו stacks של agents מרובי-ספקים על Bedrock כדי לנצל caching וניתוב מאוחדים.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog