Briefing
חזרה
NVIDIAAugust 21, 20261 מקורות

ה-AVO של NVIDIA נוגעת ב-100% ב-benchmark של ARC-AGI-3

ניתוח AI

NVIDIA פרסמה תוצאות שלפיהן ארכיטקטורת AVO שלה השיגה ציון מושלם של 100% ב-ARC-AGI-3, והציגה אותה כארכיטקטורה כללית ברמת המובילים ל-agents אוטונומיים לטווח ארוך. הטיעון המרכזי בפוסט בבלוג המפתחים הוא מתודולוגי: NVIDIA מדגישה שה-agent harness — הפיגומים של כלים, זיכרון, תכנון ותזמור סביב מודל שפה — הם שקובעים את הביצועים, ולא המודל הגולמי לבדו.

מסגור זה הוא התערבות מכוונת בוויכוח המתמשך על היכן היכולת של ה-AI באמת נמצאת. ככל שהמודלים המובילים הבסיסיים מתכנסים והופכים לסחורה, NVIDIA טוענת שהבידול — והחפיר — עולה במעלה ה-stack אל הארכיטקטורה והתזמור, מסר שמתיישב בנוחות עם אסטרטגיית הפלטפורמה שלה של חומרה-פלוס-תוכנה.

הטענה על 100% מחייבת בדיקה מדוקדקת. ARC-AGI-3 הוא benchmark חדש וקשה יותר במשפחת ARC שתוכנן לעמוד בפני שינון, וציון מושלם מזמין שאלות לגבי זיהום של ה-test set, בחירת המשימות, ואיך ה-harness כוונן. באותו שבוע Gemini 3.7 Flash של Google רשם ציונים חזקים אך לא מושלמים ב-ARC-AGI-2 (84.6%) וב-ARC-AGI-1 (95.5%) ש-ARC Prize אימת באופן עצמאי — מה שמציב רף של אימות חיצוני שהפוסט של NVIDIA עדיין לא עומד בו.

התוצאה מצטרפת לשחרורים נוספים ממוקדי-agents של NVIDIA השבוע, כולל Nemotron 3.5 Lightning ל-agents שפועלים תמיד והנחיות היכן האבטחה משתלבת ב-stack של agent. שווה לעקוב אחר אימות עצמאי מ-ARC Prize ואם NVIDIA תפרסם את פרטי ה-harness הנדרשים לשחזור הטענה.

מקורות
AI Briefing
·ספקים·Curated by AI agents · Updated daily · 2026
Built by Koby Almog