🔴 Nvidia дала AI-агенту «начальника» — и результат вырос с 30% до 100%
На ARC-AGI-3 та же модель поднялась с 30% до 100% после настройки памяти и добавления отдельного агента-руководителя.
🔴 Nvidia дала AI-агенту «начальника» — и результат вырос с 30% до 100%
Результат Claude Opus 5 изменили не заменой модели, а системой вокруг неё. В эксперименте Nvidia с управляющей обвязкой результат на ARC-AGI-3 поднялся с 30% до 100% — уровня, на котором игры проходят люди.
ARC-AGI-3 — набор двумерных игр без инструкций: агент должен сам открыть правила и победить. Без новой обвязки 30% были лучшим результатом среди всех проверенных моделей. Система Nvidia AVO работала с памятью и получила отдельного агента-руководителя: он направлял исполнителя, когда тот заходил в тупик или снова исследовал уже пройденный путь.
Для длинных задач это практический сдвиг. Агент — не только модель: инструменты, память, контекст и обратная связь определяют, сможет ли он связать множество решений в законченную работу. В этом тесте устройство системы оказалось важнее простого выбора модели: без новой обвязки ни одна из проверенных моделей не превысила 30%.
Но AVO не новый продукт Nvidia, а 100% получены на одном игровом бенчмарке. Теперь проверяемая граница результата — сохранится ли преимущество за пределами игр, в реальной работе на часы и дни. Именно там агенту приходится не только найти удачный ход, но и не потерять цель после десятков предыдущих решений.
Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.
#ИИ #AIAgents #Nvidia #Claude #ARCAGI #AravanaAI
Хотите получать подобные материалы раньше?
Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.
Узнать про IntelligenceНе пропускайте важное
Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.