🔴 Faraday перепроверяет науку — но пока по ответам из опубликованных статей
Inherent заявляет, что компактный агент превзошёл крупные модели при воспроизведении исследований, но подробного протокола сравнения пока нет.
🔴 Faraday перепроверяет науку — но пока по ответам из опубликованных статей
Агенту дали задачу, с которой часто начинают аспиранты: самостоятельно воспроизвести выводы опубликованных работ, не сообщая ответ заранее. Inherent заявила, что её Faraday справился лучше Claude Opus 4.8 и GPT-5.5. TechCrunch описывает результаты Faraday именно как заявление компании.
Inherent ждала от агента не только верного результата, но и «исследовательского чутья»: способности выбирать и проектировать полезные эксперименты. Этому его обучали через вознаграждение за результат. При этом Faraday работает на сравнительно компактной Qwen 3.6 с 27 млрд параметров, а код пишет с помощью GPT-5.5 Codex — инструмента OpenAI.
Оценить масштаб преимущества пока нельзя: в публикации нет числа воспроизведённых работ, баллов систем и подробного протокола. Поэтому показан узкий навык — проверка уже известных выводов, а не самостоятельное открытие нового знания.
Сооснователь Inherent Эдвард Хьюз сравнивает такую работу со стартовым упражнением аспиранта. Это точно задаёт нынешнюю роль Faraday: не учёный, который приносит неизвестный результат, а напарник, способный перепроверить чужой — пока на условиях, заданных его создателями.
Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.
#ИИ #Наука #AIагенты #Исследования #AravanaAI
Хотите получать подобные материалы раньше?
Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.
Узнать про IntelligenceНе пропускайте важное
Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.