🔴 Faraday перепроверяет науку — но пока по ответам из опубликованных статей

Inherent заявляет, что компактный агент превзошёл крупные модели при воспроизведении исследований, но подробного протокола сравнения пока нет.

Aravana··1 мин

🔴 Faraday перепроверяет науку — но пока по ответам из опубликованных статей

Агенту дали задачу, с которой часто начинают аспиранты: самостоятельно воспроизвести выводы опубликованных работ, не сообщая ответ заранее. Inherent заявила, что её Faraday справился лучше Claude Opus 4.8 и GPT-5.5. TechCrunch описывает результаты Faraday именно как заявление компании.

Inherent ждала от агента не только верного результата, но и «исследовательского чутья»: способности выбирать и проектировать полезные эксперименты. Этому его обучали через вознаграждение за результат. При этом Faraday работает на сравнительно компактной Qwen 3.6 с 27 млрд параметров, а код пишет с помощью GPT-5.5 Codex — инструмента OpenAI.

Оценить масштаб преимущества пока нельзя: в публикации нет числа воспроизведённых работ, баллов систем и подробного протокола. Поэтому показан узкий навык — проверка уже известных выводов, а не самостоятельное открытие нового знания.

Сооснователь Inherent Эдвард Хьюз сравнивает такую работу со стартовым упражнением аспиранта. Это точно задаёт нынешнюю роль Faraday: не учёный, который приносит неизвестный результат, а напарник, способный перепроверить чужой — пока на условиях, заданных его создателями.

Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.

#ИИ #Наука #AIагенты #Исследования #AravanaAI

Тип материала: Пост из Telegram

Поделиться:TelegramXLinkedIn
Как вам материал?

Хотите получать подобные материалы раньше?

Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.

Узнать про Intelligence

Не пропускайте важное

Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.