🔴 Faraday перепроверяет науку — но пока по ответам из опубликованных статей
Inherent заявляет, что компактный агент превзошёл крупные модели при воспроизведении исследований, но подробного протокола сравнения пока нет.
🔴 Faraday перепроверяет науку — но пока по ответам из опубликованных статей
Агенту дали задачу, с которой часто начинают аспиранты: самостоятельно воспроизвести выводы опубликованных работ, не сообщая ответ заранее. Inherent заявила, что её Faraday справился лучше Claude Opus 4.8 и GPT-5.5. TechCrunch описывает результаты Faraday именно как заявление компании.
Inherent ждала от агента не только верного результата, но и «исследовательского чутья»: способности выбирать и проектировать полезные эксперименты. Этому его обучали через вознаграждение за результат. При этом Faraday работает на сравнительно компактной Qwen 3.6 с 27 млрд параметров, а код пишет с помощью GPT-5.5 Codex — инструмента OpenAI.
Оценить масштаб преимущества пока нельзя: в публикации нет числа воспроизведённых работ, баллов систем и подробного протокола. Поэтому показан узкий навык — проверка уже известных выводов, а не самостоятельное открытие нового знания.
Сооснователь Inherent Эдвард Хьюз сравнивает такую работу со стартовым упражнением аспиранта. Это точно задаёт нынешнюю роль Faraday: не учёный, который приносит неизвестный результат, а напарник, способный перепроверить чужой — пока на условиях, заданных его создателями.
Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.
#ИИ #Наука #AIагенты #Исследования #AravanaAI
Хотите получать подобные материалы раньше?
Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.
Узнать про IntelligenceНе пропускайте важное
Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.
Исследование Стэнфорда: дружба с ИИ связана с одиночеством, но причина неясна
Исследование пользователей Character.AI выявило связь между поиском компании у чат-ботов, небольшим кругом общения и более низким психологическим благополучием, но не установило причинность.
Anthropic открыла ENISA доступ к Mythos 5 — но не к новейшей версии
ENISA после нескольких месяцев переговоров начала тестировать Mythos 5, но не получила актуальную версию модели.
🔴 Harvey привлекла $550 млн: юридический AI уже покупают 3 000 организаций
Harvey привлекла $550 млн после роста до более чем 3 000 клиентов, но масштабирование юридического AI упирается в конфликт между производительностью и почасовой оплатой.