ChatGPT и Claude обыграли сертифицированный FDA медицинский AI

Nature Medicine: универсальные модели обошли OpenEvidence и UpToDate на трёх медицинских бенчмарках. Врачи тоже предпочли чат-боты.

Aravana··1 мин

🔴 ChatGPT и Claude обыграли сертифицированный FDA медицинский AI

Компании годами строили специализированные клинические AI-инструменты с регуляторной сертификацией, под надзором FDA, заточенные под врачей. А обычный ChatGPT берёт и обходит их на медицинских тестах. Свежее исследование в Nature Medicine зафиксировало это чёрным по белому.

Исследователи прогнали три передовые модели (GPT-5.2, Gemini 3.1 Pro и Claude Opus 4.6) против двух клинических AI-сервисов, OpenEvidence и UpToDate Expert AI. Три бенчмарка: 500 вопросов MedQA на медицинские знания, 500 заданий HealthBench на согласованность с врачами и 100 реальных клинических запросов от практикующих врачей. Универсальные модели победили во всех трёх. Сами врачи, читавшие ответы, тоже выбрали ChatGPT и его конкурентов чаще, чем «медицинский AI с сертификатом».

Для российского предпринимателя это маркер сдвига: специализированные продукты с дорогой регуляторной обвязкой проигрывают универсальным моделям, которые любой пользователь открывает в браузере бесплатно. FDA пока не определила, считать ли ChatGPT «системой поддержки клинических решений», и пока тянется этот вопрос, рынок медицинского софта уже перекраивается. Если вы строите вертикальный AI-продукт, главный вопрос: что у вас есть, кроме обёртки вокруг той же передовой модели.

Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.

#нейросети #LLM #ChatGPT #Claude #Gemini #OpenAI #Anthropic #Google #healthtech #FDA #биотех #регуляция #ИИ #технологии #AravanaAI

Тип материала: Пост из Telegram

Поделиться:TelegramXLinkedIn
Как вам материал?

Хотите получать подобные материалы раньше?

Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.

Узнать про Intelligence

Не пропускайте важное

Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.

Похожие материалы

У мира появился «климатический доклад», только про ИИ, и он тревожный

Первый доклад независимой научной панели ООН по ИИ — аналог климатической IPCC: 40 учёных предупреждают, что наука не может гарантировать безопасность всё более мощных моделей.

·1 мин

Китай приказал выключить ИИ, который слишком похож на человека

Пекин с 15 июля запрещает ИИ-компаньонов и ролевых ботов с человеческой личностью — ByteDance и Alibaba уже отключают функции.

·1 мин

Bloomberg опубликовал письмо Латника, из-за которого Anthropic выключил Mythos

Bloomberg опубликовал копию письма министра торговли США Говарда Латника главе Anthropic Дарио Амодеи — приказ касается Mythos 5 и Fable 5, мотивировка про военную разведку Китая и России.

·1 мин