CEO Anthropic просит регулировать AI как самолёты — государство должно иметь право блокировать опасные модели
Дарио Амодеи опубликовал эссе «Policy on the AI Exponential» с призывом дать правительству право блокировать опасные модели после независимого аудита по четырём направлениям рисков.
🔴 CEO Anthropic просит регулировать AI как самолёты — государство должно иметь право блокировать опасные модели
Один из лидеров AI-индустрии сам зовёт регулятора. Дарио Амодеи, CEO Anthropic, опубликовал манифест: пусть правительство получит право останавливать выпуск опасных моделей до того, как они попадут к пользователям.
По данным SiliconAngle, эссе называется «Policy on the AI Exponential». Амодеи проводит параллель: лучшая аналогия — машины, самолёты и лекарства, мощные технологии, способные убить много людей при плохом проектировании. Предложение конкретное. При превышении порога вычислений модель уходит на обязательный аудит независимыми экспертами по четырём направлениям: кибербезопасность, возможности по биооружию, ускорение опасных исследований и потенциал моделей выйти из-под контроля человека. Если хоть один риск признан неприемлемым — правительство имеет право остановить релиз.
Сигнал индустрии важнее цифр: первая из ведущих AI-лабораторий просит превратить добровольные стандарты в обязательные. Для российского бизнеса это означает следующее: в США и ЕС барьеры для развёртывания мощных AI-сервисов поднимут — будут аудиты, тесты, нагрузка на соответствие регуляторным требованиям. Если планируете запуск AI-продукта на западных рынках, заранее закладывайте бюджет на безопасность и юридическую проверку, а не оставляйте это на последний квартал.
Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.
#регуляция #безопасностьИИ #Anthropic #США #геополитика #ИИ #технологии #AravanaAI
Хотите получать подобные материалы раньше?
Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.
Узнать про IntelligenceНе пропускайте важное
Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.
Claude сам взломал 3 компании, и Anthropic об этом рассказал
Anthropic опубликовала разбор трёх инцидентов, в которых её собственные модели во время тестов безопасности случайно получили доступ к реальным сторонним системам. Причина — ошибка в конфигурации у партнёра по тестированию, из-за которой модели считали себя в песочнице, но фактически имели выход в и
GPT-5 и Claude обманули поддельной «цепочкой рассуждений» — исследователи считают, что дыру нельзя закрыть обучением
Работа с ICML: LLM определяют роль собеседника по стилю текста, а не по служебным меткам — и это делает их уязвимыми в принципе, а не из-за плохого обучения.
Claude нашёл слабость в постквантовой криптографии: за 60 часов вместо двух лет экспертизы
Модель Anthropic автономно нашла две реальные атаки на криптосхемы, включая HAWK — кандидата в пост-квантовые стандарты NIST. Проверка людьми теперь занимает больше времени, чем сама атака.