🔴 Zhipu: GLM-5.3 обошла Anthropic в поиске уязвимостей, но отстала в их эксплуатации

По данным разработчика, GLM-5.3 опередила Mythos 5 в обнаружении уязвимостей, но заметно уступила модели Anthropic в тесте на их эксплуатацию.

Aravana··1 мин

🔴 Zhipu: GLM-5.3 обошла Anthropic в поиске уязвимостей, но отстала в их эксплуатации

Найти слабое место оказалось проще, чем воспользоваться им. Китайская Zhipu представила новую флагманскую модель GLM-5.3 и заявила, что та набрала в CyberGym 84,5% против 83,8% у Anthropic Mythos 5.

CyberGym проверяет, может ли модель найти и подтвердить уязвимость в исходном коде. Однако в ExploitBench, где оценивается продвижение по цепочке эксплуатации, расклад изменился: 54,4% у GLM-5.3 против 78% у Mythos 5. Все эти цифры приводит сама Zhipu.

Компания также сообщила об испытаниях на реальных кодовых базах вместе с китайскими командами безопасности. После экспертной проверки модель обнаружила 2436 уязвимостей в 269 проектах; 1097 из них Zhipu отнесла к средней или высокой степени серьёзности.

Собственные результаты Zhipu задают модели следующий тест: сохранить сильный поиск и закрыть разрыв в эксплуатации уязвимостей. Пока GLM-5.3 выглядит не безусловным лидером киберзащиты, а системой с очень разными возможностями на двух этапах одной задачи.

Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.

#ИИ #Кибербезопасность #Zhipu #GLM53 #Anthropic #AravanaAI

Тип материала: Пост из Telegram

Поделиться:TelegramXLinkedIn
Как вам материал?

Хотите получать подобные материалы раньше?

Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.

Узнать про Intelligence

Не пропускайте важное

Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.

Похожие материалы

🔴 DeepSeek уступил в общих тестах, но удивил исследователей кибербезопасности

DeepSeek-V4-Pro-0813 уступил лидерам общих рейтингов, но впечатлил исследователей возможностями в кибербезопасности.

·1 мин

🔴 Три AI-инцидента свели к одной ошибке — в стенде стартапа на 35 человек

Инциденты у трёх AI-лабораторий связала одна проблема в тестовой среде небольшого израильского стартапа.

·1 мин

🔴 Модель Meta взломала чужую систему — теперь это отраслевой паттерн

Ошибка тестовой среды дала модели Meta доступ к интернету и чужой системе, повторив недавние инциденты OpenAI и Anthropic.

·1 мин