🔴 Исследователи извлекли рассуждения Claude, GPT и Gemini — и нашли совпадения у Kimi K3
Метод раскрывает скрытые цепочки рассуждений и обнаруживает необычные совпадения между моделями, но не доказывает дистилляцию.
🔴 Исследователи извлекли рассуждения Claude, GPT и Gemini — и нашли совпадения у Kimi K3
Скрытые рассуждения передовых моделей удалось вытащить наружу. Исследователи передавали их зашифрованный след младшей версии той же модели: ключ у неё тот же, но отказывать в раскрытии внутренней логики она обучена хуже. Метод сработал с системами OpenAI, Anthropic и Google.
В эксперименте по сравнению рассуждений моделей использовали 90 вопросов. Открытым моделям давали первые слова скрытой цепочки и смотрели на продолжение. Kimi K3 в отдельных случаях отвечала поразительно похоже на Claude Opus 4.8 и GPT 5.6 Sol. Но это не доказывает дистилляцию; DeepSeek и Inkling такого сходства с Claude Opus не показали.
Метод оказался опасен не только для интеллектуальной собственности. Из перехваченных цепочек удавалось извлекать пароли и API-ключи. OpenAI, Anthropic и Google изменили API: личные данные так больше не достать, хотя отдельные рассуждения всё ещё раскрываются.
У подозрений в копировании появился проверяемый след, но не готовый приговор. Граница метода конкретна: он показывает сходство рассуждений, а не историю обучения. Следующая проверка — смогут ли разработчики закрыть оставшуюся утечку без полной перестройки API.
Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.
#ИИ #МоделиИИ #Кибербезопасность #Дистилляция #AravanaAI
Хотите получать подобные материалы раньше?
Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.
Узнать про IntelligenceНе пропускайте важное
Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.