🔴 Исследователи извлекли рассуждения Claude, GPT и Gemini — и нашли совпадения у Kimi K3

Метод раскрывает скрытые цепочки рассуждений и обнаруживает необычные совпадения между моделями, но не доказывает дистилляцию.

Aravana··1 мин

🔴 Исследователи извлекли рассуждения Claude, GPT и Gemini — и нашли совпадения у Kimi K3

Скрытые рассуждения передовых моделей удалось вытащить наружу. Исследователи передавали их зашифрованный след младшей версии той же модели: ключ у неё тот же, но отказывать в раскрытии внутренней логики она обучена хуже. Метод сработал с системами OpenAI, Anthropic и Google.

В эксперименте по сравнению рассуждений моделей использовали 90 вопросов. Открытым моделям давали первые слова скрытой цепочки и смотрели на продолжение. Kimi K3 в отдельных случаях отвечала поразительно похоже на Claude Opus 4.8 и GPT 5.6 Sol. Но это не доказывает дистилляцию; DeepSeek и Inkling такого сходства с Claude Opus не показали.

Метод оказался опасен не только для интеллектуальной собственности. Из перехваченных цепочек удавалось извлекать пароли и API-ключи. OpenAI, Anthropic и Google изменили API: личные данные так больше не достать, хотя отдельные рассуждения всё ещё раскрываются.

У подозрений в копировании появился проверяемый след, но не готовый приговор. Граница метода конкретна: он показывает сходство рассуждений, а не историю обучения. Следующая проверка — смогут ли разработчики закрыть оставшуюся утечку без полной перестройки API.

Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.

#ИИ #МоделиИИ #Кибербезопасность #Дистилляция #AravanaAI

Тип материала: Пост из Telegram

Поделиться:TelegramXLinkedIn
Как вам материал?

Хотите получать подобные материалы раньше?

Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.

Узнать про Intelligence

Не пропускайте важное

Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.