Новые разделы!
ИИ, квантовые вычисления и много других интересных тем
30.09.2026
OpenAI сообщила о скоординированной кампании по злонамеренной дистилляции — извлечению внутренних рассуждений моделей для воспроизведения их возможностей. Компания связала основную группу участников с разработчиком Kimi, но подчеркнула, что взлома шифрования, баз данных или хранилищ пользовательских диалогов не произошло.
OpenAI сообщила, что обнаружила и пресекла кампанию по массовому извлечению защищённых внутренних рассуждений своих моделей. Активность началась 1 июля 2026 года, а 24 и 25 июля компания зафиксировала всплеск из 16 тыс. запросов с характерной схемой атаки, поступивших более чем от 4 тыс. пользователей. Последующее расследование выявило связанные шаблоны запросов в группе из более чем 15 тыс. учётных записей; к 28 июля их активность была остановлена. Эти показатели относятся к попыткам извлечения данных, а не обязательно к успешным атакам.
Операторы, в частности, копировали зашифрованные рассуждения из одного диалога и просили модель в другом диалоге расшифровать и воспроизвести скрытое содержимое. По данным OpenAI, злоумышленники не взламывали шифрование и базы данных и не получали прямого доступа к сохранённым разговорам пользователей — атака строилась на манипулировании взаимодействиями с моделями.
OpenAI связала основную часть активности с людьми, имеющими отношение к Moonshot AI — разработчику модели Kimi. При этом компания не утверждает, что все обнаруженные операторы представляли одну группу.
В ответ OpenAI заблокировала или ограничила подозрительные учётные записи, усилила контроль регистрации и инфраструктуры, закрыла возможность повторного использования чужих зашифрованных рассуждений и добавила проверку потоковых ответов на возможную утечку скрытых данных. Информация об атаке передана участникам Frontier Model Forum и государственным структурам; расследование и внедрение дополнительных защитных мер продолжаются.
Источник: openai.com