OpenAI сообщила, что выявила и пресекла скоординированную кампанию по извлечению защищённого reasoning (protected reasoning) из своих моделей. По оценке компании, активность соответствует adversarial distillation — систематическому несанкционированному использованию выходов или рассуждений одной модели для обучения, воспроизведения или улучшения другой.

Операторы не взламывали шифрование, не компрометировали базу данных и не получали прямой доступ к сохранённым пользовательским диалогам. Вместо этого они манипулировали взаимодействиями с моделью так, чтобы защищённые рассуждения воспроизводились в форме, видимой запрашивающему, в скоординированном и масштабируемом виде — с нарушением условий использования OpenAI.

По данным компании, активность началась 1 июля 2026 года с низкого объёма. 24 и 25 июля зафиксированы пики: около 16 тыс. запросов с релевантным паттерном извлечения от более чем 4 тыс. пользователей. Дальнейшая проверка выявила связанную активность по prompt-паттернам у кластера более чем 15 тыс. пользователей; кампанию полностью пресекли к 28 июля.

OpenAI отмечает, что неясно, исходили ли все наблюдавшиеся операторы от одного актора. Вместе с тем ядро активности компания связывает с лицами, ассоциированными с Moonshot AI, разработчиком Kimi. Мошеннические аккаунты заблокированы, усилены защиты и меры против подобных атак; информация также передавалась партнёрам через Frontier Model Forum.