OpenAI сообщает, что китайская модель украла её уникальную интеллектуальную собственность
OpenAI предупредила, что извлечение логики из ее моделей в больших масштабах может помочь конкурентам обучать более совершенные модели, не сохраняя при этом те же самые механизмы защиты.
«Дистилляция» модели — это метод машинного обучения, который может включать в себя использование результатов работы одной модели для обучения другой путем отправки массовых запросов, призванных воспроизвести логику и возможности более крупной модели.
И федеральные власти, и крупные американские компании в сфере ИИ, включая Google и Anthropic, обвиняют китайских конкурентов — и в частности компанию Moonshot AI — в использовании дистилляции для воспроизведения возможностей американских моделей. В блоге, опубликованном в среду, OpenAI заявила, что обнаружила и в конечном итоге пресекла кампанию по состязательной дистилляции, которая длилась почти весь июль.
«Операторы не взломали наше шифрование, не скомпрометировали базу данных и не получили прямого доступа к сохраненным диалогам пользователей», — говорится в блоге OpenAI. «Вместо этого они манипулировали взаимодействиями моделей таким образом, чтобы защищенные рассуждения можно было воспроизвести в формах, видимых запрашивающей стороне, скоординированным и масштабированным образом, что нарушало наши условия предоставления услуг».
«Запросы начали поступать 1 июля, и хотя поначалу их было немного, мы наблюдали резкий рост объёма запросов 24 и 25 июля, когда было обработано 16’000 запросов с использованием соответствующего шаблона извлечения данных от более чем 4'000 пользователей», — сообщила компания OpenAI.
В ходе расследования инцидента гигант в сфере искусственного интеллекта выявил соответствующую «активность по шаблону подсказок» (prompt-pattern activity) у более чем 15'000 пользователей. OpenAI полностью пресекла эту кампанию 28 июля. Хотя в OpenAI заявили, что неясно, были ли все операторы в июльском периоде связаны только с одной конкурирующей компанией в сфере ИИ, «основной кластер» кражи исходил от компании Moonshot AI, разработавшей языковую модель Kimi.
Стоит отметить, что в конце июля помощник президента США по науке и технологиям Майкл Крациос также обвинил компанию Moonshot AI в создании модели Kimi K3 путем дистилляции модели Fable от Anthropic. Выпущенная неделю назад модель Claude Opus 5.5 от Anthropic оснащена защитой от дистилляции под названием «сохраненное мышление», которую компания представила в версии Fable 5.1.
«Состязательная дистилляция представляет угрозу безопасности, в том числе национальной», — заявила в среду компания OpenAI. «Извлеченные рассуждения можно использовать для обучения другой модели без сохранения мер безопасности, применяемых к результатам работы исходной модели, с которыми взаимодействует пользователь. При массовом внедрении дистилляция также может ускорить передачу продвинутых возможностей без дополнительных вложений в безопасность. Эти опасения усиливаются по мере того, как модели приобретают возможности в областях двойного назначения».
OpenAI заявила, что в ответ на эти действия запретила учетные записи, копирующие модели, ужесточила регистрацию и контроль инфраструктуры, а также расширила меры мониторинга. Компания также «закрыла лазейку, которая позволяла тем, кто уже завладел зашифрованными рассуждениями другого пользователя, воспроизводить их и восстанавливать их содержание», а также начала работать с поставщиками услуг, чтобы подобные действия не переместились на сторонние сервисы. Кроме того, OpenAI поделилась подробностями своего расследования с другими компаниями, занимающимися искусственным интеллектом, через форум Frontier Model Forum и государственные программы обмена информацией.



