Компания OpenAI, которая собрала огромные объемы интернет-контента на фоне споров об авторских правах, обвинила лиц, связанных с китайской Moonshot AI, в проведении «атаки дистилляции», начавшейся 1 июля. Компания Сэма Альтмана предупреждает, что извлечение рассуждений ее моделей в больших масштабах может помочь конкурентам обучить способные модели без сохранения тех же мер предосторожности.
Дистилляция моделей — это метод машинного обучения, который может включать использование выходных данных одной модели для обучения другой. В случае враждебных действий это делается путем отправки массовых запросов, разработанных для воспроизведения рассуждений и возможностей большей модели.
Как федеральные власти США, так и крупные американские компании в области ИИ, включая Google и Anthropic, обвиняли китайских конкурентов, и в частности Moonshot AI, в использовании дистилляции для воспроизведения возможностей американских моделей. В среду OpenAI также присоединилась к обвинениям, заявив, что обнаружила и в конечном итоге пресекла враждебную кампанию дистилляции, которая продолжалась почти весь июль.
«Операторы не взломали нашу систему шифрования, не скомпрометировали базу данных и не получили прямого доступа к сохраненным разговорам пользователей», — говорится в сообщении. «Вместо этого они манипулировали взаимодействиями с моделью таким образом, чтобы защищенные рассуждения могли быть воспроизведены в формах, видимых запрашивающему, в скоординированной и масштабированной манере, что нарушило наши условия обслуживания».
Запросы начались 1 июля, и хотя сначала они были медленными, «мы наблюдали всплески высокого объема 24 и 25 июля, состоящие из 16 000 запросов с использованием соответствующего шаблона извлечения от более чем 4 000 пользователей», — заявила OpenAI.
После расследования инцидента гигант в области ИИ выявил связанную «активность по шаблонам запросов» у более чем 15 000 пользователей. По нашим данным, OpenAI полностью пресекла кампанию 28 июля.
Хотя OpenAI заявила, что неясно, были ли все операторы в июле связаны только с одной конкурирующей компанией в области ИИ, «основной кластер» кражи исходил от Moonshot AI, которая разработала Kimi.
The Register обратился к Moonshot AI за комментарием, но не получил немедленного ответа. Мы также спросили OpenAI, какие из ее моделей были целью во время июльской кампании, но не получили ответа.
Стоит отметить, что в конце июля помощник президента США Дональда Трампа по науке и технологиям Майкл Крациос также обвинил Moonshot AI в создании своей модели Kimi K3 путем дистилляции Fable от Anthropic.
Модель Claude Opus 5.5 от Anthropic, выпущенная неделю назад, оснащена защитой от дистилляции под названием «сохраненное мышление», которую она представила с Fable 5.1.
«Враждебная дистилляция представляет риски для безопасности и национальной безопасности», — заявила OpenAI в среду, вторя предыдущим жалобам американских компаний и официальных лиц.
«Извлеченные рассуждения могут быть использованы для обучения другой модели без сохранения мер безопасности, примененных к выходным данным оригинальной модели, ориентированным на пользователя», — добавила OpenAI. «В больших масштабах дистилляция также может ускорить передачу передовых возможностей без необходимости таких же инвестиций в безопасность. Эти опасения усиливаются по мере того, как модели приобретают возможности в областях двойного назначения».
В ответ OpenAI заявила, что заблокировала учетные записи, копирующие модели, ужесточила правила регистрации и контроля инфраструктуры, а также расширила усилия по мониторингу.
Компания также «закрыла канал, который позволял кому-то, кто уже имел зашифрованные рассуждения другого пользователя, воспроизвести их и восстановить их содержимое», и работала с поставщиками услуг, чтобы гарантировать, что этот тип деятельности по дистилляции не переместится на сторонние сервисы.
Кроме того, OpenAI поделилась деталями своего расследования с другими фирмами в области ИИ через Frontier Model Forum и программы обмена информацией с правительством.®
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Jessica Lyons




