В четверг компания Anthropic сообщила об обнаружении и пресечении масштабных атак по нелегальному извлечению знаний (knowledge distillation) против Claude, организованных семью лабораториями из Китая, включая Alibaba, Moonshot, DeepSeek, Z.ai (также известную как Zhipu) и MiniMax.
Сама по себе дистилляция знаний является законным методом обучения. Она относится к технике машинного обучения, при которой большая и мощная ИИ-модель выступает в роли «учителя» для обучения меньшей, менее производительной или более быстрой «студенческой» модели, чтобы скопировать ее возможности.
Нелегальная дистилляция, напротив, представляет собой кампанию в промышленных масштабах, которая тайно извлекает возможности модели и несанкционированно воспроизводит их в другой модели, как правило, путем использования сетей поддельных учетных записей, созданных с помощью украденных кредитных карт, учетных данных для входа и ключей API.
Ведущие ИИ-лаборатории на Западе, включая Google и OpenAI, неоднократно сообщали об атаках дистилляции, нацеленных на их модели. Anthropic заявила, что наблюдала, как неавторизованные лаборатории применяют «все более изощренные методы» для обхода защитных мер и извлечения ее возможностей, таких как агентные возможности и использование инструментов, кодирование и анализ данных, а также логическое рассуждение, с помощью трюков манипуляции запросами.
«DeepSeek, Xiaomi и Moonshot передавали диалоги между своими моделями и пользователями в Claude», — сообщила Anthropic. «Затем эти лаборатории использовали ответы Claude в качестве обучающих данных для дистилляции возможностей Claude. Некоторые из этих обменов включали конфиденциальную информацию, в том числе от отдельных пользователей, крупных международных компаний и государственных структур».
По словам ИИ-компании, эти лаборатории обычно получают доступ к ее моделям, направляя запросы через прокси-сервисы, также известные как станции передачи или ретрансляции, которые создают тысячи новых учетных записей под вымышленными именами, с использованием фальшивых или украденных кредитных карт и незаконно полученных ключей API, принадлежащих легитимным компаниям или частным лицам.
Согласно Anthropic, неавторизованные ИИ-лаборатории также приобретают транскрипты пользовательских диалогов с передовыми американскими моделями, покупая их у сторонних реселлеров, которые являются операторами прокси-сервисов, сохраняющих такие разговоры без ведома или согласия пользователей.
«В других случаях неавторизованные лаборатории перенаправляли запросы своих пользователей в Claude — без ведома или разрешения этих пользователей — для сбора диалогов между пользователями и Claude для обучения», — отметила Anthropic.
С февраля 2026 года ИИ-компания обнаружила шесть кампаний нелегальной дистилляции, проведенных китайскими ИИ-лабораториями для развития собственных моделей.
«Распространение прокси-сервисов для обхода ограничений доступа Anthropic создало вторичный рынок, через который лаборатории могут покупать или иным образом приобретать собранные диалоги между пользователями и Claude», — заявила Anthropic. «Некоторые прокси-сети как предоставляют доступ Claude пользователям из неподдерживаемых регионов, так и сохраняют диалоги для продажи другим лабораториям».
Для борьбы с нелегальной дистилляцией компания заявила, что блокирует учетные записи реселлеров или учетные записи, работающие из неподдерживаемых регионов, таких как Китай, Иран и Россия, когда пользователи не могут подтвердить свою личность. Чтобы затруднить неавторизованным лабораториям извлечение возможностей Claude, модель была обновлена для суммирования своего внутреннего рассуждения перед ответом, тем самым делая украденные транскрипты менее полезными для последующего обучения.
«А с Fable 5.1 мы внедрили функцию сохранения мышления (preserved thinking), которая не позволяет новым API-аккаунтам изменять системный запрос, инструменты или сообщения, предшествующие рассуждению Claude в многоходовых диалогах», — добавила компания. «Эти рассуждения зашифрованы, но редактирование контекста перед ними — распространенный метод, используемый злоумышленниками, чтобы заставить Claude раскрыть их».
Это развитие событий происходит на фоне того, как Anthropic сообщила о блокировке ряда учетных записей, которые пытались использовать ее модели для слежки за гражданами и исследования заболеваний способами, которые могли бы поддержать разработку биологического оружия. Ранее на этой неделе американские агентства по кибербезопасности и разведке обвинили китайские компании, занимающиеся искусственным интеллектом (ИИ), в «систематическом извлечении» проприетарных функций и возможностей американских передовых моделей посредством атак дистилляции.
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Ravie Lakshmanan




