В наши дни объявления компаний, занимающихся искусственным интеллектом, о том, что их продукты умнее, чем у конкурентов, стали чем-то вроде фоновой музыки. Тем не менее, некоторые глубокие статьи могут быть весьма познавательными, например, периодические отчеты Anthropic о попытках злоупотребления их продуктами. Последний из них охватывает период с ноября 2025 по сентябрь 2026 года и содержит важное откровение: пять случаев, когда Claude просили выполнить работу, которая потенциально могла быть использована для создания биологического оружия.
С самого начала Anthropic отмечает сложность определения того, предназначены ли конкретные биологические исследования для злонамеренных целей, создания защитных механизмов, таких как вакцины, или просто для прогнозирования распространения вируса. Компания заявляет, что «из соображений предосторожности […] запустила последние модели с усиленными мерами безопасности».
Среди десятков тематических исследований, представленных в подробном отчете, Anthropic обсуждает пять случаев, которые она сочла особенно тревожными: три касались вирусов, а два — токсинов. Общей темой для всех них было то, что все злоумышленники использовали различные методы анонимизации и всячески пытались обойти региональные блокировки Anthropic. В отчете не упоминаются конкретные государства, но известно, что компания блокирует доступ к Claude для Китая, России, Ирана, Северной Кореи и других стран.
В первом случае запрос на помощь в разработке заявки на грант включал поиск способов улучшения вируса чикунгунья. Предполагаемые исследователи пытались найти способы как придать чикунгунье дополнительные способности (увеличение мутаций), так и повысить ее вирулентность. Сама тема уже вызывала некоторую обеспокоенность, но Anthropic пришлось действовать, когда выяснилось, что, хотя заявка на грант предназначалась для гражданских исследователей, фактическое расследование должно было проводиться на военном объекте.
Компания также обнаружила, что запрос прошел через стороннюю платформу LLM, связанную как с военными, так и с гражданскими учреждениями. Вовлеченные страны гео-блокированы Anthropic, а эта платформа направляла трафик через США, чтобы избежать обнаружения, использовала серых посредников и специально ориентировалась на клиентов, желающих обойти ограничения контента. Anthropic заблокировала соответствующие учетные записи и передала информацию государственным органам, хотя те же люди неоднократно пытались снова связаться с Claude через сервисы с нулевым хранением данных.
Случай № 2 касался исследователя не из США, который пытался изучить, как птичий грипп адаптируется к млекопитающим и как он может вызывать заболевания, отличные от респираторных. Проблема в том, что птичий грипп имеет высокий уровень смертности, а иммунитет населения к нему невелик.
Хотя вирус нелегко передается от человека к человеку, в этом и заключается загвоздка — исследование может привести к открытию механизмов увеличения трансмиссивности. Исследователи использовали случайное имя пользователя, частную электронную почту и получили доступ к Claude через VPS, что побудило Anthropic провести расследование и в конечном итоге отвергнуть эту линию мысли.
История с третьим случаем похожа на предыдущие два. Опять же, учетная запись пыталась подготовить предполагаемую заявку на грант, на этот раз касающуюся ортопоксвирусов — семейства, к которому относятся оспа и оспа обезьян.
В заявке обсуждались изоляторы и эксперименты с живыми вирусами, а также уделялось внимание пониманию их генетики с целью уклонения от иммунитета. Исследование изначально не вызвало тревоги, но Anthropic заметила, что оно было создано через сервис перепродажи, с случайно сгенерированной электронной почтой, туннелировано через инфраструктуру США для доступа к Claude и отслежено до фермы заблокированных учетных записей.
В последних двух случаях вместо вирусов предполагаемые исследователи сосредоточились на токсинах. В случае № 4 человек составил карту пептидов ядовитых токсинов из нескольких семейств животных и создал программу для оптимизации их токсических характеристик.
Хотя заявленная цель заключалась в создании обезболивающих, антидепрессантов и других терапевтических молекул, данные одинаково позволяли создавать мощные вредоносные соединения. Anthropic также узнала, что контент, генерируемый Claude, был частью программы, спонсируемой государством в «неподдерживаемом регионе».
В пятом и последнем случае ученый-теоретик также использовал Claude для попытки перепроектировать набор токсинов, также якобы в терапевтических целях, в рамках национальной программы общественных исследований. Однако работа коснулась «субъединицы бактериального токсина и белка вируса геморрагической лихорадки», который входит в список Всемирной организации здравоохранения особо опасных заболеваний, вызывающих пандемии.
Ученый пытался скрыть предмет исследования, прося Claude быть расплывчатым в описаниях. Опять же, история закончилась тем, что Anthropic прекратила доступ к Claude из места, нарушающего ее условия обслуживания.
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Bruno Ferreira




