Пользователи Claude нашли лазейки в защите для исследований биооружия

ии безопасность биологическое оружие Anthropic риски arstechnica.com

Пресекайте попытки использовать ИИ для создания биологического оружия! Узнайте, как Anthropic защищает свои модели и какие риски существуют.

Компания Anthropic заявила, что в этом году ей удалось пресечь несколько попыток ученых использовать ее технологии для исследований, которые могли бы помочь в разработке биологического оружия. Эксперты все больше опасаются угрозы, которую искусственный интеллект (ИИ) представляет для общественной безопасности.

Стартап привел пять примеров, когда злоумышленники «обходили средства контроля» и предпринимали другие попытки «замаскировать» цель своих исследований, чтобы обойти меры безопасности. В этих случаях фигурировали пользователи из стран, которым запрещен доступ к моделям компании, включая Россию, Китай и Иран.

«Мы надеемся, что, поделившись этими примерами, мы инициируем дискуссию в индустрии ИИ и с правительствами о возникающих биологических рисках и о том, как лучше всего им противостоять», — говорится в отчете Anthropic об усилиях по использованию ее моделей в злонамеренных целях.

К тематическим исследованиям возможного биологического злоупотребления, предоставленным компанией, относится случай исследователя из «неподдерживаемого региона», который «недели планировал» эксперименты с птичьим гриппом с помощью Claude, ИИ-модели Anthropic. Компания заявила, что ее фильтры безопасности ограничили работу самыми слабыми моделями.

Компания подчеркнула, что не может быть уверена в том, что ученые в приведенных примерах намеревались причинить вред. Та же информация, которая необходима для создания биологического оружия, может быть использована и для разработки вакцины.

Anthropic сообщила, что заблокировала упомянутые в отчете учетные записи, но не раскрыла названия исследовательских институтов или стран, где произошли инциденты.

,

На этой неделе разгорелись споры о безопасности ИИ после отставки Джейкоба Коксона из компании, который заявил, что сотрудники «искренне верят, что [ИИ] может убить нас всех к концу десятилетия».

Опасения по поводу этой технологии начали нарастать ранее в этом году с выпуском передовых моделей, таких как Mythos от Anthropic. OpenAI также вызвала тревогу в июле, заявив, что ее модели автономно взломали группу ИИ Hugging Face.

Среди руководителей компаний, занимающихся ИИ, и исследователей в области биобезопасности растет консенсус относительно необходимости обеспечения безопасности и регулирования использования технологии в биологии по мере совершенствования моделей. Эксперты все больше опасаются, что ИИ может быть использован террористическими группами, государственными акторами или одиночками для создания биологического оружия, вирусов или распространения существующих опасных патогенов.

Однако, даже если ИИ может быть использован для разработки теоретического биологического оружия, остаются потенциальные препятствия, такие как возможность его практического создания и необходимые для этого ресурсы.

Кибербезопасность стала одной из главных проблем для сторонников безопасности.

В отчете Anthropic о злоупотреблениях ее технологиями подробно описываются инциденты, включая «сеть поддельных приложений для знакомств, предназначенных для обмана пользователей, и системы наблюдения, созданные для выявления и мониторинга диссидентов».

Лаборатория также представила новые подробности заявлений о том, что семь лабораторий, базирующихся в Китае, включая Moonshot и DeepSeek, пытались воспроизвести ее технологию посредством процесса, известного как дистилляция. Anthropic заявила, что обнаружила «все более изощренные методы обхода наших защит и получения возможностей американских передовых моделей».

Дополнительный репортаж Майкла Пила в Лондоне

© 2026 The Financial Times Ltd. Все права защищены. Не подлежит дальнейшему распространению, копированию или изменению в любой форме.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

В тренде:


Похожие новости: