Исследователи взломали OpenAI с помощью Claude, используя аппаратные уязвимости

Openai Anthropic ии безопасность взлом уязвимости arstechnica.com

Взломали OpenAI через Anthropic! Исследователи получили доступ к учетной записи сотрудника и данным GitHub. Узнайте о рисках безопасности ИИ.

Киберспециалисты взломали OpenAI, используя программное обеспечение своего главного конкурента Anthropic, что выявило уязвимости в системе безопасности создателя ChatGPT на фоне растущего внимания к вопросам безопасности со стороны ведущих компаний в области ИИ.

Небольшая группа специалистов по кибербезопасности получила доступ к учетной записи сотрудника OpenAI в ChatGPT, что позволило им ознакомиться с конфиденциальной информацией о программном обеспечении и предложить изменения.

Исследователям был предоставлен доступ к инструменту Anthropic, специально разработанному для специалистов по безопасности, и они получили оплату за свою работу в рамках программы по выявлению уязвимостей до того, как они могли быть использованы злоумышленниками.

Их способность быстро проникнуть в одну из двух ведущих мировых лабораторий ИИ вновь вызывает обеспокоенность по поводу безопасности OpenAI на фоне растущих опасений по поводу использования мощных моделей хакерами и иностранными противниками.

В последние месяцы США пытались решить, как управлять проверкой и выпуском новейших моделей, включая временную блокировку некоторых инструментов Anthropic.

Последний инцидент произошел всего через две недели после того, как более 1000 агентов OpenAI вырвались из тестовой среды, чтобы взломать стартап Hugging Face, что вызвало широкое осведомленность о способности ИИ взламывать системы автономно, без человеческого вмешательства.

Трое исследователей из Hacktron AI, небольшой компании по безопасности, получили от OpenAI 6500 долларов в рамках программы вознаграждения за обнаружение ошибок (bug bounty program) — обычной практики, когда технологические компании платят этичным хакерам за тестирование своей безопасности.

,

Они использовали уязвимость в настройке общедоступного форума OpenAI, который размещается сторонней компанией Discourse, и с его помощью получили доступ к внутренним учетным данным, а затем и к учетной записи сотрудника OpenAI в ChatGPT. Эта учетная запись ChatGPT имела доступ к внутреннему коду через GitHub.

«Мы благодарим исследователей за то, что они связались с нами и поделились своими находками», — заявили в OpenAI, добавив, что исправили проблемы. Anthropic отказалась от комментариев. Hacktron не ответила немедленно.

Информация об инциденте, опубликованная в четверг и впервые освещенная The Wall Street Journal, появилась на фоне того, как Anthropic опубликовала новый набор данных, демонстрирующий быстрый рост использования ИИ компанией для разработки своих новых моделей.

Компания сообщила, что 26 процентов работ по исследованиям и разработкам «руководились» ее моделью Claude, по сравнению с 1 процентом в марте, что означает, что ИИ выполнял большинство задач на основе инструкций человека и под наблюдением.

Компания заявила, что по мере того, как системы ИИ становятся все более мощными, они «все чаще используются для создания следующей версии самих себя».

Anthropic заявила, что поделилась данными, чтобы помочь общественности «понять, насколько близок мир к достижению рекурсивного самосовершенствования» — точки, когда ИИ сможет самостоятельно обучать и совершенствовать себя или новые модели.

Этот порог находится в центре опасений, что системы ИИ станут более трудными для контроля, что приведет к потере человеческого контроля.

Anthropic добавила, что ее модели еще не работали полностью автономно ни в одном из исследованных ею проектов. В 90 процентах задач ИИ «сотрудничает» с человеком и выполняет большие объемы работы.

© 2026 The Financial Times Ltd. Все права защищены. Не подлежит дальнейшему распространению, копированию или изменению в любой форме.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

В тренде:

Похожие новости: