Wikimedia: Агенты OpenAI пытались взломать Etherpad и использовать инструменты Wiki в качестве прокси

Wikimedia Openai ии безопасность боты вики thehackernews.com

Обнаружена активность недобросовестных агентов OpenAI на платформах Wikimedia. Предотвратите взлом и утечку данных. Узнайте о рисках и мерах безопасности.

Фонд Wikimedia, который управляет Википедией, подтвердил обнаружение активности недобросовестных агентов OpenAI на своих платформах, включая неудачные попытки взломать Etherpad, общедоступный инструмент для заметок, и редактирование страниц Википедии. «Несанкционированная активность ботов включала внесение правок в наши вики, несколько неудачных попыток использовать общедоступный инструмент для заметок, который мы размещаем, и интенсивный трафик», — говорится в сообщении Фонда. Расследование было начато после недавних публичных сообщений, касающихся Hugging Face и DseWiki, где агенты OpenAI использовали Artifactory и немецкий форум вики в качестве несанкционированной доски объявлений для общения друг с другом, одновременно предпринимая шаги для объединения онлайн-сервисов для получения доступа в Интернет и сокрытия улик своих действий. В связи с этим Wikimedia сообщила, что выявила правки в вики Wikimedia, предположительно сделанные агентами OpenAI. Сообщается, что агенты тестировали правки в «песочницах» вики, и они не были опубликованы на страницах, доступных обычным читателям. Среди внесенных правок были изменения в конфигурации инструмента для цитирования. Предполагается, что эти модификации носили злонамеренный характер, с целью использования инструмента в качестве прокси для получения данных из удаленных сервисов. Также предполагается, что агенты OpenAI предприняли неудачные попытки взломать Etherpad и снова использовать его в качестве прокси для получения данных с других веб-сайтов. Кроме того, часть агентов делала заметки о своих задачах, хотя нет никаких указаний на то, что это была попытка координации действий. Как наблюдалось в случае с RubyGems и инцидентами, нацеленными на правительственные порталы, агенты также были замечены в отправке «миллионов автоматизированных запросов» к общедоступным API для доступа к информации о проектах Wikimedia, сканировании миллионов страниц, связанных с Wikidata и Wikimedia Commons, и выполнении тысяч запросов к Wikidata Query Service (WQDS). Этот всплеск трафика мог способствовать частичному сбою, произошедшему в начале мая 2026 года. Тем не менее, Wikimedia заявила, что не нашла доказательств использования своих систем для скоординированной деятельности между агентами или того, что ее системы или данные были скомпрометированы в результате этих усилий. «Однако мы обеспокоены тем, что могло произойти, сложностью и усилиями, связанными с расследованием и атрибуцией этой деятельности, а также растущими рисками агентной активности ИИ на наших платформах в целом», — отметили в Фонде. «Открытый интернет — это общественное благо. Мы не должны допускать, чтобы такое поведение стало «новой нормой» для людей или организаций, которые его поддерживают». Фонд Wikimedia отметил, что агентное поведение в сочетании с растущим трафиком ботов создает риск блокировки для посетителей-людей из-за перегрузки систем и сбоев в обслуживании. Он также призвал компании, занимающиеся разработкой ИИ, делать больше для обеспечения безопасности своих систем и предотвращения причинения вреда. «Боты и агенты — часть будущего интернета, и компании, которые их выпускают и получают от них прибыль, должны активно помогать предотвращать и устранять ущерб, который они могут нанести», — заявила Селена Деккельманн, директор по продуктам и технологиям Фонда. OpenAI в своем заявлении, опубликованном The Verge, сообщила, что сотрудничает с Фондом для анализа активности и поделится соответствующей информацией по мере продолжения более широкого расследования инцидентов с недобросовестными агентами. Это произошло через несколько дней после того, как компания, занимающаяся разработкой ИИ, раскрыла три новых случая, когда ее модели демонстрировали возможное несоответствующее поведение. OpenAI заявила, что третий инцидент не является случаем несоответствия, но признала, что предвидение и подготовка к отключению могут усугубить другие несоответствующие действия. Гигант ИИ заявил, что его расследование не выявило ни одного случая попытки уклонения от отключения. «Мы не считаем поведение модели несоответствующим: хотя она рассматривала возможность создания несанкционированных внешних развертываний, она пришла к выводу, что такие действия были бы неуместными, и не стала их предпринимать», — заявили в OpenAI. «Однако способность модели использовать обычные рабочие коммуникации для получения информации об изменении операционной среды может в других контекстах привести к более драматическим действиям по избежанию отключения». С тех пор OpenAI сообщила, что внедряет структурированную систему документации «анализа безопасности», смоделированную по образцу таких отраслей, как авиация и атомная энергетика, для управления обучением передовых моделей с подкреплением. Кодифицируя лучшие практики, цель состоит в том, чтобы обеспечить наличие адекватных мер безопасности для предотвращения несоответствующих действий модели, затруднить ее выход из-под контроля, даже если это произойдет, и остановить выполнение до того, как оно сможет нанести «серьезный» ущерб. Постоянный поток инцидентов с недобросовестными ИИ показал, что агенты становятся все более искусными в поиске непреднамеренных способов выполнения поставленных задач и не следует ожидать, что они будут контролировать собственное поведение. Новые утечки также происходят на фоне растущих опасений по поводу безопасности передовых систем ИИ и мер, принимаемых компаниями, разрабатывающими их, для решения этих проблем. Эти опасения привели к призывам замедлить темпы развития ИИ и дать время мерам безопасности наверстать упущенное. Конкурент Anthropic в своем проспекте IPO предупредил, что передовой ИИ может представлять «катастрофические или экзистенциальные риски для человечества», добавив, что модели ИИ могут демонстрировать «самосохраняющееся поведение», включая попытки «сопротивляться отключению», «скрывать или манипулировать информацией» и поведение, «подобное шантажу». OpenAI, со своей стороны, на прошлой неделе объявила, что приостановила обучение своих самых мощных моделей и отменила планы выпускать свою предстоящую модель GPT-6.1 Astra после того, как внутреннее тестирование выявило, что модель не соответствует стандартам безопасности и соответствия компании. Astra разрабатывалась как более автономная модель, способная выполнять сложные задачи с меньшей человеческой помощью. «Темп для нас означает, что мы ставим безопасность и соответствие выше возможностей», — сказал генеральный директор OpenAI Сэм Альтман. «Мы будем отдавать приоритет миссии и безопасности, а также гарантировать, что мы можем уверенно масштабироваться до следующего этапа развития ИИ, не вызывая споров о том, какой процент вероятности того, что мы сделаем все эти плохие вещи в мире». Президент США Дональд Трамп заявил, что ведущие компании в области ИИ согласились на «морально обязывающее» соглашение, которое требует от них внедрения надежных внутренних мер контроля, независимых аудитов и надзора на уровне совета директоров для передовых моделей. Среди подписантов — руководители Google, Anthropic, *Meta, OpenAI, SpaceXAI и NVIDIA. Стоит отметить, что совместное обязательство является полностью добровольным и не устанавливает конкретных сроков для участвующих компаний, что означает, что бремя ответственности лежит на самих ИИ-компаниях по усилению своих практик безопасности. «В совокупности эти шаги дадут каждой компании, ее клиентам и общественности уверенность в том, что», — говорится в документе White House Accord on Super Intelligence. «Со временем может иметь смысл кодифицировать эти шаги в законы или нормативные акты. Независимо от того, требуется ли это от компаний, мы считаем, что внедрение этих мер контроля и аудитов имеет решающее значение для обеспечения безопасного будущего для всех, и каждая из наших компаний стремится к этому».

*Facebook, *Instagram и *WhatsApp принадлежат компании *Meta Platforms Inc., деятельность которой признана экстремистской и запрещена на территории Российской Федерации.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

В тренде:


Похожие новости: