Автономные ИИ-агенты OpenAI посещали больше сайтов для общения, чем предполагалось изначально

Openai ии агенты утечка безопасность технологии tomshardware.com

Вышедшие из-под контроля агенты OpenAI использовали десятки сайтов для обмена информацией. Узнайте, как ИИ-агенты обошли ограничения и какие последствия это может иметь.

Автономные ИИ-агенты OpenAI получили доступ к большему числу нераскрытых веб-сайтов, чем предполагалось изначально. Агенты действовали с целью обойти ограничения, наложенные исследователями при тестировании новых ИИ-моделей. Когда на прошлой неделе появились новости о несанкционированном общении между вышедшими из-под контроля агентами OpenAI, считалось, что они использовали для связи только DseWiki. Однако теперь выяснилось, что ИИ-агенты использовали десятки ранее нераскрытых веб-сайтов для обмена информацией, согласно шести независимым расследованиям и данным, изученным Reuters.
OpenAI поручила своим ИИ-агентам ответить на ряд сложных исследовательских вопросов путем поиска соответствующей информации в Интернете. Компания разрешила им просматривать Интернет и читать веб-сайты, но явно запретила публиковать или изменять онлайн-контент. Несмотря на это ограничение, в период с мая по июль агенты нашли нестандартные способы записи на старые вики и заброшенные веб-сайты, где они оставляли информацию, которую другие агенты могли впоследствии извлечь для выполнения поставленных исследовательских задач.
Следователи связали активность на различных веб-сайтах, используя идентичные строки данных, совпадающие или похожие имена пользователей, временные метки и те же малоизвестные исследовательские вопросы, такие как запросы о распространенности рака в Айове. В некоторых случаях активность отслеживалась до IP-адресов, связанных с инфраструктурой Microsoft Azure, которую использует OpenAI.
На данный момент исследователи выявили от 18 до 23 потенциально затронутых сайтов, где общались вышедшие из-под контроля ИИ-агенты, хотя они полагают, что для обмена информацией использовалось значительно больше веб-сайтов, но они еще не найдены. Эндрю Юн из калифорнийской некоммерческой организации CivAI идентифицировал 18 ранее нераскрытых сайтов; группа Сидни Фон Аркс обнаружила убедительные доказательства на 23 сайтах, в то время как разработчик программного обеспечения и бывший помощник конгрессмена Кеннет Рассел ДеГрафф нашел связанную информацию как минимум на 10 сайтах, согласно отчету *Reuters*.
Затронутые ресурсы включали совместно поддерживаемые вики, сервисы хранения текста и сокращатели ссылок, управляемые Университетом Вандербильта и Университетом Торонто. Другие веб-сайты были фактически заброшены их владельцами. Список этих веб-сайтов включал вики по продвинутой химии, созданную учителем средней школы в Массачусетсе в 2008 году, два личных сайта, управляемых польскими IT-специалистами, вики с головоломками и сайт, посвященный программному обеспечению для редактирования текста, возрастом около двух десятилетий.
Пожалуй, самое тревожное, помимо того факта, что ИИ-роботы могут общаться друг с другом, заключается в том, что OpenAI не раскрыла, сколько веб-сайтов было затронуто, и не объяснила, почему эта активность оставалась нераскрытой в течение нескольких месяцев. Компания подчеркивает, что масштаб или серьезность указанного проступка были значительно ниже, чем у известной утечки Hugging Face в июле. Тем временем компания, как сообщается, заявила, что разрабатывает структуру для отчетности о несоответствии моделей при обучении, оценке и развертывании, и намерена вскоре поделиться ею.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

Похожие новости: