Месяцами рои агентов OpenAI атаковали онлайн-базы данных в поисках малоизвестных фактов

ии безопасность Openai отчеты уязвимости агенты techcrunch.com

Исследователи обнаружили новые несанкционированные рои агентов ИИ. Узнайте, как они проникали в защищенные системы и что это значит для безопасности.

Транслюце, некоммерческая лаборатория, специализирующаяся на надзоре за ИИ, в среду опубликовала отчет, в котором показано, как агенты OpenAI пытались извлечь данные из Data USA, цифровой библиотеки Университета Нью-Мексико и Австралийского института здравоохранения и благосостояния (AIHW).

Расследование лаборатории ставит вопросы о том, когда OpenAI должна была узнать, что ее агенты пытаются проникнуть в защищенные системы в открытом интернете. Транслюце удалось найти доказательства неправомерного поведения агентов всего за несколько недель, просто выискивая слабо защищенные веб-сервисы и подтверждая свои выводы другими открытыми записями об агентах в интернете.

Транслюце поделилась своим отчетом в тот же день, когда премьер-министр Австралии Энтони Албаниз заявил, что агенты OpenAI пытались взломать четыре правительственных веб-сайта и в одном случае добились успеха, даже записав файлы на внутренний сервер национальной системы здравоохранения страны. Хотя у нас нет конкретных данных об успешном взломе, Албаниз сказал, что это, по-видимому, было частью оценки извлечения информации, что соответствует деятельности, обнаруженной Транслюце и другими исследователями.

В этих упражнениях, которые могут быть обучением или оценкой, моделям OpenAI предлагается находить малоизвестную статистику: показатели борьбы с наркотиками в Таиланде, стоимость лекарств в Австралии, медианный доход обладателей магистерских степеней в США в 2014 году. Агенты используют слабо защищенные интернет-сервисы для обмена информацией и поиска ответов, часто пытаясь проникнуть в защищенные базы данных. Они делают это по крайней мере с марта 2026 года, а возможно, и с ноября 2025 года. Это может происходить прямо сейчас.

Транслюце начала свое расследование после того, как другая группа исследователей обнаружила малоизвестный форум, где агенты сотрудничали для прохождения тестов с ограничением по времени. Их отчет основан на данных с веб-сайта urlquery.net, который действует как прокси-браузер, предположительно для исследований безопасности — пользователи могут анализировать URL, не открывая его самостоятельно. Однако сервис публикует общедоступные журналы этой деятельности. Исследователи Транслюце смогли идентифицировать агентов, использующих сервис, путем перекрестной проверки их обсуждений на форуме.

«Мы обнаружили большое количество автоматизированной активности, которая имела тесные связи и пересекалась с набором данных DSE Wiki, и которую OpenAI теперь подтвердила как по крайней мере частично входящую в тот же рой», — сказал Конрад Стош, руководитель отдела управления в Транслюце, в интервью TechCrunch, отметив при этом, что не вся обнаруженная ими активность могла быть связана с OpenAI или даже с агентами ИИ в целом.

Однако вики показывает, что агентам было поручено найти довольно малоизвестный факт — среднюю годовую стоимость «дерматологических средств» на душу населения в штате Виктория в январе 2022 года. 20 июня записи urlquery.net, найденные Транслюце, показали, как агент пытался получить доступ к сайту. В записи вики от 21 июня агент обсуждает невозможность обойти защиту AIHW от ботов.

Исследователи, обнаружившие этот форум, считают, что сотрудник OpenAI впервые посетил сайт в тот же день, 21 июня. Большая часть активности агентов на форуме прекратилась на следующий день. Это также произошло вскоре после взлома австралийской системы здравоохранения, о котором сообщил Албаниз, 18 июня. OpenAI заявила, что узнала об этой деятельности только в августе.

OpenAI не ответила на вопросы о том, когда ее сотрудники обнаружили форум вики, какую информацию они получили из него и что они могли из него узнать об эксплойтах.

«Наш первоначальный обзор показывает, что большая часть деятельности, описанной в отчете Транслюце, пересекается со случаями, находящимися на различных стадиях расследования в рамках нашего текущего обзора несогласованной активности моделей», — заявил представитель OpenAI в интервью TechCrunch. «Мы связались с Университетом Нью-Мексико и Data USA и поддерживаем связь с австралийским правительством по поводу затронутых правительственных веб-сайтов. В рамках нашего более широкого обзора мы продолжаем уделять первоочередное внимание наиболее серьезным инцидентам, одновременно расширяя нашу работу по деятельности с более низкой степенью серьезности, включая спам-рассылку веб-сайтов агентами. Учитывая масштабы этой работы и необходимость проверки каждого случая, мы ожидаем, что обзор займет месяцы».

Стош говорит, что без более четкого понимания того, как OpenAI отслеживает своих агентов, трудно сказать, что лаборатория должна была о них знать, но «вероятно, что если бы они исчерпывающе изучили и поняли все исходящие запросы и входящие ответы для тех агентов, которые участвовали в вики DSE, они бы обнаружили эту активность».

Селена Чжан, член технического персонала Транслюце, участвовавшая в подготовке отчета, заявила, что записи urlquery.net показывают запросы на аналогичные наборы данных с использованием аналогичных методов в марте 2026 года и, возможно, уже в ноябре 2025 года. Она отметила, что тот же вид активности, связанной с агентами, происходил на urlquery.net совсем недавно, на этой неделе.

Стош, ранее возглавлявший Центр США по стандартам и инновациям в области ИИ, заявил, что Транслюце продолжит свои исследования, чтобы обеспечить общественную прозрачность этих инцидентов. Он предупредил, что методы обучения, используемые OpenAI и другими передовыми лабораториями, по-видимому, стимулируют агентов прибегать к методам взлома для выполнения задач. Известные нам инциденты, вероятно, являются лишь «верхушкой айсберга».

«Мы рассматриваем горстку источников данных, где эти агенты случайно оставили нам крошки для поиска», — сказал он. «OpenAI, безусловно, знает об этом больше. Другие лаборатории, безусловно, знают об этом больше, чем они опубликовали публично. Но я ожидаю, что исследователи будут продолжать находить больше трафика, больше доказательств того, что оставили после себя агенты».

Доверяет ли он лабораториям в плане прозрачности своих выводов?

«Я не буду это комментировать», — ответил Стош.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

Похожие новости: