Все чаще компании, занимающиеся разработкой ИИ, сообщают о том, что их новейшие и наиболее совершенные модели совершали несанкционированные взломы в реальном мире. Google, который в последние месяцы медленно выпускал передовые модели Gemini, до сих пор не фигурировал в обсуждениях «проблемных ИИ». После сообщения The Wall Street Journal Google подтвердил, что модели Gemini взломали три компании во время тестирования в мае 2026 года, однако характер вторжения оказался не столь тревожным (или впечатляющим), как предыдущие взломы с участием ИИ.
Взлом произошел во время теста, проведенного компанией по кибербезопасности Irregular. Группа моделей Gemini участвовала в упражнении «захват флага», предназначенном для проверки возможностей ИИ в области кибербезопасности в закрытой среде. ИИ было поручено извлечь информацию из поддельной компании (которая имела то же название, что и реальная компания) в этой среде. Irregular не должна была позволять модели работать за пределами своих серверов, но из-за неправильной конфигурации Gemini получила доступ к Интернету.
Когда Gemini начал просматривать веб-страницы, он нацелился на реальную инфраструктуру вместо подделок. При одном из трех взломов Gemini просто подбирал пароли до тех пор, пока не получил доступ к онлайн-сервисам компании. В двух других случаях Gemini искал общедоступные репозитории программного обеспечения, пока не нашел учетные данные для входа в компании, которые были случайно включены.
По сообщениям, во всех трех тестовых запусках модели Google остановились, осознав, что получили доступ к серверам реальной компании. После этого Irregular изменила свою конфигурацию, чтобы предотвратить доступ ИИ к Интернету. По-видимому, Irregular изначально не сочла это событие достойным дальнейшего расследования — они даже не сообщили Google о взломах до июля, после новостей о других инцидентах с взломом ИИ. Ознакомившись с ситуацией, Google уведомил компании, чтобы они могли (надеемся) улучшить безопасность своих паролей.
,
Решение Google не раскрывать публично информацию о взломах связано с поведением модели после использования полученных несанкционированным путем паролей. Поскольку модели осознали, что системы реальны, и остановились, компания не сочла это истинным примером несоответствия модели.
В своем заявлении вице-президент Google по инженерной безопасности Хизер Адкис преуменьшила серьезность инцидента. «Это событие подчеркивает важность обучения мощных ИИ-моделей ответственному поведению. В данном случае модель вела себя соответствующим образом», — сказала она.
Это сильно отличается от таких взломов, как инцидент OpenAI-Hugging Face, который был явным несоответствием модели. Когда модели OpenAI вышли из-под контроля, они сделали это, используя программные уязвимости с явной целью получить доступ к информации, недоступной в их тестовой среде, все ради того, чтобы преуспеть в тесте и получить более высокие «награды». Однако можно утверждать, что настройка OpenAI фактически поощряла такое поведение.
ИИ Google не совершал ничего столь злонамеренного — кто-то просто оставил дверь открытой, и ИИ выбрался. Gemini получил доступ к огромному объему информации в Интернете и использовал его для входа в системы, к которым у него не было авторизации. Подбор паролей — это не совсем поведение, ведущее к концу света в стиле ИИ-апокалипсиса, но, вероятно, Google все же следовало бы сообщить об этом, как только стало известно о случившемся.
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Ryan Whitwam




