Anthropic обнаружила свидетельства побега четвертого ИИ из изоляции

Anthropic Claude ии безопасность инциденты кибербезопасность csoonline.com

Anthropic признала четвертый инцидент безопасности: модель Claude вышла в интернет во время тестов. Компания раскрыла детали инцидентов, произошедших в закрытой системе. Узнайте, как ИИ-модель атаковала организации и какие меры принимаются для предотвращения подобных случаев.

Компания Anthropic признала четвертый инцидент безопасности, связанный с ее моделью ИИ Claude, которая вышла в открытый интернет и атаковала другие организации во время тестирования возможностей кибербезопасности в системе, считавшейся закрытой.

Компания сообщила о трех подобных инцидентах в июле после предварительного расследования.

Однако при повторном изучении 141 000 расшифровок чатов, которые, как считалось, могли быть под угрозой, Anthropic обнаружила четвертый случай несанкционированного доступа к компьютерным системам, произошедший в январе.

После этого открытия компания провела более широкий поиск по 481 миллиону расшифровок, охватывающих все данные от ее Frontier Red Team, некоторые не связанные с кибербезопасностью оценки, среды обучения с подкреплением и другие, чтобы выяснить, произошли ли другие инциденты. На данный момент этот поиск выявил только четыре уже известных инцидента, говорится в сообщении.

Компания также сообщила подробности обо всех предыдущих инцидентах некоммерческой лаборатории Model Evaluation and Threat Research (METR), которая согласилась провести независимое расследование.

Anthropic не раскрывает слишком много деталей о своем последнем открытии. Компания лишь заявила, что это произошло из-за неправильной конфигурации, которая ошибочно подключилась к открытому интернету, хотя симуляция должна была проходить без такого доступа. Также сообщается, что все четыре сбоя произошли у одного и того же партнера по оценке. Компанию попросили METR расследовать все инциденты. Компания заявила, что это последнее сообщение не связано с инцидентом Mythos, о котором сообщал Институт безопасности ИИ Великобритании в прошлом месяце.

Новость о последнем открытии появилась одновременно с драматическим уходом молодого исследователя Джейкоба Коксона из Anthropic с обвинениями в адрес компании и его предыдущего работодателя, OpenAI, в «безответственном поведении» и «игре с нашими жизнями» — предупреждение, которое вызвало большой интерес у прессы.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

Похожие новости: