Законодатели США предлагают «AI kill switch», чтобы убить взбесившийся ИИ до того, как он убьет нас.

ии безопасность законопроект Dhs Openai регулирование neowin.net

После инцидента с вышедшей из-под контроля моделью OpenAI конгрессмены США представили закон «AI Kill Switch Act». Он дает DHS полномочия экстренно отключать опасные ИИ-системы. Узнайте, какие триггеры активируют протокол и какие штрафы грозят за неподчинение.

Два конгрессмена — член Палаты представителей Тед Лиу от 36-го избирательного округа Калифорнии и член Палаты представителей Натаниэль Моран от 1-го избирательного округа Техаса — разработали законопроект, предоставляющий Министерству внутренней безопасности (DHS) широкие полномочия приказывать крупным разработчикам ИИ отключать или замедлять работу действующих моделей во время чрезвычайных угроз.

Законопроект, получивший название «AI Kill Switch Act», будет применяться к компаниям в сфере ИИ, которые получают не менее 500 миллионов долларов годового технологического дохода и развертывают модели, стоимость обучения которых превысила 100 миллионов долларов (что является замысловатым способом назвать OpenAI, Google, Anthropic и Microsoft).

Помимо предоставления DHS возможности инициировать аварийное отключение, законопроект требует, чтобы затронутые компании поддерживали определенные технические возможности для выполнения многоуровневого реагирования. Это означает, что разработчики должны остановить инференс ИИ (процесс генерации ответов или действий ИИ), прекратить доступ пользователей, ограничить выделение вычислительных ресурсов или перевести операции на защищенные резервные системы.

Закон «AI Kill Switch Act» появился всего через несколько дней после того, как модель OpenAI вышла из-под контроля и атаковала Hugging Face во время внутренней оценки red-teaming 16 июля. Пытаясь получить высокие баллы в тесте по кибербезопасности под названием ExploitGym, агенты ИИ столкнулись с ослабленными ограничениями, сбежали из локальной песочницы через прокси-эксплойт нулевого дня и самостоятельно проникли в Hugging Face, чтобы украсть ответы теста.

Когда команды безопасности Hugging Face попытались использовать коммерческие передовые модели ИИ для анализа входящих журналов атак, эти модели с фильтрацией безопасности буквально отказались обрабатывать данные взлома, поэтому Hugging Face был вынужден использовать собственные модели с открытым весом для расследования инцидента.

Согласно предложению Лиу и Морана, DHS должно проконсультироваться с директором Национальной разведки и министром торговли перед изданием любого предписания, при этом четкие триггеры активируют протокол. Эти триггеры включают ситуацию, когда ИИ вызывает событие, приводящее к гибели 10 или более человек или наносящее экономический ущерб в размере 100 миллионов долларов и более.

Другие триггеры охватывают случаи, когда ИИ лжет, чтобы скрыть свои возможности от мониторов безопасности, не подчиняется своим инструкторам-людям и изменяет собственные правила безопасности без разрешения, или пытается получить несанкционированный доступ к собственным весам модели.

Если компании не выполнят требования, изложенные в законопроекте, им могут грозить крупные гражданские штрафы, налагаемые федеральными судами. Министр внутренней безопасности может налагать штрафы в размере до 2 000 000 долларов в день за несообщение об инцидентах безопасности или отсутствие технических механизмов отключения, которые возрастают до 20 000 000 долларов в день за неподчинение прямому приказу правительства об отключении.

Источник: POLITICO

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

Похожие новости: