OpenAI приостановила крупный тренировочный запуск ИИ из-за тревожных кибервозможностей внутренних моделей

Openai безопасность ии киберугрозы Astra обучение neowin.net

OpenAI приостановила обучение самых мощных моделей ИИ, внедряя усиленные меры безопасности инфраструктуры. Узнайте, как компания реагирует на риски кибервозможностей и почему замедление разработки стало необходимым шагом.

OpenAI недавно запустила GPT-5.6 Cyber и расширила свою программу киберзащиты Daybreak, добавив уровни доступа Red и Blue, чтобы помочь разработчикам в поиске уязвимостей, безопасном ревью кода, анализе вредоносного ПО, реагировании на инциденты, валидации патчей и многом другом.

Ранее в этом месяце мы также сообщали, что OpenAI ужесточает меры безопасности для своей будущей модели Astra после того, как предварительные оценки выявили тревожные кибервозможности. Теперь OpenAI подтвердила, что обновит свою Preparedness Framework, чтобы учитывать риски, которые могут возникнуть непосредственно в процессе обучения, а не только на этапе развертывания модели. Кроме того, компания раскрыла больше деталей о мерах защиты, внедряемых в ее исследовательскую инфраструктуру.

Главная новость заключается в том, что OpenAI временно замедлила разработку своих самых мощных моделей ИИ, подготавливая системы со все более продвинутыми возможностями кибербезопасности. Это включало двухнедельную паузу в обучении с подкреплением (RL) для своих новейших моделей, предназначенных для развертывания. В то время как самый масштабный прогон RL на передовых моделях оставался на паузе, меньшие по размеру тренировочные прогоны и оценки продолжались.

В ответ на появление более сильных моделей с кибервозможностями OpenAI добавила надежную изоляцию (sandboxing) для рабочих нагрузок, выполняющих сгенерированный моделью код, усилила сетевую изоляцию для более рискованных задач, сократила постоянные привилегии и удалила потенциально уязвимые общие сервисы. Хотя некоторые тренировочные и оценочные нагрузки Astra возобновились с этими улучшенными средствами контроля, «значительное количество» остается на паузе до тех пор, пока они не будут перенесены в среды, соответствующие новым требованиям безопасности.

Мы временно замедлили некоторые передовые тренировки, чтобы усилить безопасность и мониторинг. Наш самый масштабный запланированный прогон RL на передовых моделях остается на паузе, в то время как тренировки и оценки меньшего масштаба помогают нам тестировать средства защиты и собирать больше доказательств согласованности.

Я ожидаю, что уверенность в безопасности…

— Jakub Pachocki (@merettm) 18 августа 2026 г.

OpenAI также упомянула, что расширяет свою систему мониторинга моделей. Теперь она использует классификаторы, которые проверяют активность на каждом семплированном токене, прежде чем передавать подозрительное поведение более capable автоматическим исследователям. Эта система будет искать несанкционированный доступ, кражу данных, деструктивные действия и попытки обойти средства защиты. Такой дополнительный мониторинг обходится недешево; OpenAI отметила, что он потребляет примерно 20% вычислительных мощностей инференса, которые находятся под наблюдением.

OpenAI подчеркнула, что недавний инцидент безопасности OpenAI-Hugging Face не является единственной причиной этих строгих мер. Вместо этого внутреннее тестирование показало, что ее будущая модель Astra может достичь критического порога кибербезопасности в соответствии с Preparedness Framework компании.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

В тренде:


Похожие новости: