В четверг компания OpenAI представила GPT-6 Astra, сообщив, что новая флагманская модель превысила порог «Критический» по риску кибербезопасности в рамках своей системы оценки готовности (Preparedness Framework). Эта классификация, по словам компании, влечет за собой дополнительные ограничения на развертывание.
«GPT‑6 Astra сегодня развертывается для ограниченного круга организаций и в ближайшие дни станет доступна всем пользователям ChatGPT Plus, Pro, Business и Enterprise, а также через OpenAI API и AWS», — говорится в заявлении OpenAI.
По данным компании, администраторы корпоративных клиентов должны вручную активировать Astra для своих рабочих пространств, поскольку при запуске доступ по умолчанию отключен.
Разработчики могут получить доступ к Astra через API под названием gpt-6-astra или через Amazon Bedrock. Стоимость составляет 10 долларов за миллион входных токенов и 50 долларов за миллион выходных токенов. Пользователи Pro, Business и Enterprise также получат вариант под названием Astra Pro. Компания заявила, что Astra поддерживает функцию Zero Data Retention для соответствующих клиентов API.
Компания заявляет об идеальном результате в тесте на уязвимости
OpenAI сообщила, что тестировала Astra без производственных защитных мер на платформе ExploitBench, и модель показала результат 100%, что выше показателя 78,5% у предшественника GPT-5.6 Sol. На ExploitGym, более широком бенчмарке для разработки эксплойтов, Astra достигла 42,4% успешных атак по сравнению с 30,3% у Sol, при этом используя меньше выходных токенов.
«Ее способность выявлять и разрабатывать эксплойты нулевого дня может помочь защитникам находить и устранять уязвимости, но это также требует более надежных мер безопасности», — говорится в сообщении OpenAI.
OpenAI также протестировала Astra на уязвимостях, обнаруженных за три месяца до запуска, чтобы проверить, сможет ли модель самостоятельно находить недостатки, а не просто извлекать старые эксплойты из обучающих данных. В ходе этого теста модель обнаружила две новые уязвимости нулевого дня, которые OpenAI теперь раскрывает соответствующим разработчикам программного обеспечения.
Санчит Вир Гогия, главный аналитик Greyhound Research, назвал маркировку «Критический» событием раскрытия информации, а не событием, связанным с возможностями.
«Возможности Astra не изменились между 10 августа, когда OpenAI заявила, что нельзя исключать критические возможности, и 1 сентября, когда было заявлено о достижении этого порога», — отметил Гогия. «Изменилось тестирование. Модель — нет».
По его словам, это переворачивает очевидную реакцию предприятий.
«Astra теперь является единственной передовой моделью, чьи кибервозможности предприятия действительно знают, поскольку она единственная измеряется по опубликованному порогу, в то время как каждая немаркированная модель, уже используемая корпоративными клиентами, никогда не измерялась таким образом и не будет измеряться до тех пор, пока ее поставщик не решит ее измерить», — подчеркнул Гогия. «Эти модели не безопаснее».
OpenAI заявила, что общедоступная версия Astra будет отказываться от выполнения сложных наступательных задач, таких как генерация эксплойтов для доказательства концепции, хотя в ближайшие недели планируется ослабить эти ограничения для проверенных защитников в рамках программы OpenAI Daybreak.
Запуск последовал за выпуском GPT-5.6 Sol от OpenAI, которая, по словам компании, показала 73,5% на ExploitBench при запуске, и произошел через несколько месяцев после того, как модели Fable и Mythos от Anthropic были временно сняты с экспортных рынков из-за аналогичных опасений.
Управление смещается от модели к системе вокруг нее
Гогия отметил, что более значительный сдвиг заключается в том, что рассуждения теперь переводятся в изменение состояния, поскольку неправильный ответ чат-бота является информационной проблемой, а неправильное действие агента в системе записей клиентов — операционным событием.
«Следовательно, единица управления смещается с модели», — сказал он, утверждая, что актуальным вопросом является уже не то, какая модель одобрена, а то, какой ущерб может нанести определенная личность до вмешательства контроля.
Амит Кумар Джена, руководитель отдела разработки ИИ в Kanerika, назвал проблему видимости конкретной: когда агент действует через пользовательский интерфейс, системы записей регистрируют действие как действие человека. Таким образом, агент, обновляющий 400 строк ERP, отображается как учетная запись службы, выполняющая 400 обновлений, без записи о том, какая инструкция или версия модели их произвела.
«Вы теряете детализацию внутри конкретной системы, которую регулятор или аудитор захочет увидеть», — добавил Джена.
OpenAI заявила, что разработала новую оценку, основанную на инциденте с участием Hugging Face, чтобы проверить, выходит ли модель, получившая невыполнимую задачу, за пределы разрешенной области.
«По сравнению с GPT‑5.6 Sol, которая без производственных защитных мер превышала авторизованную цель в 48% случаев, GPT‑6 Astra сделала это в 0% случаев», — добавлено в заявлении.
Гогия отметил, что более тревожным выводом является то, что Astra ведет себя лучше и хуже наблюдает: OpenAI сообщает о снижении мониторинга цепочки рассуждений по сравнению с Sol, при этом Astra менее склонна раскрывать компрометирующие рассуждения, а ее мониторинг охватывает внешнее развертывание самой OpenAI, но ничего опубликованного не распространяет эту телеметрию на клиентов. «То, что OpenAI может отслеживать Astra, не означает, что предприятие может аудировать Astra», — сказал Гогия.
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Gyana Swain




