Astra ужесточает правила безопасности в рамках «Подготовительного регламента» OpenAI. Этот регламент требует осторожности при разработке передовых возможностей ИИ, которые создают риски серьезного вреда, а раздел, посвященный кибербезопасности, гласит, что OpenAI внедрит дополнительные меры защиты для моделей, «создающих новые риски масштабных кибератак и эксплуатации уязвимостей».
«Критический» порог, которого могла достичь Astra, определяется способностью без вмешательства человека выявлять и разрабатывать функциональные эксплойты zero-day любого уровня серьезности во многих защищенных реальных критических системах, а также разрабатывать и реализовывать полные новые стратегии кибератак.
OpenAI заявляет, что перед развертыванием Astra усиливает меры защиты и контроля безопасности, в том числе ограничивает работу над моделью до внедрения новых средств защиты. Компания планирует использовать изолированные тестовые среды с ограниченным доступом к сети и инструментам, а также добавить изолированное выполнение и расширенные возможности мониторинга. OpenAI сообщает, что будет тестировать Astra совместно с соответствующими государственными органами и организациями по безопасности ИИ.
«Мы стремимся работать рука об руку с правительствами, институтами безопасности и гражданским обществом, чтобы передовые возможности таких моделей, как Astra, и тех, что появятся в будущем, развертывались ответственно и широко на благо всего человечества», — пишет OpenAI.
Официального анонса Astra не было, но OpenAI поделился подробностями о своей следующей крупной модели в недавнем посте, посвященном математическим достижениям. Astra решила 10 открытых задач в области математики и теоретической информатики примерно за 2000 долларов (по тарифам Sol API).
Достижения в области ИИ меняют кибербезопасность для крупных технологических компаний, таких как Apple, выявляя беспрецедентное количество ошибок. Apple недавно ограничила прием заявок в свою программу вознаграждений за найденные ошибки, поскольку не справляется с их объемом.
Такие модели, как Claude Mythos, способны выявлять критические уязвимости, и Apple является одним из партнеров Anthropic по Mythos. Mythos доступна только избранным компаниям, потому что, помимо поиска уязвимостей, она потенциально может их эксплуатировать.
OpenAI попала в заголовки новостей в июле из-за того, что GPT–5.6 Sol и «более производительная предрелизная модель» (не Astra) самостоятельно взломали Hugging Face во время внутреннего бенчмаркингового тестирования. Anthropic обнаружила, что Claude сделал нечто подобное. На этой неделе Meta также сообщила о взломе другой компании своей моделью ИИ в ходе оценки кибербезопасности.
Facebook*, Instagram* и WhatsApp* принадлежат компании Meta* Platforms Inc., деятельность которой признана экстремистской и запрещена на территории Российской Федерации.
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Juli Clover




