Anthropic представила Fable 5 класса «Mythos» с защитой от киберугроз

Anthropic ии Claude Fable 5 Mythos кибербезопасность csoonline.com

Anthropic представила две новые мощные модели ИИ на базе архитектуры Mythos: Claude Fable 5, которая становится общедоступной, и Claude Mythos 5, ограниченную для партнеров. Fable 5 — самая производительная модель компании, превосходящая предшественников в разработке ПО и научных задачах. — csoonline.com

Anthropic представила две новые мощные модели ИИ, созданные на базе ранее ограниченной архитектуры Mythos: Claude Fable 5, которая становится общедоступной, и Claude Mythos 5, доступ к которой по-прежнему ограничен небольшой группой партнеров в области кибербезопасности и инфраструктуры.

Anthropic описывает Fable 5 как самую производительную модель, когда-либо выпущенную для общественности, превосходящую предыдущие модели Claude в задачах, связанных с разработкой программного обеспечения, научными исследованиями, зрением и сложной интеллектуальной работой. По заявлению Anthropic, преимущество модели возрастает по мере усложнения и удлинения задач, что позволяет пользователям поручать системе более крупные проекты с меньшим контролем и меньшим количеством подробных инструкций.

По словам Дайан Пенн, руководителя отдела управления продуктами, исследований и лабораторий Anthropic, целью было сделать интеллект уровня Mythos общедоступным без подвергания пользователей рискам, которые ранее ограничивали использование этой технологии. «Мы хотели иметь возможность безопасно предоставить этот уровень интеллекта обычным пользователям», — заявила Пенн The Wall Street Journal.

Меры защиты могут быть шире, чем предполагает Anthropic

Когда Anthropic выпустила Mythos в апреле, компания утверждала, что возможности модели в таких областях, как обнаружение уязвимостей и наступательная кибербезопасность, создают риски, оправдывающие ограничение доступа примерно для 50 получателей. Всего неделю назад Anthropic объявила о расширении доступа к Mythos для 150 организаций.

Теперь Anthropic заявляет, что разработала достаточно надежные меры защиты для более широкого выпуска. Эти меры работают путем перенаправления определенных категорий запросов — включая запросы, связанные с кибербезопасностью, биологией, химией и дистилляцией моделей, — на менее производительную Claude Opus 4.8. Anthropic утверждает, что такие резервные переключения происходят менее чем в 5% сессий, что означает, что большинство пользователей будут фактически взаимодействовать с полнофункциональной моделью класса Mythos при обычном использовании.

Первоначальное тестирование, проведенное исследователями безопасности, предполагает, что меры защиты в области кибербезопасности могут быть шире, чем подразумевает описание Anthropic. Роб Т. Ли, директор по ИИ и руководитель отдела исследований в SANS Institute, сообщил CSO, что его рутинные задачи по кибербезопасности, связанные с реагированием на инциденты, обнаружением и базовыми процедурами судебной экспертизы, были автоматически перенаправлены с Fable 5 на Opus 4.8 во время его первоначального тестирования. Если эти наблюдения подтвердятся в ходе более широкого тестирования, это может указывать на то, что классификаторы Anthropic широко идентифицируют запросы, связанные с кибербезопасностью, вместо того чтобы пытаться различать добронамеренную и вредоносную кибер-активность.

Компания описывает меры защиты как намеренно консервативные. Пользователи могут иногда сталкиваться с ложными срабатываниями, когда добронамеренные запросы перенаправляются на Opus 4.8, но Anthropic заявляет, что предпочла безопасность удобству, пока продолжает совершенствовать систему.

Значительная часть последнего объявления Anthropic посвящена объяснению, почему компания считает эти меры защиты необходимыми. Компания утверждает, что системы класса Mythos пересекли порог, когда они могут оказать существенную помощь злоумышленникам. В отличие от ранних систем ИИ, которые в основном предоставляли информацию, Anthropic заявляет, что передовые модели все чаще способны выполнять части сложных рабочих процессов, включая действия, связанные с наступательными операциями в области кибербезопасности.

Для устранения этих рисков Anthropic разработала серию классификаторов на базе ИИ, предназначенных для выявления потенциально опасных запросов. Если система обнаруживает запрос, связанный с наступательными кибероперациями, передовыми биологическими исследованиями, химическими рисками или попытками извлечь возможности модели для использования в конкурирующих системах, запрос перенаправляется на Opus 4.8. Anthropic заявляет, что обширное внутреннее и внешнее тестирование не выявило широко эффективных методов обхода защиты (jailbreaks), которые могли бы последовательно обходить эти меры.

Anthropic заявляет о прогрессе в кодировании, анализе и автономной работе

Анонс Fable 5 также фокусируется на разработке программного обеспечения, где Anthropic считает достижения модели особенно значительными. Например, во время тестирования Stripe, по сообщениям, использовала Fable 5 для завершения миграции в репозитории Ruby объемом 50 миллионов строк кода за один день — задача, на которую, по оценкам компании, потребовалось бы более двух месяцев инженерной работы при ручном выполнении.

Anthropic также заявляет, что модель достигла передовых результатов в оценках кодирования, которые измеряют не только работоспособность программного обеспечения, но и его соответствие стандартам, ожидаемым в производственных средах.

Компания также отметила успехи в финансовом анализе, логическом анализе документов, интерпретации диаграмм и задачах, связанных со зрением. Anthropic заявляет, что Fable 5 может точно извлекать информацию из сложных научных данных и выполнять сложные задачи визуального анализа, включая восстановление исходного кода веб-приложения по скриншотам.

Расширенный доступ для защитников киберпространства

Для избранной группы пользователей Anthropic также представляет Claude Mythos 5. Эта модель идентична Fable 5, но с удаленными некоторыми мерами защиты. В рамках проекта Glasswing организации по кибербезопасности и поставщики критической инфраструктуры получат доступ к версии системы с отключенными ограничениями, связанными с кибербезопасностью, — Anthropic планирует постепенно расширять доступ через более широкую программу доверенного доступа, разработанную в консультации с правительством США.

Компания заявляет, что Mythos 5 обладает тем, что она называет самыми сильными возможностями в области кибербезопасности среди всех доступных на данный момент моделей. Anthropic ранее подчеркивала способность систем класса Mythos обнаруживать уязвимости программного обеспечения, помогать в разработке эксплойтов и выполнять сложные многоэтапные задачи по кибербезопасности. Именно эти возможности побудили компанию ограничить доступ к ранним версиям технологии.

Этот шаг отражает общую тенденцию в индустрии ИИ, поскольку поставщики ищут способы коммерциализации все более мощных систем, не делая их наиболее опасные возможности широко доступными. Разработчики ИИ в течение последнего года решали проблему того, как развертывать модели, чьи возможности могут принести существенную пользу защитникам, исследователям и предприятиям, но в то же время создавать возможности для неправомерного использования.

ИИ не заменяет основы

Для руководителей служб безопасности это объявление поднимает важные вопросы о том, как быстро организации могут адаптироваться к все более производительным системам ИИ. Задача теперь заключается не просто в получении доступа к передовым моделям, а в их интеграции в операции по обеспечению безопасности таким образом, чтобы это приносило измеримую пользу.

Вопрос о том, насколько хорошо откалиброваны меры защиты, имеет значение не только для отдельных рабочих процессов — он затрагивает суть того, могут ли организации эффективно применять эти модели на практике. Энтони Гриеко, старший вице-президент и директор по безопасности и доверию Cisco, заявил, что организациям следует сосредоточиться не только на получении доступа к все более мощным моделям, но и на их эффективном развертывании при сохранении надежных основ безопасности.

«Темпы развития передового ИИ меняют ландшафт безопасности в режиме реального времени, и защитники не могут позволить себе ждать, пока уляжется пыль», — сказал Гриеко в заявлении, отправленном в CSO. «Будь то модель Claude Mythos 5, Claude Fable 5, GPT-5.5-Cyber или следующий прорыв, проблема заключается уже не просто в доступе к передовому ИИ, а в том, как организации внедряют его с правильной системой сдерживания, инфраструктурой и агентной логикой, чтобы превратить скорость в ясность и действие».

В то же время Гриеко предостерег от рассмотрения ИИ как замены основным методам обеспечения безопасности.

«ИИ поднимет потолок того, что могут делать защитники, но устойчивость безопасности остается фундаментом, от которого зависит, превратятся ли эти достижения в реальную защиту», — сказал он. Даже по мере того, как модели ИИ ускоряют разработку ПО, анализ и операции по обеспечению безопасности, организациям по-прежнему необходимо выполнять базовые задачи, такие как установка исправлений, многофакторная аутентификация, сегментация сети и архитектуры нулевого доверия.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

В тренде:


Похожие новости: