Специалисты по кибербезопасности недовольны «ограничителями» в модели Fable от Anthropic

Fable Anthropic кибербезопасность ии ограничения Mythos techcrunch.com

Специалисты по кибербезопасности жалуются, что у новой модели Anthropic Fable слишком строгие защитные механизмы для любой работы в сфере кибербезопасности. — techcrunch.com

Однако не все довольны ограничениями, и рядспециалистов по кибербезопасности и профессионаловвыразилижалобы в сети. 

«[Fable] отклоняет любой запрос, который может быть хоть как-то связан с кибербезопасностью. Даже безобидные задачи, вроде чтения статьи в блоге», — < заявила Валентина «Чомпи» Пальмиотти, известный исследователь в области безопасности, работающий в IBM X-Force. 

Когда запрос активирует защитные механизмы, Fable приостанавливает чат и сообщает, что его «меры безопасности пометили это сообщение как относящееся к темам кибербезопасности или биологии».

Эти защитные механизмы были введены для снижения риска того, что Fable может быть использован для разработки вредоносного ПО или компрометации программного обеспечения — < это давняя обеспокоенность в Anthropic. Ограничения, касающиеся биологии, проистекают из аналогичной озабоченности по поводу < разработки биологического оружия.

Когда < гигант в сфере ИИ выпустил Mythos в апреле, он ограничил доступ к модели небольшим числом компаний и организаций в рамках того, что компания назвала < Project Glasswing — инициативы по развертыванию модели для защиты критически важного программного обеспечения и инфраструктуры. На прошлой неделе < Anthropic расширила доступ к Mythos для сотен организаций в 15 странах. 

Но, несмотря на благие намерения, многих экспертов по кибербезопасности по-прежнему отталкивает хаотичный характер ограничений. Мэтт Суиче, ветеран кибербезопасности, сообщил TechCrunch, что «если вы попросите его написать безопасный код, он решит, что это работа по кибербезопасности, а не лучшие практики разработки ПО, и вы получите понижение рейтинга». Fable запрограммирован переключаться на Claude Opus 4.8, если срабатывает защитный механизм. «Похоже, это основано на ключевых словах, так что любое слово из лексического поля „кибербезопасность“ активирует защитные механизмы».

<“>

«Но это объяснимо, поскольку мы все еще находимся на ранних этапах, и они все еще настраивают свои защитные механизмы. Я уверен, что со временем они будут развиваться по мере того, как Anthropic и другие компании, разрабатывающие передовые модели, будут больше сотрудничать с нынешним новым поколением компаний в сфере кибербезопасности», — сказал Суиче, который входит в технический штат Tolmo, стартапа в области ИИ-кибербезопасности. «Лучше затронуть слишком многих, чем недостаточно, когда делаешь такой релиз, и ослаблять защитные механизмы со временем».

Другой исследователь < пожаловался в X, что «даже запрос на обзор кода» активирует защитные механизмы Fable. 

Anthropic не сразу ответила на запрос о комментарии.

Помимо встроенных в модели защитных механизмов, Anthropic требует, чтобы специалисты по кибербезопасности подавали заявки на участие в < Программе киберверификации (Cyber Verification Program). В случае одобрения заявители получают меньше ограничений на использование Claude для работы в сфере кибербезопасности. У OpenAI есть аналогичная программа под названием < Trusted Access for Cyber.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

Похожие новости: