Anthropic запускает Opus 5

Anthropic Claude Opus 5 ии бенчмарки безопасность Api techcrunch.com

Anthropic выпускает Claude Opus 5: мощнее, дешевле и с меньшим числом ограничений, чем Fable 5. Новая модель превосходит предшественника в бенчмарках, не подпадает под 30-дневную политику хранения данных и получает функцию Automatic Fallbacks для снижения числа сбоев при срабатывании фильтров безопасности.

Примечательно, что Opus 5 на самом деле превосходит Fable 5 по ряду бенчмарков, включенных в анонс.

Opus 5 выходит всего через два месяца после Opus 4.8, который стал доступен 28 мая. Mythos 5, Fable 5 и Sonnet 5 вышли в июне, и только легковесная модель Haiku все еще ожидает обновления до серии 5.

В посте, анонсирующем новую модель, Anthropic подчеркнул, что Opus 5 «гораздо лучше проверяет свою работу и тщательно итерирует до достижения успеха», сославшись на тестирование в бенчмарках, где Opus 5 написал собственный пайплайн компьютерного зрения в ответ на неполный промпт, среди прочих примеров.

Ключевой момент: Opus 5 также свободен от многих ограничений, которые преследовали Fable с момента его выхода. Как и его предшественник, Opus 5 не подпадает под 30-дневную политику хранения данных, которая распространяется на Fable и Mythos и вызывала опасения у некоторых пользователей, заботящихся о конфиденциальности.

На Opus по-прежнему действуют значимые меры защиты, особенно в отношении задач кибербезопасности, таких как генерация эксплойтов и тестирование на проникновение. Например, средства защиты Opus 5 не позволяют использовать его для сканирования уязвимостей в бинарном файле, хотя ему разрешено искать уязвимости в исходном коде, поскольку последняя задача чаще используется в оборонительных целях.

В целом, Anthropic ожидает, что эти классификаторы будут срабатывать для Opus 5 на 85% реже, чем для Fable 5, что отражает более мягкий подход к менее мощной модели.

Anthropic также внедряет новый инструмент, чтобы сделать средства защиты менее разрушительными, когда они все же срабатывают. Пользователи теперь могут включить бета-функцию под названием Automatic Fallbacks, которая будет автоматически направлять запросы к менее мощной модели, когда промпт активирует классификатор безопасности. В результате пользователи API с включенной настройкой получат функциональный ответ вместо сообщения об ошибке.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

Похожие новости: