Новости: claude opus
ИИ решил 56% многонедельных задач по программированию в новом бенчмарке MirrorCode
Бенчмарк автономного кодирования ИИ MirrorCode показывает, что Claude Opus 4.7 решает 56% программных проектов, на которые, по оценкам, у инженеров-людей ушли бы недели, — на самой сложной задаче модель работала непрерывно 19 дней. Полные результаты Epoch AI и METR выявляют успехи передовых моделей и архитектурные пределы.

Shannon Lite v1.2.0 на базе Claude Opus 4.7: новые меры кибербезопасности Anthropic требуют от пентестеров предварительной регистрации перед сканированием
Shannon Lite, автономный инструмент для тестирования на проникновение с белым ящиком от Keygraph, выпустил версию 1.2.0 с обновлением модели до Claude Opus 4.7. Это требует регистрации в программе верификации Anthropic из-за новых мер безопасности. — techtimes.com

Anthropic запускает новую модель, которая выявляет «zero days» и заставляет трейдеров с Wall Street сходить с ума
Opus 4.6 прибыл. Anthropic представила новую модель Claude Opus 4.6, усовершенствованную для кодирования, поиска уязвимостей и других рабочих задач, что влияет на фондовый рынок. — gizmodo.com

Самое просматриваемое:
- Вот как использовать новую кнопку “Плюс”…
- Bitcoin Depot оштрафован на $18,5 млн – сталкивается…
- WatchGuard бьёт тревогу: критическая уязвимость…
- Как настроить ComfyUI для генерации изображений ИИ…
- ECARX берет управление бизнесом Flyme OS в свои руки…
- Результаты еженедельного опроса: Samsung Galaxy Z…
- Исследователи из MIT возродили 40-летнюю концепцию…
- США прикрыли платформу для хранения паролей, которой…
- Представитель сервисного центра Google сообщил…
- Тим Суини из Epic: «нечестность» и «грубое…


