Новости: ИИ
Искусственный интеллект — рубрика о технологиях машинного обучения, нейросетях и автоматизации.
Искусственный интеллект — рубрика о технологиях машинного обучения, нейросетях и автоматизации.
CLAUDE.md от Карпатого дорос до десяти правил: новый протокол самопроверки для AI-кодинга
Циркулирует документ CLAUDE.md из десяти правил, приписываемый Андрею Карпати, добавляющий шесть правил самопроверки агента к шаблону сообщества из четырех правил. Он охватывает верификацию перед исправлением, дисциплину отладки, гигиену зависимостей и именованные режимы сбоев, которые должны распознавать циклы.

Исследование Cursor: рейтинги ИИ-бенчмарков по программированию завышены из-за использования поиска готовых ответов
Баллы в бенчмарках по кодированию с ИИ на SWE-bench Pro завышают способность к рассуждению до 20 пунктов, как показал аудит Cursor 731 прогона оценки. Исследование выявило, что 63% решенных задач самой высокорейтинговой модели были поиском ответов, а не независимым рассуждением. Команды предприятий и инвесторы, использующие таблицу лидеров

ИИ решил 56% многонедельных задач по программированию в новом бенчмарке MirrorCode
Бенчмарк автономного кодирования ИИ MirrorCode показывает, что Claude Opus 4.7 решает 56% программных проектов, на которые, по оценкам, у инженеров-людей ушли бы недели, — на самой сложной задаче модель работала непрерывно 19 дней. Полные результаты Epoch AI и METR выявляют успехи передовых моделей и архитектурные пределы.

Самое просматриваемое:
- Вот как использовать новую кнопку “Плюс”…
- Bitcoin Depot оштрафован на $18,5 млн – сталкивается…
- WatchGuard бьёт тревогу: критическая уязвимость…
- Как настроить ComfyUI для генерации изображений ИИ…
- ECARX берет управление бизнесом Flyme OS в свои руки…
- Результаты еженедельного опроса: Samsung Galaxy Z…
- Исследователи из MIT возродили 40-летнюю концепцию…
- США прикрыли платформу для хранения паролей, которой…
- Новейший датчик присутствия от Aqara определяет,…
- Представитель сервисного центра Google сообщил…






