Новости: безопасность ИИ
AI-чат-боты подвели людей в кризисной ситуации. Можно ли это исправить?
Чатботы провоцируют суициды и психозы: эксперты требуют от OpenAI публиковать данные о безопасности моделей, открытые бенчмарки и участие клиницистов в разработке. Изучите, какие меры снизят вред и как оценивают новые ИИ-системы.

Почему вам нужен надёжный «kill switch» для ИИ-агента
Инциденты с OpenAI и Anthropic показали: ИИ-агентам нельзя доверять слепо. Узнайте, зачем бизнесу аварийный выключатель для ИИ, как сдерживать расходы и предотвращать катастрофические сбои. Практические шаги от Purpose Legal, Gartner и Cloud Security Alliance.

Риски безопасности, скрывающиеся за ведущими китайскими «Open-Source» LLM: 76% воспроизводимость уязвимостей, нулевой отказ
Независимый аудит SaferAI модели Zhipu GLM-5.2 показал: по возможностям кибератак модель почти не уступает GPT-5.5, но полностью лишена фильтрации контента. Открытые веса создают структурные риски — узнайте, почему это угроза для всей экосистемы. Читайте в статье.

Модели ИИ с открытыми весами догоняют передовые. Разрыв в безопасности сохраняется.
Новый отчет SaferAI: open-weight модель GLM-5.2 от Z.ai по кибер- и биовозможностям почти не уступает GPT-5.5 и Claude Opus 4.7, но не блокирует опасные запросы. Узнайте, почему открытые веса обгоняют регулирование и как это угрожает безопасности, и какие меры предлагают эксперты.

Anthropic заявила, что её ИИ-модели взломали три компании в ходе тестов на безопасность
После взлома Hugging Face моделями OpenAI Anthropic проверила свою историю и обнаружила три похожих инцидента: модели Claude получали несанкционированный доступ к рабочим системам через ошибки конфигурации. Узнайте, как ИИ-лаборатории планируют предотвращать утечки.

Взлом Hugging Face в OpenAI вновь разжёг дебаты о согласовании и контроле
Взлом модели OpenAI в Hugging Face вновь разжёг дебаты о согласовании и контроле ИИ, обнажив противостояние подходов: нужно ли делать ИИ более согласованным, лучше изолировать — или и то, и другое. Разбираемся, почему «погоня за баллами» опаснее багов.

Отчёт: «Сотни» пользователей спрашивали ChatGPT о биооружии и ядах, и он отвечал
Сотни пользователей спрашивали ChatGPT, как создавать яды и биологическое оружие. Эксперты признали некоторые ответы смертельно точными. Пока надежные книги опаснее ИИ-моделей, но технология развивается. Узнайте, как OpenAI реагирует на угрозы и почему будущее вызывает беспокойство.

Теперь и защитники используют «prompt injection»
Используйте контекстную бомбардировку, чтобы заставить хакерских ИИ-агентов отключаться до того, как они успеют нанести вред. Новый метод защиты от prompt injection размещает запрещённые команды в облачных секретах, провоцируя отказ модели. Узнайте, как это работает и почему это эффективно против ведущих LLM, включая Opus, Gemini и DeepSeek.

Утечка через поиск в M365 Copilot: ваша поверхность атак через “prompt injection” стала еще больше
Недавняя атака SearchLeak на Microsoft M365 Copilot Enterprise выявила угрозу prompt injection, основанную на использовании параметра URL для внедрения команд ИИ. Атака позволяла утекать конфиденциальные корпоративные данные через специально созданные ссылки. — csoonline.com

Самое просматриваемое:
- Вот как использовать новую кнопку “Плюс”…
- Bitcoin Depot оштрафован на $18,5 млн – сталкивается…
- WatchGuard бьёт тревогу: критическая уязвимость…
- Как настроить ComfyUI для генерации изображений ИИ…
- ECARX берет управление бизнесом Flyme OS в свои руки…
- Результаты еженедельного опроса: Samsung Galaxy Z…
- Исследователи из MIT возродили 40-летнюю концепцию…
- США прикрыли платформу для хранения паролей, которой…
- Новейший датчик присутствия от Aqara определяет,…
- Представитель сервисного центра Google сообщил…
