Уловив возможность обойти своего конкурента Anthropic, OpenAI только что анонсировала ориентированный на конфиденциальность подход к безопасности для мониторинга злоупотреблений. Компания представляет избранным клиентам новый сервис, который она называет Private Safety Processing. Это автоматизированная система, которая отслеживает потенциальные злоупотребления, одновременно не сохраняя никаких данных клиента.
Эта система явно противоречит недавно объявленной политике хранения данных Anthropic. Эта политика, которая вызвала недовольство некоторых клиентов, позволяет лаборатории ИИ хранить пользовательские данные (все их сессии и содержащиеся в них разговоры) в течение 30 дней, когда речь идет о «покрытых моделях». К таким моделям относятся все модели класса Mythos и «будущие модели с аналогичными возможностями», сообщает компания.
Эта политика, объявленная в июле, была разработана в целях безопасности, позволяя лаборатории анализировать потенциальные нарушения. Однако она вызвала серьезную обеспокоенность у некоторых предприятий, которые работают с большими объемами конфиденциальных данных и не хотят, чтобы они хранились (или проверялись) лабораторией ИИ.
OpenAI — как и большинство других компаний в сфере ИИ — уже предоставляет клиентам относительный уровень конфиденциальности, придерживаясь политики, известной как Zero Data Retention (ZDR). ZDR использует агентов в API OpenAI для мониторинга злоупотреблений в рамках каждой отдельной сессии. Таким образом, данные клиентов не сохраняются компанией, но компании по-прежнему могут сканировать подозрительную активность без участия человека. Стоит отметить, что Anthropic также в основном соблюдает ZDR — за исключением «покрытых моделей», таких как Fable.
OpenAI заявляет, что Private Safety Processing — это новая технология, расширяющая сферу действия ZDR. Она описывается как форма долгосрочного мониторинга безопасности, которая оценивает входные и выходные данные нескольких разговоров, а не только одного. Опять же, мониторинг осуществляется агентом, который в случае срабатывания фиксирует взаимодействия и анализирует их в рамках нескольких сессий на предмет признаков потенциального злоупотребления.
Новая технология помогает OpenAI выявлять злонамеренное использование ИИ, которое происходит в течение нескольких сессий, сообщил представитель компании TechCrunch. Злоумышленник — гипотетически кто-то, пытающийся создать вредоносное ПО для кибератаки, — может распределять свои запросы во времени, чтобы избежать обнаружения. Private Safety Processing может анализировать эти несколько разговоров на предмет признаков злоупотреблений без проверки разговоров пользователя человеком.
В случае срабатывания системы она может отправить «узко определенный сигнал» в OpenAI, предупреждающий о конкретном типе активности, сообщает компания. На основе этого сигнала OpenAI может решить, «необходимы ли меры принуждения», говорится в сообщении. Если да, OpenAI свяжется с клиентом для получения дополнительной информации или для совместной работы над проблемой, и клиент может по своему усмотрению решить, делиться ли данными с OpenAI, сообщил представитель.
Для сравнения, Anthropic отмечает, что проверка данных клиентов человеком может происходить, но только «через контролируемый путь доступа», который включает «небольшой набор утвержденных рецензентов». Каждый такой сеанс проверки «записывается в защищенный от несанкционированного доступа журнал, который рецензенты не могут подавить или изменить», сообщает компания.
Корпоративная конкуренция между OpenAI и Anthropic сейчас напряженная: обе компании ищут любую возможность получить преимущество друг перед другом. Недавний отчет показал, что продажи OpenAI во втором квартале росли медленнее, чем у Anthropic. Годовой темп выручки Anthropic сейчас, по сообщениям, составляет 65 миллиардов долларов. Инвесторы Anthropic заявили, что компания может провести IPO с оценкой в 2 триллиона долларов, в то время как OpenAI также работает над своим IPO.
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Lucas Ropek




