Компании выражают обеспокоенность по поводу использования проприетарных данных для обучения моделей ИИ компаниями Anthropic и OpenAI. Некоторые клиенты настолько обеспокоены, что начали требовать гарантий обработки своих данных или даже ввели ограничения на использование определенных моделей и задач для своих сотрудников, сообщает The Information. Они опасаются, что модели могут обучаться на их интеллектуальной собственности и информации.
Проблема восходит к июньскому изменению политики Anthropic. После изменения политики в отношении флагманской модели Fable, Anthropic теперь может сохранять данные клиентов. Компания утверждает, что делает это только для того, чтобы убедиться, что Fable не используется злонамеренно. Однако некоторые компании выразили обеспокоенность тем, что это означает, что конфиденциальные бизнес-данные будут включены в этот сбор.
Хотя и OpenAI, и Anthropic указывают, что по умолчанию не обучают свои модели на информации, предоставленной им компаниями по корпоративным контрактам, это не вся история. Обе компании собирают метаданные от тех же корпоративных клиентов, и хотя получить точную информацию о содержании этих метаданных сложно, OpenAI отмечает, что они используются только «для лучшего понимания того, как используются наши услуги». Anthropic также утверждает, что любые собранные ею данные об использовании продуктов клиентами агрегируются и анонимизируются. И эти метаданные не используются для обучения моделей.
Тем не менее, сохраняются опасения по поводу предполагаемого отсутствия ясности в отношении того, что собирается. Телекоммуникационная компания C Spire имеет соглашения как с OpenAI, так и с Anthropic, которые запрещают им использовать ее данные для обучения моделей, говорится в отчете.
Однако контракты позволяют как OpenAI, так и Anthropic собирать технические данные об использовании C Spire. C Spire считает, что это включает информацию о том, к каким приложениям подключены модели ИИ, а также данные об использовании. Компания также обеспокоена тем, что ИИ-компании могут собирать информацию о том, что делают их модели между генерацией ответов.
Со своей стороны, OpenAI заявляет, что не использует эти данные «цепочки рассуждений» для обучения своих моделей. Но C Spire по-прежнему считает, что ей необходимо лучше понимать, какие данные собираются, добавляет отчет. Компания утверждает, что ни одна из ИИ-компаний не дает четких объяснений.
Одним из решений проблем конфиденциальности может быть использование изолированных серверов (air-gapped servers), на что уже пошла аэрокосмическая компания Northrop Grumman. The Information сообщает, что компания запускает модели ИИ с открытым исходным кодом на собственных изолированных серверах, вместо того чтобы полагаться на OpenAI и Anthropic.
В качестве альтернативы Microsoft уже пытается воспользоваться любыми опасениями по поводу конфиденциальности данных, привлекая клиентов OpenAI и Anthropic к своим собственным безопасным платформам ИИ. Изолированные облачные среды Microsoft запускают модели ИИ на частных серверах, которые не отправляют никаких данных внешним ИИ-компаниям. Но этот подход дорогостоящ, и в отчете отмечается, что по крайней мере один клиент все еще рассматривает альтернативный подход Microsoft.
Фармацевтическая компания Novo Nordisk применила несколько иной подход. Хотя она продолжает использовать Claude от Anthropic для некоторых задач, она запретила использование любых проприетарных данных моделью.
Очевидно, что отсутствие доверия может стоить ИИ-компаниям реальных денег, и в одном случае это уже произошло. Тот же отчет отмечает, что крупная американская энергетическая компания уже отказалась от планов тестирования Fable от Anthropic. Энергетическая компания хотела узнать, сможет ли Fable управлять ее основной энергетической инфраструктурой, но в конечном итоге отказалась от этого из-за отказа Anthropic согласиться на безотзывную политику нулевого хранения данных (ZDR).
Nvidia также решила использовать Fable для задач, которые не требуют доступа к конфиденциальным данным. Компания указывает на то же отсутствие гарантий ZDR как на причину. Вместо этого Nvidia использует собственное внутреннее решение ИИ для задач, которые она считает слишком конфиденциальными для модели Anthropic. Генеральный директор Nvidia Дженсен Хуанг знаменито заметил, что его сотрудники должны использовать токены ИИ стоимостью в половину своей годовой зарплаты каждый год, чтобы быть полностью продуктивными.
Toms Hardware обратилась к Nvidia за комментарием, но не получила его к моменту публикации.
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Oliver Haslam




