Компании, занимающиеся разработкой ИИ, не могут похвастаться безупречной репутацией в вопросах авторского права или конфиденциальности пользователей — если только они сами не оказываются в невыгодном положении, разумеется. Однако общеизвестно, что журналы чатов платформ вроде ChatGPT используются для улучшения моделей. Механизм того, *как* это происходит, до сегодняшнего дня оставался загадкой. Издание *404 Media* опубликовало отчет о процессе человеческой проверки стенограмм чатов OpenAI, объяснив, как работает этот процесс и как в нем иногда участвуют другие люди, читающие личную информацию.
Название проекта по оценке в OpenAI — Project Lily. Издание получило информацию об инструкциях к проекту, каналах Slack, реальных беседах ChatGPT и, конечно же, системе оценки для классификации разговоров. Операторы называются «prompt reviewers» (рецензенты запросов), и их работа довольно проста: они просматривают анонимизированные реальные чаты и оценивают качество ответов ChatGPT, чтобы определить, действительно ли они отвечают на вопрос, и не злоупотребляет ли текст «ИИ-речью», покровительственным тоном, эмодзи или подобострастием, среди прочих параметров. Антропоморфизация и изложение «личного» опыта исключены, что означает: если ChatGPT может сказать «Я нашел некоторую информацию», то нельзя говорить «как шеф-повар, я люблю…» или «я знаю, каково это».
Работа «очень рутинная», по словам одного из рецензентов, но при ставке более 50 долларов в час это высокая плата за то, что выглядит как относительно простая работа. Рецензент также отметил, что их инструкции постоянно меняются и часто противоречивы, что должно быть легко знакомо большинству разработчиков программного обеспечения.
Однако человек не думает, что большинство пользователей осведомлены о том, что их чаты читают другие люди, что особенно тревожно, учитывая, что многие используют ChatGPT как импровизированного друга или терапевта и доверяют боту глубокие секреты.
Хотя чаты якобы проходят анонимизацию, и рецензенты не видят имен пользователей, OpenAI признала *404 Media*, что фильтрация может пропускать некоторые личные данные, особенно в коротких чатах. Сайт отмечает, что во многих разговорах пользователь просит ChatGPT сохранить содержимое в секрете. Версия чата, переданная рецензентам, также якобы включает «сводку воспоминаний пользователя», содержащую информацию о вопросах и интересах пользователя, контексте и, возможно, даже местоположении.
Важно отметить, что Project Lily не оценивает фактическую точность чатов, кроме как отмечая очевидные ошибки, что подразумевает наличие как минимум еще одной команды (или нескольких), проводящей отдельные оценки. Аналогично, эта проверка отделена от ручных проверок безопасности, которые определяют, не пытается ли кто-то причинить вред другому человеку (или, предположительно, себе).
Существование проекта также указывает на то, что, вопреки имиджу, который пытаются создать компании, занимающиеся разработкой ИИ, модели улучшаются не только за счет технологического прогресса и лучших наборов данных — похоже, что без нескольких компетентных людей в процессе не обойтись.
К настоящему времени вы, возможно, задаетесь вопросом о настройке «разрешить нам использовать ваши чаты для улучшения нашего продукта» (перефразировано), присутствующей в большинстве клиентских чат-ботов. Эта настройка включена по умолчанию во всех ботах, которые мы можем себе представить, даже во многих платных планах. В случае с ChatGPT она по умолчанию отключена для корпоративных, бизнес- и образовательных клиентов.
Однако этот переключатель не действует ретроактивно, поэтому любые чаты, уже находящиеся в базе данных ChatGPT, останутся там, если пользователь не запросит удаление. Кроме того, такое удаление также не является ретроактивным, что означает, что удаленные чаты могли быть уже собраны и анонимизированы и, возможно, находятся в наборе данных где-то.
Хотя изначально OpenAI не дала ответа на запрос *404 Media* о том, были ли пользователи явно уведомлены о том, что их чаты могут читаться людьми, компания в конечном итоге предоставила ссылку на одну из своих страниц часто задаваемых вопросов, посвященную человеческой проверке для улучшения моделей. Мы сами убедились, что это уведомление существует как минимум два года, а возможно, и дольше. После публикации разоблачения фирма изменила свою справочную страницу, объясняющую, как люди могут отказаться от сбора данных, но в этом тексте нет упоминания о людях-операторах.
Этот тип сбора и проверки данных является общей темой для большинства поставщиков. Google Gemini четко указывает, что «люди могут просматривать некоторые сохраненные чаты» в своем Центре конфиденциальности. Позиция Anthropic аналогична: есть страница, посвященная этой теме. Между тем, позиция Perplexity неясна, поскольку ее Уведомление о конфиденциальности не подтверждает и не отрицает доступ людей к журналам чатов.
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Bruno Ferreira




