Правила ЕС об искусственном интеллекте в отношении прозрачности, вступившие в силу 2 августа, обязывают компании, занимающиеся разработкой ИИ, помечать контент, сгенерированный ИИ, таким образом, чтобы другие системы могли его идентифицировать.
OpenAI заявила, что водяной знак будет внедряться в течение следующих нескольких недель для пользователей ChatGPT и Codex, имеющих право на участие, во всех тарифных планах, но только в ЕС. Разработчики, использующие API OpenAI в любой точке мира, могут включить его для выбранных моделей начиная с сегодняшнего дня; по умолчанию он отключен. OpenAI заявила, что не делает текстовые водяные знаки глобальным параметром по умолчанию при запуске.
Водяной знак не является фактическим символом, а работает путем тонкой настройки выбора слов моделью, оставляя узор, который читатели не могут увидеть, но который может обнаружить детектор. Поскольку он находится в самих словах, он перемещается вместе с текстом при его копировании и вставке. OpenAI заявила, что водяной знак не идентифицирует пользователя и что она не заметила существенных изменений в производительности своих моделей при его включении.
Вместе с анонсом OpenAI также опубликовала технический отчет о своем методе под названием textGrain. В нем, написанном совместно с исследователями из Пенсильванского университета и Йельского университета, приводится пример использования секретного ключа для сортировки предсказаний следующего слова для завершения предложения. Добавьте сотни таких подсказок, и детектор сможет обнаружить контент, сгенерированный ИИ, используя только текст и ключ.
Можно ли удалить водяной знак путем редактирования? Тесты OpenAI предполагают, что да. В одном из тестов замена 10% слов синонимами снизила уровень обнаружения примерно с 92% до 66%. Компания также заявила, что короткие отрывки, математические ответы и переведенный текст труднее обнаружить.

«Эти ограничения способствуют нашему решению предоставлять первоначальный доступ к детектору только одобренным исследователям и экспертным организациям, которые могут помочь нам оценить надежность и ответственное использование», — заявила компания.
OpenAI также предупредила, что отсутствие водяного знака «не доказывает авторство человека». Текст может быть слишком коротким или слишком сильно отредактированным, или он может исходить от ИИ другой компании.
«[Водяные знаки] могут указывать на то, что система OpenAI сгенерировала или обработала часть отрывка, но не на то, сколько человеческого суждения, редактирования или творчества было вложено в него», — заявила компания.
Анонс последовал через два месяца после того, как Anthropic заявила, что будет ставить водяные знаки на текст, генерируемый Claude, что она применяет по всему миру. Это решение вызвало негативную реакцию некоторых пользователей Claude, которые утверждали, что они предоставили «инструкции, контекст, решения», в то время как Claude был просто «инструментом».
OpenAI ранее создавала текстовый водяной знак, но отложила его выпуск, отчасти из-за опасений, что пользователи перейдут к конкурентам, которые не используют водяные знаки, как сообщала The Wall Street Journal в 2024 году.
Anthropic, Google, *Meta, Microsoft и OpenAI входят в число компаний, которые обязались соблюдать кодекс практики ЕС в отношении контента, сгенерированного ИИ.
*Facebook, *Instagram и *WhatsApp принадлежат компании *Meta Platforms Inc., деятельность которой признана экстремистской и запрещена на территории Российской Федерации.
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Aditya Mehta




