OpenAI будет по умолчанию ставить водяные знаки на ответы ChatGPT, но только в ЕС

Openai Chatgpt ии маркировка ес безопасность arstechnica.com

OpenAI внедряет водяные знаки для текста ChatGPT в ЕС. Узнайте, как это работает и насколько надежна защита.

Компания OpenAI объявила, что начнет автоматически ставить водяные знаки на текст, сгенерированный с помощью ChatGPT, в Европейском союзе. Эта функция также будет доступна в других регионах, но по умолчанию будет отключена за пределами ЕС.

Решение ввести водяные знаки в Европе продиктовано необходимостью соблюдения Закона ЕС об искусственном интеллекте, который вступил в силу в августе. Он требует маркировать контент, созданный моделями ИИ, таким образом, чтобы его мог обнаружить другой инструмент. К сожалению, пока не существует полностью эффективного и надежного способа сделать это. Уже существуют некоторые стандарты, такие как SynthID и проект C2PA, но их относительно легко обойти любому, кто обладает базовыми знаниями.

То же самое, вероятно, относится и к водяным знакам OpenAI. Их метод является проприетарным; компания называет его textGrain и опубликовала технический документ, объясняющий, как он работает. Но в целом он работает так же, как и другие инструменты для маркировки текста, генерируемого большими языковыми моделями, которые мы видели в прошлом: он вносит закономерности в выбор слов, которые не очевидны для человеческого читателя и не влияют существенно на общее качество вывода, но которые специалист с ключом может обнаружить с помощью специализированного детектора. OpenAI заявляет, что предоставит доступ к детектору ограниченному кругу исследователей и организаций, а также внедрит процесс запроса на одобрение для других участников со временем.

,

Хотя в лучшем случае тесты OpenAI показывают уважительный, но не полностью надежный 92-процентный уровень успешного обнаружения textGrain, тесты компании также демонстрируют, что изменение всего 10 процентов текста в выводе снижает уровень успешного обнаружения почти на 30 процентов, а изменение 20 процентов текста может снизить уровень успеха почти на 75 процентов. (Также стоит отметить, что в целом уровень успеха ниже для короткого или переведенного текста, чем для длинного.) Все это примерно соответствует тому, что мы видели с другими подобными решениями для маркировки текста в прошлом.

В августе конкурент OpenAI компания Anthropic также представила маркировку текста, генерируемого ее моделями, но Anthropic включила ее глобально, в то время как OpenAI в настоящее время делает ее стандартной только там, где это требуется регулирующими органами — по крайней мере, в приложениях ChatGPT и Codex. Похоже, что в API она останется отключенной, но будет доступна опционально.

Новая функция маркировки будет развернута для пользователей в ЕС «в ближайшие недели», сообщает компания.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

В тренде:


Похожие новости: