OpenAI выпустила слабое водяное клеймо для ИИ-текстов

Openai ии водяные знаки ес закон об ии theregister.com

OpenAI внедряет водяные знаки для текста в ЕС. Узнайте, как это работает и почему это неидеально. Соблюдайте закон!

OpenAI теперь предлагает клиентам API возможность ставить водяные знаки на выходные данные определенных моделей, чтобы соответствовать букве европейского закона об ИИ. И в течение нескольких недель компания планирует применять ту или иную форму цифровых водяных знаков — нравится это или нет — к соответствующим текстовым выходным данным ChatGPT и Codex в Европейском союзе.

Но, в отличие от конкурента Anthropic, она не применяет свою технику наложения водяных знаков к контенту, созданному за пределами Европы, хотя клиенты API могут выбрать применение меток к контенту, созданному где угодно. Более того, OpenAI использует технологию, которая пропускает значительное количество случаев генерации текста с помощью ИИ и которую легко обмануть.

Закон ЕС об ИИ требует, чтобы поставщики услуг генеративного ИИ обеспечивали идентификацию выходных данных модели способом, читаемым машинами.

Anthropic стала первой крупной ИИ-компанией, объявившей о своем подходе к соблюдению закона об ИИ, который включает применение алгоритма Google SynthID-Text. Они делают это глобально.

Microsoft и *Meta работают над аналогичной технологией для ИИ, работающего с изображениями, поскольку ЕС — не единственный рынок, где люди выражали обеспокоенность по поводу происхождения контента и возможности использования сгенерированного ИИ контента для дезинформации. OpenAI уже применяет другие сигналы происхождения контента к сгенерированным ИИ изображениям, аудио и видео.

В соответствии с буквой закона об ИИ, OpenAI теперь предлагает подход к наложению текстовых водяных знаков под названием textGrain [PDF], который «добавляет невидимый статистический сигнал к выбору слов моделью. Наш детектор ищет этот сигнал, чтобы оценить, содержит ли фрагмент водяной знак OpenAI».

Большие языковые модели предсказывают словесные токены по одному из вероятностного распределения потенциальных слов. Выбирая периодически другое слово для вывода — в идеале синоним — результирующий текст отклоняется от статистического паттерна, производимого непредвзятой моделью. Детектор водяных знаков, который OpenAI предоставляет только одобренным исследователям и организациям, должен отмечать это расхождение в лексике.

Такова теория, но на практике результаты варьируются. Целевой уровень ошибок составляет один процент, но в коротких фрагментах из 200 слов детектор может отмечать только 80 процентов водяных знаков по сравнению с 95 процентами во фрагментах из 400 слов. Результаты также хуже в текстах, имеющих функциональный характер, например, в отрывках о математике или коде, поскольку замены с большей вероятностью приведут к ошибкам.

В документе textGrain не рассматривается вероятность того, что статистически измененный выбор слов может изменить смысл данного отрывка. Это возможно, если алгоритм изменит какой-либо существенный факт или цифру. Подход Anthropic, который также заменяет определенные выходные слова, используя другой алгоритм, несет аналогичные риски.

В любом случае, водяной знак OpenAI легко обходится заменой слов. В тестах на фрагментах из 400 токенов замена 10 процентов слов синонимами снизила обнаружение водяных знаков с 92 до 66 процентов. А при замене 25 процентов слов сигнал водяного знака мог быть обнаружен только в 17 процентах случаев.

А теперь оцените мощь этого едва адекватного, но соответствующего требованиям детектора ИИ… ®

*Facebook, *Instagram и *WhatsApp принадлежат компании *Meta Platforms Inc., деятельность которой признана экстремистской и запрещена на территории Российской Федерации.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

В тренде:


Похожие новости: