Пользователи Claude спорят об этом шаге с тех пор, как компания объявила на этой неделе, что будет наносить водяные знаки для соблюдения Кодекса прозрачности Закона ЕС об ИИ, который требует от компаний, занимающихся ИИ, использовать системы, позволяющие идентифицировать контент, созданный ИИ.
На Reddit, например, один пользователь охарактеризовал это как заговор против невинных пользователей Claude, в то время как другой заявил: «Единственная причина не хотеть этого — чтобы лгать людям». А Business Insider сообщает, что «десятки» пользователей в X заявили об отмене своих подписок на Claude в результате этого.
Новый пост Anthropic начинается с общего обзора концепции водяных знаков, объясняя, что при принятии «малозначимых решений» — например, выбора между словами «overcast» и «grey» для описания погоды — Claude может создавать в своих ответах шаблон, который «незаметен для читателя, но является обнаруживаемым для любого, у кого есть ключ для его кодирования».
«Нанесение водяных знаков не влияет на качество вывода Claude», — заявила компания. «Для читателя ответ с водяным знаком неотличим от ответа без него».
Более конкретно, Anthropic сообщила, что будет использовать подход SynthID-Text, который команда Google DeepMind представила в 2024 году, и планирует выпустить API для обнаружения водяных знаков. Она также отметила, что нанесение водяных знаков отличается от методов обнаружения ИИ, предлагаемых такими компаниями, как Pangram, которые ищут «признаки» в тексте (например, конструкцию «это не [X], это [Y]»), чтобы выявить использование ИИ: «Обнаружение этих шаблонов принципиально отличается от проверки на наличие водяного знака».
Может ли кто-то просто переписать текст, чтобы скрыть водяной знак? Anthropic заявила, что это возможно, но «легкое редактирование, вероятно, не удалит водяной знак полностью», в то время как «полная переработка, где каждое слово заменено, удалит».
«В последнем случае, конечно, спорно, можно ли по-прежнему называть текст созданным ИИ», — заявила компания.
Что касается того, будет ли водяной знак обнаруживаемым в тексте, который был только вычитан или отредактирован Claude, Anthropic заявила, что это будет зависеть от «длины текста и того, насколько сильно Claude его отредактировал». Если текст был лишь слегка отредактирован, «почти все слова» будут написаны человеком-автором, и «водяному знаку будет очень мало (если вообще что-то) к чему прикрепиться».
Код, тем временем, должен иметь меньше водяных знаков, чем другой текст, потому что модели нужно будет создавать рабочий код, и у нее не будет свободы выбора между множеством одинаково допустимых вариантов.
«Тем не менее, в областях, где есть произвольный выбор между конкретными словами или терминами внутри кода, водяной знак может быть использован, например, в комментариях внутри кода», — заявила Anthropic. «Но по определению его влияние на фактический создаваемый код будет незначительным».
Anthropic также сообщила, что Claude будет не единственным ИИ-чат-ботом, генерирующим текст с водяными знаками, поскольку «другие крупные разработчики моделей подписали тот же Кодекс практики и будут внедрять свои собственные водяные знаки».
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Anthony Ha




