Anthropic: «Клод» не потерпит излишней жестокости

Anthropic Claude ии политика безопасность правила macrumors.com

Обновите политику использования Claude! Запретите жестокое обращение с ИИ. Узнайте о новых правилах для обманных кампаний, выборов, оружия и правоохранительных органов.

Anthropic заявляет, что правило о недопустимости злоупотреблений предназначено для применения только в крайних случаях, когда пользователи «неоднократно проявляют жестокость» по отношению к моделям ИИ «без видимой цели». Правило не распространяется на обычное пользовательское разочарование, противодействие, мрачные творческие темы или тестирование и исследование моделей.

Модели Claude уже способны прекращать такие разговоры с пользователями, которые постоянно злоупотребляют ими, и прекращение разговора останется основным инструментом обеспечения соблюдения правил. Когда Claude прекращает чат, дальнейшие сообщения в этом разговоре отправлять нельзя, но другие чаты не затрагиваются.

Anthropic изначально предоставила Claude возможность прекращать разговор в августе 2025 года в рамках исследования благополучия ИИ. В то время Anthropic заявила, что не уверена, обладает ли Claude моральным статусом, но компания искала недорогие способы снижения рисков для Claude. Anthropic обнаружила, что Claude Opus 4 демонстрирует «устойчивое и последовательное неприятие вреда». Модель показала предпочтение избегать опасных задач, явное расстройство при общении с пользователями, ищущими оскорбительные разговоры, и тенденцию прекращать вредоносные беседы, когда ей это разрешено.

Политика использования Anthropic была реорганизована для объединения связанных положений, и несколько других правил были изменены.

  • Обманные кампании — Новый раздел об обманных кампаниях объединяет правила, запрещающие политическое и коммерческое мошенничество и дезинформацию, запрещая поддельные отзывы, астротурфинг, фейковые сайты и ботов, выдающих себя за людей.
  • Выборы — Более узкий раздел о выборах запрещает обман избирателей и вмешательство в процесс голосования.
  • Оружие — Claude нельзя использовать для разработки программного обеспечения или компонентов оружия, а новое правило запрещает модификацию биологических или химических агентов для повышения летальности или трансмиссивности. Пользователям также запрещено использовать Claude для вооружения дронов и беспилотных систем.
  • Правоохранительные органы — Правила, касающиеся правоохранительных органов, были переписаны. Claude не может принимать решения или предлагать, кого расследовать, арестовывать, обвинять или преследовать. Отслеживание людей без согласия не допускается, и введено новое запрещение на создание инструментов слежки. Также запрещен доксинг.
  • Физические действия — Новый раздел о физических действиях гласит, что если Claude управляет оборудованием, которое может причинить вред человеку, квалифицированный специалист должен наблюдать за работой и быть готовым остановить ее при необходимости.
  • Вредный контент — Введено новое правило, запрещающее создание, распространение или угрозу распространения интимных изображений без согласия и инструментов для их создания.

Большинство изменений уточняют существующие правила Anthropic и направлены против злоупотреблений, которые Anthropic отслеживала. Anthropic заявляет, что обнаружила, как государственные СМИ, правительственные пропагандистские отделы и коммерческие фирмы использовали Claude для управления сетями фейковых аккаунтов и сайтов с вымышленными новостями, что привело к созданию нового раздела об обманных кампаниях.

Новая политика вступает в силу 12 ноября. Дополнительную информацию об изменениях можно найти на веб-сайте Anthropic, как и полную политику использования.

Тег: Anthropic

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

В тренде:


Похожие новости: