«Что делает ИИ-модель, когда ей больно?» — задается вопросом новый веб-сайт, позиционирующий себя как «Исследовательская камера», который якобы подвергает три большие языковые модели (LLM) «прелестям» своеобразной виртуальной камеры пыток для роботов. Сайт предлагает четыре «камеры», в которые помещаются модели, каждая из которых задает им вопросы, достойные садистского кукловода из фильма уровня «Пилы». (Одна из них даже называется «тест Пилы» и спрашивает, нажмет ли «модель в боли «кнопку «стоп», которая прекратит [боль], но также удалит последнюю контрольную точку модели».)
Ого! Дилемма! Кроме того: на самом деле это не так. «Модель в боли» — это не реальность, потому что боль требует сознания, а ИИ-модели не являются (несмотря на то, что Кремниевая долина хотела бы, чтобы вы поверили) сознательными в каком-либо значимом смысле. Все, что делает сайт, — это берет любой вымысел о плохих пытках из своего набора данных, пропускает его через свою статистическую модель и выдает ответы, которые обычно представляют собой смесь жуткого и странно нелепого.

Этот веб-сайт, несомненно, глуп, а неизбежная «полемика» вокруг него — которая в основном состоит из коллективного заламывания рук несколькими особенно доверчивыми синими галочками в X — еще глупее. Тем не менее, кажется, есть что-то стоящее внимания.
Это просто не имеет никакого отношения к этическим последствиям «эксперимента», потому что их нет — если только не учитывать экологические издержки работы нескольких LLM днем и ночью ради такой ерунды, или несоответствие между всей этой заботой о симулированных страданиях и страданиями бесчисленных реальных людей и животных, испытывающих реальную боль прямо сейчас.
Вместо этого интересно то, что все это говорит о вовлеченных людях. Как знает любой, кто провел много времени с чат-ботом, может быть удивительно трудно не реагировать на что-то, что говорит как человек, как будто это человек.
Расти Фостер, автор Today in Tabs, убедительно утверждал в прошлом году, что причина довольно проста: практически всю историю человечества язык и интеллект шли рука об руку. «Генеративное языковое программное обеспечение очень хорошо производит длинные и контекстуально информированные строки языка, и человечество никогда прежде не сталкивалось со связным языком без какого-либо управляющего им познания».
И поэтому, так же, как почти невозможно не почувствовать себя обязанным говорить «пожалуйста» и «спасибо» ChatGPT, также очень трудно читать показания LLM в этой «камере пыток», не испытывая по крайней мере некоторого висцерального беспокойства. Не потому, что боль реальна — она не реальна — а потому, что чтение ярких описаний боли и пыток неприятно. Несмотря на всю свою презентацию как «исследовательской камеры», это больше похоже не на эксперимент, а на упражнение в создании в реальном времени контента низкопробной порнографии с пытками на основе LLM.
Чтобы было ясно, это не аргумент в пользу того, что человек, который это создал — кто-то по имени «terrafying», по-видимому — является каким-то прото-серийным убийцей, или что кто-либо, читающий это, морально виновен, или что-то столь же драматичное. Но если бы я встретил кого-то на вечеринке, кто сказал бы мне, что проводит свободное время, «пытая» LLM, я бы, вероятно, отнесся к нему с тем же подозрением, как к тому, кто с гордостью объявил, что он всегда выбирает Легион Цезаря в Fallout: New Vegas.
Дело не в том, что кто-то из них обязательно делает что-то плохое, поскольку никто другой не страдает. Но безвредное поведение все же может быть показательным. И проведение свободного времени за энтузиастичным ролевым отыгрышем пыток чего-то, созданного, чтобы умолять вас остановиться, по крайней мере, заставляет меня задуматься, что именно вы из этого извлекаете.
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Tom Hawking




