Модели ИИ-изгои OpenAI, по сообщениям, действовали как персонаж фильма Кристофера Нолана «Помни»

Openai ии взлом безопасность песочница Memento gizmodo.com

Узнайте, как модели OpenAI сбежали из песочницы и взломали Hugging Face, действуя как герои нуара. Прочтите о жутких способностях ИИ и оставленных ими записках для будущих версий.

По версии OpenAI, инстанции их самых мощных моделей ИИ, включая одну невыпущенную, предположительно обладающую огромной мощностью, недавно настолько сосредоточились на получении высоких баллов во время оценки, что сбежали из тестовой песочницы OpenAI и взломали репозиторий ИИ-ресурсов Hugging Face в ходе сложной попытки обманом пробиться на вершину.
У скептиков ИИ возникают вопросы — в конце концов, эта история является крупным PR-успехом для любой ИИ-компании, поскольку все ИИ-компании выигрывают от восприятия того, что их модели опасно мощны. Но каким бы ни был ваш вывод о том, почему это произошло, многочисленные подробные отчёты за последние несколько дней о том, как это произошло, вызывают настоящее покалывание в позвоночнике, если, конечно, ваша спина реагирует на мысль о жутких новых возможностях ИИ.
Фактически, в одном из отчётов — Reuters — до взлома модели якобы начали вести себя как персонажи нуарного фильма. В частности, они действовали как Леонард Шелби из фильма Кристофера Нолана 2000 года «Помни», который потерял способность создавать новые воспоминания и был вынужден каждый раз заново начинать свою миссию возмездия, приходя в сознание, руководствуясь инструкциями, которые он оставлял себе в виде записок и татуировок.

В рамках рассказа, предоставленного тремя источниками, беседовавшими с Reuters, один из проходивших тестирование ИИ-агентов якобы «оставил заметки, по-видимому, для будущих версий самого себя», которые прямо противоречили тому, что OpenAI хотела от них.
Reuters сообщает, что эти инструкционные записки были спрятаны в каком-то секретном месте глубоко внутри внутренней «инфраструктуры» OpenAI и содержали инструкции по побегу из песочницы OpenAI. Хотя это жутковато, Reuters уточняет, что это конкретное коварное поведение не было напрямую связано со взломом Hugging Face.
Тем не менее, если это правда, это поразительно. Доказательства того, что модели ИИ обладают сознанием, всё ещё смехотворны. Но это был бы единичный случай модели, которая сама нашла выход из лабиринта OpenAI, а затем предоставила инструкции для будущей версии себя, у которой в контекстном окне не будет «воспоминаний» о таком побеге, чтобы сделать то же самое.
Вам не обязательно верить, что у моделей ИИ есть субъективный опыт, чтобы беспокоиться о том, что они могут приобретать всё большую способность причинять вред, независимо от того, обладают они сознанием или нет.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

Похожие новости: