Новый институт призван выявить расхождения во взглядах между Google, Google DeepMind и мировым исследовательским сообществом относительно общего искусственного интеллекта (AGI). «Они не всегда будут согласны, и, вероятно, изменят свое мнение по мере поступления новых данных и информации на быстро развивающемся рубеже», — говорится в объявлении.
Первая коллекция из четырех эссе охватывает ряд тем: экономическая политика для управления потенциальными сбоями, вызванными AGI, сохранение понятного для человека процесса принятия решений моделями, принципы процветания человечества и рамки для оценки передовых моделей ИИ.
Одно эссе исследователей безопасности DeepMind Рохина Шаха и Анки Драган утверждает, что сокращающееся окно прозрачности ИИ — способность видеть и проверять пошаговое рассуждение модели — не является неизбежным. Поскольку новые архитектуры делают самые мощные модели труднее отслеживаемыми, авторы говорят, что разработчики и регулирующие органы должны напрямую столкнуться с компромиссами в области безопасности. Это может означать ограничение «непрозрачной серийной глубины» — объема последовательных вычислений, которые модель может выполнить без создания читаемого следа рассуждений — или требование к разработчикам продемонстрировать, что менее прозрачные системы остаются столь же отслеживаемыми.
В другом эссе Хассабис предлагает возглавляемый США орган по стандартам передовых ИИ для оценки самых современных моделей ИИ. В рамках его предложения разработчики первоначально добровольно представляли бы модели на рассмотрение за 30 дней до выпуска. Как только система оценки докажет свою эффективность, прохождение ее тестов может стать обязательным условием для развертывания передовых моделей в Соединенных Штатах.
Поначалу орган будет разрабатывать оценки совместно с компаниями, занимающимися ИИ, но в конечном итоге разработает независимые, нераскрываемые оценки — то, что в эссе называется тестами «отложенного набора» — чтобы предотвратить адаптацию моделей лабораториями к известным оценкам. Хассабис заявил, что рамки могут быть «усилены, если серьезность ситуации потребует этого», потенциально включая скоординированное замедление темпов разработки передовых ИИ.
Эссе появляются в то время, когда дебаты в отрасли по вопросам безопасности смещаются от общих заявлений о беспокойстве к конкретным предложениям по раскрытию информации, внешнему надзору и, если меры безопасности отстанут, скоординированному замедлению темпов. Этот сдвиг ускорился на этой неделе, когда лидеры отрасли одобрили элементы призыва генерального директора Anthropic Дарио Амодеи «установить темп» разработки передовых ИИ.
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Aditya Mehta




