Арси, американская open source лаборатория ИИ, заявляет, что китайские модели не опасны сами по себе

Ai китай Open Source безопасность Arcee модели techcrunch.com

Китайские AI-модели набирают популярность в США, вызывая споры о запрете. Эксперт Arcee объясняет, почему открытые модели не опаснее другого open source, и призывает развивать собственную экосистему вместо запретов.

Ходят разговоры о том, что администрация Трампа может попытаться запретить их (хотя пока не предприняла никаких действий в этом направлении). Тем временем создатели проприетарных моделей, особенно OpenAI и Anthropic, проявляют всё большую обеспокоенность по их поводу.

Модели с открытыми весами, такие как Kimi K3 от Moonshot AI или Qwen от Alibaba, предлагают инференс по стоимости токена, составляющей лишь долю от стоимости закрытых моделей крупных американских лабораторий. Опасения заключаются в том, что они также представляют собой некую угрозу. Безусловно, они угрожают норме прибыли крупных проприетарных AI-лабораторий.

Но стоит ли предприятиям, запускающим эти модели в собственных центрах обработки данных, поддаваться страху, что они могут стать вектором для китайских хакеров?

Нет, считает Лукас Аткинс, технический директор Arcee, которая создает открытые модели, чтобы предоставить американским компаниям отечественную альтернативу китайским моделям.

Если бы какой-либо стартап и выиграл от запрета китайских моделей, то это была бы Arcee. Но Аткинс утверждает, что открытые модели из Китая не более опасны, чем любое другое программное обеспечение с открытым исходным кодом, которое может использовать компания. Более того, по его словам, они даже приносят пользу его собственной компании.

«Многие люди рассматривают это как аналогию с китайской программой. Мол, она была написана с такими-то и такими-то намерениями», которыми мог бы просто управлять злоумышленник, — сказал он.

«В корне не так обучаются эти модели. На самом деле нет никакого способа для Arcee или Alibaba создать модель, позволить кому-то запустить её в своей собственной среде и получить к ней какой-либо доступ», — объяснил он.

Хотя большинство этих моделей являются так называемыми «моделями с открытыми весами» и не являются полностью программным обеспечением с открытым исходным кодом, исходный код (та часть, которая будет фактически выполняться на серверах), если он загружен с сайтов открытого кода, таких как Hugging Face, в значительной степени виден и доступен для проверки. (Чего нет, так это методов и данных, использованных для обучения моделей.)

Крупные организации должны пропускать ядро любой модели через свои процессы тестирования безопасности и инспекции, а также часто дообучать модели для своих конкретных целей и могут проверять такие области, как предвзятость, токсичность, галлюцинации и чувствительность к определенным темам. Таким образом, они работают с моделями, оптимизируют их и понимают их, прежде чем люди начнут отправлять им промпты.

Может ли модель, используемая для написания кода, каким-либо образом внедрить вредоносные бэкдоры в код, который она пишет? Опять же, хотя теоретически это возможно, для этого потребовались бы акробатические трюки.

«Нет причин, по которым достаточно искушенный субъект не мог бы обучить модель быть совершенно потрясающей моделью для написания кода в любых обстоятельствах, но при предъявлении определенного типа кодовой базы… сработало бы какое-то скрытое обучение», — предположил Аткинс, который проводит свои дни, обучая модели. Но он добавляет: «Я не знаю, как бы вы это сделали».

Поскольку большие языковые модели по своей природе креативны, вероятность того, что современная модель выдаст вредоносное ПО в ответ на заранее спланированное идеальное сочетание контекста и промпта, невелика. Еще меньше шансов, что какое-либо предприятие затем использует этот код.

Может ли это произойти в будущем? Это знает только Бог. Но предприятия также строят свои AI-приложения, делая их независимыми от моделей и используя несколько моделей. Так что, даже если китайские модели сегодня являются лучшими по соотношению цены и качества, предприятия не будут привязаны к их использованию навсегда.

«Я думаю, что вместо разговоров о том, как запретить китайские модели, следует говорить о том, как создать хорошую открытую экосистему здесь, в США», — говорит Аткинс.

Arcee также получает преимущества от китайских моделей. Поскольку они открыты, стартап «выигрывает от того, что эти модели хороши, потому что мы можем учиться на том, что они сделали. Мы можем строить на их основе. Затем они могут учиться на том, что делаем мы», — говорит он. «Мы испытываем огромное уважение к людям, создающим эти модели, к отдельным исследователям».

В конечном счете, способ конкурировать с китайскими моделями — «это выпустить модель, которая будет лучше», — говорит Аткинс. «Мы должны дать им тему для обсуждения».

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

Похожие новости: