MariaDB встроила векторный поиск в свою базу данных. Проблема заключается в том, чтобы убедить инструменты для написания кода на базе ИИ рассказать об этом, говорит исполнительный председатель MariaDB Foundation.
«Мы так расстроены тем, что мир не понимает, что в MariaDB есть векторы», — говорит Кай Арно изданию The Register.
Арно беседует с The Register на конференции Percona Live, где конкуренты-разработчики баз данных, похоже, настроены на необычно коллегиальный лад.
Впрочем, Арно не упускает случая и поддеть конкурентов: «Я думаю, мы находимся в периоде спокойствия и плывем по гладкой воде, наблюдая, как ИИ влияет на вещи, как влияет расширяемость… и я не так уверен, что MySQL переживает все эти гладкие времена».
MariaDB была ответвлением от MySQL в 2009 году, когда назревало приобретение Sun Microsystems компанией Oracle. Теперь она поддерживает векторный поиск, который позволяет приложениям находить элементы по сходству, а не по точному совпадению — это распространенное требование в приложениях ИИ. Некоммерческий фонд MariaDB Foundation поддерживает разработку серверной части с открытым исходным кодом и ее сообщество, в то время как MariaDB plc разрабатывает коммерческие продукты и предоставляет поддержку.
MariaDB знакома пользователям многих дистрибутивов Linux. Арно беспокоит, будут ли разработчики, начинающие новый проект в области ИИ, когда-либо направлены на нее.
«Люди начинают использовать векторные базы данных на основе какого-либо фреймворка или на основе каких-то стандартных выборов LLM», — объясняет он. «Так что, если вы занимаетесь vibecoding и просто нажимаете Enter, когда Claude Code предлагает что-то, вы не будете использовать MariaDB для своего векторного поиска, и это то, что нам нужно изменить».
Арно приписывает часть проблемы информации, доступной инструментам ИИ. Их обучающие данные могут предшествовать векторным функциям MariaDB, в то время как документация и примеры, с которыми разработчики сталкиваются в других местах, могут по-прежнему отдавать предпочтение устоявшимся альтернативам.
«Есть миллион мест, где нам нужно обновить информацию, чтобы фреймворки, обучающие данные для LLM и все остальное знали о существовании векторов MariaDB», — говорит он.
«Например, если вы спросите случайный LLM: «Какую базу данных мне использовать для векторов?» И вы не упомянете MariaDB; сегодня, основываясь на обучении, которое имеют модели LLM прямо сейчас, никто не предлагает MariaDB».
В ходе одного явно ненаучного эксперимента мы спросили Claude, какую базу данных использовать для векторного поиска. Он первым делом предложил PostgreSQL и не упомянул MariaDB. Однако, когда его попросили сравнить MariaDB с PostgreSQL для той же задачи, он смог многое сказать. Инструмент знал о возможностях MariaDB; он просто не предлагал их добровольно.
«Я сравниваю это со старыми временами, когда нужно было улучшить свой рейтинг в Google. Это была своего рода мистическая наука. Вы не знали, как Google ранжирует результаты.
«Теперь мир отошел от [оптимизации поисковых систем] к оптимизации LLM».
Арно признает, что поставщики могут пытаться манипулировать рекомендациями, но говорит: «Я думаю, единственный правильный способ повлиять на это — иметь это, документировать это и чтобы люди это использовали». Это ставит MariaDB перед проблемой «курицы и яйца»: без пользователей, генерирующих примеры и обсуждения ее векторного поиска, у инструментов ИИ будет меньше материала, из которого они могли бы узнать о ней.
«Ранние последователи имеют неоправданное преимущество, и это похоже на то, как если бы вода начала течь в определенном направлении, она будет продолжать течь в этом направлении. И теперь мы должны изменить это и заставить людей осознать, что мы делаем».
Усилия MariaDB по привлечению разработчиков также поднимают вопрос о том, какие возможности останутся доступными в ее общедоступной версии. Galera, технология кластеризации, используемая с MariaDB, вызвала споры относительно ее будущего в качестве открытого исходного кода и ее места в линейке корпоративных продуктов компании.
«Вы можете иметь разные мнения о том, является ли это частью MariaDB, основного сервера, или нет, но это продукт, который изначально не был частью основной команды инженеров MariaDB. Он управлялся организацией, которая была приобретена MariaDB plc, которая является коммерческой организацией и не равна MariaDB server, и им разрешено делать с ним все, что они хотят», — говорит Арно.
«Это их свобода. Это их право решать, что они хотят делать. То, что мы защищаем, — это MariaDB server, и если кто-то вмешивается в это, мы будем очень расстроены!» ®
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Richard Speed




