由 John Doe 九月 29, 2026
MariaDB 基金会主席称:其向量搜索功能已就绪,但编程助手始终引导开发者转向其他数据库。

作者:Richard Speed | 微软生态记者
MariaDB 基金会执行主席表示,MariaDB 已在数据库内核中内置了向量搜索能力,而当前最大的难题,是让 AI 编程工具向开发者推荐这一功能。
「外界都不知道 MariaDB 已经支持向量功能,这让我们非常挫败。」卡伊・阿尔诺(Kaj Arnö)向我们表示。
阿尔诺是在 Percona Live 大会上接受《The Register》采访时发表上述观点的。本届大会上,各大竞品数据库厂商之间的氛围难得地十分融洽。
不过阿尔诺也没忘了时不时调侃一下对手:「我觉得现在行业处于一段平稳期,整体风平浪静,大家都在观察 AI 会带来什么影响,可扩展性又会带来什么改变…… 但我可不觉得 MySQL 的日子也这么顺风顺水。」
2009 年,甲骨文收购太阳微系统(Sun Microsystems)一事尘埃落定,MariaDB 由此从 MySQL 分叉诞生。如今它已支持向量搜索,允许应用通过相似度匹配而非精确匹配检索数据,这是 AI 应用中的典型需求。非营利的 MariaDB 基金会负责开源数据库服务器的研发与社区运营,MariaDB plc(上市公司)则负责商业产品的开发与技术支持服务。
很多 Linux 发行版的用户都对 MariaDB 十分熟悉。阿尔诺担忧的是,从零启动 AI 新项目的开发者,是否有机会被引导选用 MariaDB。
他解释道:「人们选择哪款向量数据库,往往取决于所用的开发框架,或是大语言模型的默认推荐。所以如果你跟着 AI 的建议『凭感觉写代码』,Claude Code 给出方案你直接回车确认,最终你的向量搜索肯定不会用 MariaDB,这正是我们要改变的现状。」
阿尔诺认为,问题部分源于 AI 工具可获取的信息存在滞后性。大模型的训练数据可能早于 MariaDB 向量功能的发布时间,而开发者在其他渠道接触到的文档与案例,也普遍更偏向那些市场地位稳固的竞品。
「我们需要在无数渠道更新信息,让各类开发框架、大语言模型的训练数据等等,都知道 MariaDB 向量功能的存在。」他说。
「打个比方,你随便问一个大模型:『做向量检索该用什么数据库?』只要你不提 MariaDB,以目前大模型的训练数据来看,没有一个会推荐它。」
我们做了一个非正式的小测试:询问 Claude 做向量搜索该选用什么数据库,它首推 PostgreSQL,完全没有提及 MariaDB。但当我们要求它对比 MariaDB 与 PostgreSQL 的向量搜索能力时,它又能说出不少细节。可见这款工具并非不了解 MariaDB 的功能,只是不会主动推荐。
「我把这比作早年的谷歌排名优化,那更像一门玄学,你根本摸不清谷歌是怎么给搜索结果排序的。」
「而现在,整个行业已经从搜索引擎优化(SEO),转向了大语言模型优化。」
阿尔诺承认,厂商可以尝试钻空子操纵大模型的推荐结果,但他表示:「我认为唯一正当的影响方式,就是把功能做扎实、完善文档,再靠真实用户去使用和传播。」这也让 MariaDB 陷入了「先有鸡还是先有蛋」的困境:没有用户产出向量搜索的相关案例与讨论,AI 工具就缺少学习相关信息的语料。
「先行者占据了极大的先发优势,就像水流一旦朝某个方向形成势头,就会一直顺着这个方向流动。现在我们必须扭转这个趋势,让更多人知道我们在做的事。」
MariaDB 吸引开发者的动作,也引发了另一个疑问:社区版未来还会保留哪些核心能力?MariaDB 常用的集群技术 Galera,其开源前景以及在公司企业级产品线中的定位,一直以来都争议不断。
阿尔诺对此表示:「Galera 到底算不算 MariaDB 核心服务器的一部分,大家可以有不同看法。但它从一开始就不是 MariaDB 核心工程团队开发的产品,它原本由另一家团队运营,后来被商业公司 MariaDB plc 收购。MariaDB plc 和 MariaDB 开源服务器项目不是一回事,他们有权决定这款产品的走向。」
「这是他们的自由,他们有权利做自己的决策。我们要守护的是 MariaDB 服务器本身,如果有人动这块核心,我们绝不会答应!」
参考
The Register: For MariaDB, LLMs are the new search engines to win over