Vector Database
/ˈvektər ˈdeɪtəbeɪs/向量数据库跟读一遍
歪克特·戴塔·贝斯
点「跟读」听中文慢速念法——记住这一串,开口不慌。
专存「数字坐标」、擅长找近邻的数据库。
人话解释
向量数据库专门存储 embedding 生成的数字坐标,核心本领只有一个:从千万条向量里飞速找出离目标最近的若干条。它与大模型搭档完成 RAG 流程的前半段——先把用户问题转成向量,再去库里捞「意思最近」的文本片段交给大模型参考。与传统数据库的精确匹配不同,它找的是「意思相像」而非「一字不差」。选型时重点看两件事:检索召回的速度和条件过滤的能力。
例传统搜索像查字典,错一个字都查不到;向量库像那位懂眼神的老管理员,你描述个大意,他直接把几本最像的书拍在你面前。