设置向量存储
什么是向量?
向量(Vector)是将文本、图片等非结构化数据通过嵌入模型(Embedding Model)转换得到的一组高维数值。语义相近的数据通常会映射到向量空间中相近的位置,因此可以通过计算向量之间的距离来衡量数据的相似度。RDS当前支持欧氏距离(L2)和余弦距离(Cosine)两种距离度量方式。
传统B+Tree索引适用于精确匹配和范围查询,但无法高效支持高维向量的相似度检索。为此,RDS引入HNSW(Hierarchical Navigable Small World)向量索引,通过构建多层近邻图来组织向量数据。查询时,从高层入口节点开始逐层搜索,快速定位与目标向量最接近的候选节点,最终返回Top-K相似结果。
在存储层面,每个向量索引对应一张隐藏的辅助表,用于持久化保存HNSW图节点及邻接关系。这样可以直接复用InnoDB的事务、恢复和锁机制,无需额外设计专用存储引擎,在保证数据一致性的同时提供高效的向量检索能力。
本章节介绍在RDS界面开启和关闭向量存储开关。
约束限制
操作步骤
- 登录RDS管理控制台。
- 单击管理控制台左上角的
,选择区域。 - 在“实例管理”页面,单击实例名称,进入实例“概览”页。
- 在“向量存储”处,单击“开启”。
- 在弹框中,单击“确定”。 图1 开启向量存储
开启向量存储后,约需要1分钟生效。
- 登录RDS管理控制台。
- 单击管理控制台左上角的
,选择区域。 - 在“实例管理”页面,单击实例名称,进入实例“概览”页。
- 在“向量存储”处,单击“关闭”。
- 在弹框中,单击“确定”。 图2 关闭向量存储
关闭向量存储后,约需要1分钟生效。