源文件:chapter3/dense-embedding/README.md 向量相似度检索服务 一个用于教学的 HTTP 向量相似度检索服务,基于 BGE-M3 嵌入模型,可在 ANNOY 与 HNSW 两种索引后端之间灵活切换。 命令行工具:稠密检索与 ANN 对比(cli.py,实验 3-4) 除了上面的 HTTP 服务,本项目还提供一个开箱即用、可离线复现的命令行工具 , 把书中实验 3-4 的两个观察点直接跑成可量化的数字,无需先启动服务: 稠密嵌入检索的语义能力——在带标注的小型语料上计算 ; ANN 索引后端对比(实验 3-4 的重点)——复用服务端 里的 ANNOY / HNSW 实现,测量二者相对精确暴力检索的召回率、建索引耗时与查询延迟。