
向量检索是否值得优化先看漏召的真实原因搜不到答案时第一反应常常是调大nprobe、换索引或把 topK 往上加。可很多漏召和 ANN 没关系文档没入库、切分把关键句切断了、查询改写偏了甚至标注答案本身就不稳定。先收集一小份失败集挑出真实检索失败的查询给每条记录标注期望文档、当前候选、过滤条件和最终回答。先确认目标文档是否存在、是否被权限或时间过滤再看它在向量候选中的位置。这样可以把问题分到数据、切分、嵌入、索引或重排而不是一锅端给“召回率”。指标要和任务一起看离线评测固定语料版本、查询集和相关性规则。若只关心“目标文档有没有进候选”看 RecallK若候选顺序会影响下游上下文则同时看排名指标和答案质量。不要把一组样本上的改善直接写成普遍结论。每次只调整一个因素并保留失败样本。向量检索调优像给苏绣挑线先看是哪一根线走错了再动整块布。