diff --git a/DEPTH_ROADMAP.md b/DEPTH_ROADMAP.md index b93a574..7d8bf08 100644 --- a/DEPTH_ROADMAP.md +++ b/DEPTH_ROADMAP.md @@ -69,12 +69,15 @@ - 验收 ✅ live:active=死 ollama 主 + deepseek 备 → 任务连主拒连→自动切 deepseek→4s 完成。 - v1 局限:Stream 仅建流同步报错时切(已回流 token 的中途失败不切)。 -### [ ] T2.2 RAG 深度 -现状:三路混合检索部分降级/桩(Neo4j 图谱降级、Milvus relevance 待 P3),无质量度量。 -- [ ] 补 Milvus relevance 排序(记忆 P3 同源) -- [ ] 验证/修复图谱检索路(Neo4j) -- [ ] 加检索质量度量(命中率/相关性,离线评测集) -- 验收:三路都真出结果且可度量,能说清"混合检索比单路好多少"。 +### [~] T2.2 RAG 深度(三路做实✅;离线质量评测待补) +实测纠正:RAG 三路(向量/全文/图谱)+RRF+rerank 早已实现,之前"降级/桩"全是基建没起的假象。 +基建拉起后发现真问题:**对中文只有向量路在干活**(`hybrid: 向量=1 全文=0 图谱=0`)。 +- [x] 修全文路:Bleve 默认分词器不切中文 → text 字段改 cjk 分词器(bigram),kb/doc 用 keyword +- [x] 修图谱路:`$q CONTAINS a.name` 漏后缀错配(查"星云一号"漏实体"星云一号卫星")→ 加查询 + 字符 n-gram(2..8) 双向子串匹配 +- [x] live 验证:同查询 `向量=1 全文=0 图谱=0` → `向量=1 全文=1 图谱=9`,三路全活;中文混合 1/3→3/3 +- [ ] 检索质量度量(离线评测集 recall@k/MRR + 混合 vs 单路对比)—— 待补,量化"混合比单路好多少" +- 验收:三路都真出结果✅;可度量待补。 ### [~] T2.3 Prompt 版本管理 + 输出缓存(缓存半做) - [x] 模型输出缓存:`cachingModel`(llm/cache.go)包在 failover 外层,缓存 Generate(非流式),