核心概念
知识库
理解文档处理、分块、向量与全文混合检索
知识库把文档转换成可被 Agent 和工作流检索的分块。资源归属于团队,创建时选择嵌入模型,并可选重排序模型。
处理流水线
上传或导入网址后,文档先处于等待中。处理会完成文本提取、清理、分块、嵌入和索引,最终进入已完成或失败。文档级状态为 pending、processing、completed、error。
已处理文档的分块可以查看、编辑、新增和删除。重新分块会替换所有现有分块及向量,手工编辑会丢失。
三种检索方式
| 方式 | 适用场景 |
|---|---|
| 向量检索 | 按语义相似度召回 |
| 全文检索 | 按词法/BM25 精确匹配 |
| 混合检索(默认) | 加权 RRF 融合向量与全文排名 |
混合检索默认稠密权重与词法权重均为 1.0,rrf_k 为 60。两个权重不能同时为 0。重排序可在融合后对候选分块二次打分。
检索实验室
命中测试/检索实验室可运行单配置测试或 A/B 对比,展示每条结果在向量、全文、融合和重排阶段的排名与分数,并可把本地预设应用到生产知识库设置。