知识库设置参考
查阅分块、检索、融合、重排序和文档处理字段
知识库设置同时影响文档处理和运行时检索。创建后嵌入模型与向量维度应保持稳定。
嵌入模型与维度
| 字段 | 类型 | 默认值 | 限制/说明 |
|---|---|---|---|
embedding_model_id | UUID/null | null | 知识库绑定的嵌入模型;创建后不可修改 |
embedding_dimension | integer/null | null | 由首次向量化实测并固化,后续向量维度必须严格一致 |
创建知识库时 embedding_dimension 为空,系统在首批文档切片向量化后写入实测维度。此后再更新 embedding_model_id 会被拒绝,提交维度不一致的向量则抛出 DimensionMismatchError。供应商支持范围与 Qdrant 多维集合映射见 Embedding 适配器与向量维度。
知识库的 visibility 默认为 private(仅创建者可访问),可设为 team(团队成员可访问);public 仅为兼容保留。
分块与重排序
| 字段 | 类型 | 默认值 | 限制 |
|---|---|---|---|
chunk_size | integer | 1000 | >=100 字符 |
chunk_overlap | integer | 100 | >=0 字符 |
separator | string/null | null | 自定义文本分隔符 |
rerank_model_id | UUID/null | null | 团队授权的重排序模型 ID;需与 rerank_enabled 配合 |
rerank_enabled | boolean | true | 是否启用重排序 |
rerank_candidate_k | integer | 10 | 1-100 |
rerank_score_threshold | number/null | null | 0-1 |
检索
| 字段 | 类型 | 默认值 | 限制/说明 |
|---|---|---|---|
search_mode | vector、fulltext 或 hybrid | null(知识库设置);请求默认 hybrid | 混合融合向量与全文 |
top_k | integer/null | null(设置);请求默认 5 | 请求范围 1-20;设置范围 1-100 |
score_threshold | number/null | null(设置);请求默认 0 | 0-1 |
dense_weight | number/null | null(设置);请求默认 1.0 | >=0 |
lexical_weight | number/null | null(设置);请求默认 1.0 | >=0 |
rrf_k | integer/null | null(设置);请求默认 60 | 1-1000 |
混合检索要求稠密权重或词法权重至少一个大于 0。查询长度为 1-1000 字符;批量对比最多 10 个配置且 ID 必须唯一。
expand_adjacent 为内部选项
检索层还有一个 expand_adjacent 开关(默认 false):开启后会把命中切片在文档中的相邻切片一并召回,以补足上下文。它是检索服务的内部请求参数,当前未通过公开检索 API 暴露,无法在知识库设置或搜索请求中配置;当前公开检索接口也不提供该字段。
文档与状态
支持 PDF、DOC/DOCX、TXT、Markdown、HTML、CSV、XLS/XLSX、PPT/PPTX、JSON 和 URL。文档状态为 pending、processing、completed、error。站点默认单文件上传上限为 50MB,可在 1-1024MB 范围修改。
失败诊断
检索响应可能包含 inactive、missing_embedding_model、timeout、failed 诊断以及 recall、rerank、context、total 阶段耗时。生产排障依次检查文档完成状态、嵌入维度、Qdrant、PostgreSQL/pg_search、重排序模型凭据和服务商配额。

这篇文章对你有帮助吗?