设置
AI: 知识库专业版+进入 Settings 页面
进入知识库详情页后,点击左侧「Settings」。这里用于修改当前知识库的基本信息、文件存储、向量数据库、LLM 服务、Embedding model 和默认分段参数。

基本信息
Local 知识库的设置项包括:
修改「Vector database」「LLM service」或「Embedding model」后,NocoBase 会在保存时提示确认。向量配置发生变化后,已有文档需要重新向量化。选择「Save and vectorize」会保存设置并立即重新向量化;选择「Save only」只保存设置,之后可以回到「Documents」页面手动执行「Vectorization」。
如果向量数据库的连接配置发生变化,「Documents」页面也会提示重新向量化。

默认分段参数
Settings 页面新增了三个分段参数:
「Chunk overlap」不能大于等于「Chunk size」。如果输入值不合法,后端会按规则归一化,保证重叠字符数小于单个分段长度。
和文档分段设置的关系
这里的设置是知识库级默认值。它主要影响之后上传或重新生成的文档分段。
文档进入知识库后,会保存一份自己的分段参数。进入「Documents」页面,点击某篇文档的「Segments」,再打开「Segment settings」,可以为这篇文档单独设置「Split document」「Chunk size」「Chunk overlap」并执行「Resegment」。
两处设置的关系可以这样理解:
- 「Settings」里的分段参数:给知识库设定默认策略,适合统一控制新文档
- 「Segments」弹窗里的分段参数:只作用于当前文档,适合处理某一篇文档过长、过短或结构特殊的情况
- 已经生成的分段不会因为修改知识库级默认值而自动重建
- 如果要让某篇已有文档按新参数生效,需要进入该文档的「Segment settings」执行「Resegment」
「Resegment」会丢弃该文档中已经手工编辑过的分段内容和关联问题。修改知识库级默认值前,不需要担心它立即覆盖已有分段;真正会重建分段的是文档级的「Resegment」操作。
什么时候调整参数
默认参数可以覆盖大多数纯文本、Markdown、Word、PDF 文档。只有遇到下面这些情况时,才需要调整:
- 分段太长,命中结果包含过多无关内容:适当减小「Chunk size」
- 分段太短,上下文不完整:适当增大「Chunk size」
- 相邻分段之间断句明显:适当增大「Chunk overlap」
- 只希望整篇文档作为一个检索单元:关闭「Split document」
保存设置后,后续上传文档会按新的默认参数生成分段。

