For the complete documentation index, see llms.txt. This page is also available as Markdown.

文档预处理

知识库文档预处理用于在向量化前对 PDF / 图片等非文本内容做 OCR 与结构解析,让知识库能正确检索这些资料。

配置OCR服务商

打开 设置 → 文档处理,依次配置:

  • 系统 OCR:macOS 用户开箱即用(无需配置);Windows 需手动选择 OCR 引擎

  • 文档处理服务商:默认 MinerU,可填写 API Key + API Host(默认 https://mineru.net);也可切换为 Tesseract / Paddle OCR / OpenVINO / 三方 Provider

点击获取API KEY后会在浏览器打开申请地址,点击立即申请填写表单后获取API KEY,并将其填入API KEY中。

在知识库中启用文档预处理

在创建好的知识库设置中打开 文档预处理 开关,即可在添加文件时自动使用上一步配置的 OCR Provider。

上传文档

可以通过右上角搜索对知识库结果检测

在对话中使用

知识库使用Tips: 使用能力较强的模型时可以将知识库搜索模式修改为意图识别,意图识别可以更准确、广泛的描述您的问题。

开启知识库意图识别


💡 获取帮助与提交反馈

如果您在配置或使用过程中遇到任何疑问、Bug 或有功能改进建议,请参考 反馈与建议 中提供的官方渠道。

最后更新于

这有帮助吗?