文档处理
最后更新于
这有帮助吗?
简单说:这是 Cherry Studio 把"PDF / 复杂版式文档"读成规整文本的中央配置。
带表格、多栏、扫描页的 PDF(学术论文、合同、研报等)直接丢给模型往往会读得乱七八糟。文档处理会先用专门的解析引擎把它们转成结构清晰的文本,再交给对话或 知识库 使用。
文档处理 vs OCR:两者是分开的两页设置。
文档处理(本页):管 PDF / 复杂版式文档 的结构化解析。
OCR:管 图片 / 扫描件 里的文字识别。
普通纯文本 PDF、.md/.txt/.docx 里的文字段落两者都不需要,直接读即可。
打开 【设置】→【文档处理】,右上角的下拉里选择解析引擎,选中的引擎即作为默认。

文档处理内置 5 个引擎,默认 MinerU:
Open MinerU
可自部署的 MinerU 服务,适合希望自行控制处理链路的团队
自部署后填 API 地址(按需填 API 密钥)
换用其他引擎:在下拉里选中它,填入该引擎的【API 密钥】/【API 地址】即可,选中即成为默认。其中 PaddleOCR 和 Open MinerU 支持自部署——部署后把【API 地址】填成你自己的服务地址。
MinerU 对带表格 / 多栏排版的 PDF 效果显著更好,遇到学术论文等首选;
需要识别的是 图片里的文字(截图、扫描件)而非 PDF 结构,请改用 OCR。
如果您在配置或使用过程中遇到任何疑问、Bug 或有功能改进建议,请参考 反馈与建议 中提供的官方渠道。
最后更新于
这有帮助吗?
这有帮助吗?