文件處理
最後更新
呢個有冇幫助?
簡單嚟講:呢個係 Cherry Studio 將「PDF/複雜版式文件」讀成規整文字嘅中央配置。
帶表格、多欄、掃描頁嘅 PDF(學術論文、合約、研報等)直接丟畀模型往往會讀到亂晒龍。文檔處理會先用專門嘅解析引擎將佢哋轉成結構清晰嘅文字,再交畀對話或 知識庫 使用。
文檔處理 vs OCR:兩者係分開嘅兩頁設定。
文件處理(本頁):管 PDF/複雜版式文件 嘅結構化解析。
OCR:管 圖片/掃描件 入面嘅文字識別。
普通純文字 PDF、.md/.txt/.docx 入面嘅文字段落兩者都唔需要,直接讀就得。
打開【設定】→【文檔處理】,喺右上角嘅下拉揀解析引擎,揀中嘅引擎就會作為預設。

文檔處理內置 5 個引擎,預設 MinerU:
Open MinerU
可自部署嘅 MinerU 服務,適合希望自行控制處理鏈路嘅團隊
自部署後填 API 地址(按需要填 API 密鑰)
改用其他引擎:喺下拉揀中佢,填入該引擎嘅【API 密鑰】/【API 地址】就得,揀中即成為預設。其中 PaddleOCR 同 Open MinerU 支援自部署——部署後將【API 地址】填成你自己嘅服務地址。
MinerU 對帶表格/多欄排版嘅 PDF 效果明顯更好,遇到學術論文等首選;
需要識別嘅係 圖片入面嘅文字(截圖、掃描件)而唔係 PDF 結構,請改用 OCR。
如果您喺配置或使用過程中遇到任何疑問、Bug 或有功能改善建議,請參考 反饋與建議 入面提供嘅官方渠道。
最後更新
呢個有冇幫助?
呢個有冇幫助?