ドキュメント処理
簡単に言うと:これは Cherry Studio が「PDF / 複雑なレイアウトの文書」を整ったテキストとして読み取るための中心設定です。
表や複数カラム、スキャンページを含む PDF(学術論文、契約書、調査レポートなど)は、そのままモデルに投げると読みにくくなりがちです。文書処理ではまず専用の解析エンジンでそれらを構造の明確なテキストに変換し、その後、対話または ナレッジベース で使用します。
設定入口
【設定】→【文書処理】を開き、右上のドロップダウンで解析エンジンを選択します。選択したエンジンがそのままデフォルト。

内蔵解析エンジン
文書処理には 5 つのエンジンが内蔵されており、デフォルトは MinerU:
エンジン
説明
接続方法
Open MinerU
自前でデプロイ可能な MinerU サービスで、処理フローを自分たちで管理したいチームに適しています
自前でデプロイした後、API アドレスを入力(必要に応じて API キーも入力)
MinerU の設定(デフォルト案)
ナレッジベースとの関係
文書処理は「複雑な文書 → 整ったテキスト」への変換だけを担当します。
変換後のテキストはそのまま 埋め込みモデル ベクトル化、格納へ進みます;
「ナレッジベースで有効にする」詳しい手順は ナレッジベース文書の前処理。
ヒントとコツ
MinerU は表や複数カラムのレイアウトを含む PDF で特に高い効果を発揮します。学術論文などではまず最優先で試してください;
認識したいのが 画像内の文字(スクリーンショット、スキャンデータ)であって PDF の構造ではない場合は、代わりに OCR。
ヘルプの取得とフィードバックの送信
設定または使用中に不明点、バグ、機能改善の提案がある場合は、 フィードバックと提案 に記載の公式チャネルをご参照ください。
最終更新
役に立ちましたか?