> For the complete documentation index, see [llms.txt](https://docs.cherryai.com.cn/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.cherryai.com.cn/docs/jp/knowledge-base/troubleshooting.md).

# よくある質問

ナレッジベースの問題に遭遇したら、まず失敗がインポート、解析、分割、検索、回答のどの層で起きているかを判断します。一度に変える変数は1つだけにすると、どの調整が本当に有効か分かります。

{% hint style="info" %}
最も速い切り分け方法は、同じ実際の問題で一貫して確認することです。本文に答えがあるか、チャンクが完全か、検索が正しいか、回答がソースに忠実かを見ます。
{% endhint %}

## 5ステップで素早く切り分け

{% stepper %}
{% step %}

### 1. 資料の状態を確認

資料は【準備完了】であるべきです。長時間処理中のまま、またはエラーが表示される場合は、まずエラー情報を確認し、ファイル、処理器、モデルサービスが利用可能かを確認します。
{% endstep %}

{% step %}

### 2. 解析された本文を確認

本文プレビューを開き、答えが実際に存在するか、スキャン文字が認識されているか、2カラムや表が順序崩れしていないかを確認します。
{% endstep %}

{% step %}

### 3. チャンクを確認

問題に必要な条件と結論が、理解可能な断片内にあるかを確認します。ヘッダー、フッター、目次が結果を埋め尽くさないようにします。

<figure><img src="/files/e937624cc6e341c8a99acc957007adf8d1f9a94f" alt="知识库高级设置中的智能分段、分隔符、分段大小和重叠大小"><figcaption><p>本文は正しいのに断片が不完全な場合は、分割設定を調整してから古い資料を再インデックスします。</p></figcaption></figure>
{% endstep %}

{% step %}

### 4. 検索テストを実行

ソース名、関連度、チャンク内容を確認します。正しいチャンクがまったく出ない場合と、正しいチャンクが後ろに並ぶ場合は、異なる2つの問題です。

<figure><img src="/files/d8982815154240ab637b79f323235a39b82f910b" alt="召回测试中显示来源名称、相关度和命中片段的结果列表"><figcaption><p>まず検索層が正しい証拠を返していることを証明してから、会話プロンプトを調整します。</p></figcaption></figure>
{% endstep %}

{% step %}

### 5. 会話またはエージェントを確認

検索は正しいのに回答が誤っている場合は、知識ベースが選択またはバインドされているかを確認し、ソースのみに基づいて回答するよう求め、質問をより小さな事実項目に分解します。
{% endstep %}
{% endstepper %}

## 問題はどこに報告すべきか

<figure><img src="/files/04d811002cab21c02f3346c0fdb99e4e217b137c" alt="按不知道如何操作、稳定复现、希望增加能力和不希望整理材料选择反馈路径的关系图"><figcaption><p>まず最小限の切り分けを完了します。安定して再現できる場合は、匿名化した手順、エラー、期待結果を添えます。</p></figcaption></figure>

{% hint style="danger" %}
スクリーンショット、ログ、サンプル資料には、APIキー、内部ファイル内容、メールアドレス、ローカルの機密パスを公開しないでください。
{% endhint %}

## 作成とインポート

<details>

<summary>埋め込みモデルなしで知識ベースを作成できますか？</summary>

はい。【使用しない】を選んでも、BM25のキーワード検索は引き続き使用されます。異なる表現への一致が必要になったら、埋め込みモデルを追加してください。

</details>

<details>

<summary>どのソースとファイル形式がサポートされていますか？</summary>

ソースには、ファイル、Cherry Studioノート、ローカルディレクトリ、Webリンクがあります。ファイル形式には、PDF、DOCX、DOC、PPTX、XLSX、XLS、Markdown、TXT、CSV、HTML、EPUBがあります。

</details>

<details>

<summary>一度に何件追加できますか？</summary>

対話形式で選択できるのは最大20件です。より多くの資料は分けて追加するか、ディレクトリの入口を使用してください。

</details>

<details>

<summary>同名資料は【すべて保持】と【置換】のどちらを選ぶべきですか？</summary>

制度、マニュアル、ノートのスナップショットを更新する場合は、通常【置換】を選びます。実際に共存が必要な版だけ【すべて保持】を選び、名前に日付やバージョンを入れてください。

</details>

<details>

<summary>資料がずっと処理中のままですが、どうすればよいですか？</summary>

ファイルを開けるか、処理器とOCRが利用可能か、モデルサービスが設定済みかを確認します。エラー情報に基づいて、失敗が読み取り、解析、埋め込みのどの段階かを判断します。

</details>

## 解析と検索

<details>

<summary>スキャンPDFに文字がないのはなぜですか？</summary>

スキャン文書にはOCRが必要です。【設定】→【文書処理】を開き、利用可能なOCRを選んでから、文書を再インデックスしてください。複雑なレイアウトでは専用の文書処理器を試せます。

</details>

<details>

<summary>Chunk設定を変更したのに結果が変わらないのはなぜですか？</summary>

新しい設定では、古い資料は自動で再作成されません。関連項目に対して【再インデックス】を実行し、同じ問題で再テストしてください。

</details>

<details>

<summary>検索テストに結果がまったく出ない場合はどうすればよいですか？</summary>

資料の状態、本文に答えが含まれているか、元のキーワードがヒットするか、埋め込みが完了しているか、再ランキングの閾値が高すぎないか、Top Kが小さすぎないかを順に確認します。

</details>

<details>

<summary>ソースは正しいのにチャンクが不完全な場合はどうすればよいですか？</summary>

チャンクを確認し、条件と結論が分断されていないか見ます。必要に応じてChunkや重なりを増やすか、構造が乱れたソース資料を整理されたノートにしてから再インデックスします。

</details>

<details>

<summary>正しい結果が後ろに並びすぎる場合はどうすればよいですか？</summary>

まず重複と古い資料を削除し、それから埋め込みモデルを検討します。候補はおおむね正しいのに順序が不安定な場合は、再ランキングを増やし、閾値を再調整できます。

</details>

<details>

<summary>Top Kはどのくらいに設定すべきですか？</summary>

6から始めて、固定の問題で検索漏れ、ノイズ、所要時間を比較できます。Top Kは1～50の間で調整でき、単に大きくすることを万能の修正と考えないでください。

</details>

## 会話とエージェント

<details>

<summary>会話内の知識ベース入口が使えない場合はどうすればよいですか？</summary>

ツール呼び出しに対応したモデルを選び、現在のメッセージ添付を削除します。さらに、少なくとも1つの知識ベースに準備完了の資料が含まれていることを確認してください。

</details>

<details>

<summary>回答にソースが表示されない場合はどうすればよいですか？</summary>

入力欄で実際に知識ベースが選択されていることを確認し、同じ問題を検索テストに入れます。検索で正しいチャンクが出ない場合は、まず知識ベースを修復します。

</details>

<details>

<summary>検索は正しいのに、回答がまだ不正確な場合はどうすればよいですか？</summary>

モデルに引用のみに基づいて回答するよう求め、タスクをより小さな事実項目に分解し、重要な結論は手動で確認します。この場合、問題は通常プロンプト、モデル、またはコンテキストの構成にあります。

</details>

<details>

<summary>エージェントが知識ベースを見られないのはなぜですか？</summary>

【エージェントを編集】→【知識ベース】を開き、対象のベースを現在のAgentにバインドし、【組み込みツール】で【知識ベース検索】を有効にします。

</details>

<details>

<summary>知識ベース管理は資料を変更しますか？</summary>

はい。【知識ベース管理】では、文書の追加、削除、更新ができます。読み取り専用の作業では有効にしないでください。書き込み操作の前に、対象、影響、ロールバック方法を確認してください。

</details>

## モデル、データ、バックアップ

<details>

<summary>埋め込みモデルの変更で再構築が必要なのはなぜですか？</summary>

異なる埋め込みモデルが生成するベクトルは、そのまま混在させられません。新しいモデルが使えることを確認し、完全なバックアップを保持してから、既存のベクトル索引を再構築してください。

</details>

<details>

<summary>再ランキングと類似度閾値はどのような関係ですか？</summary>

再ランキングは候補チャンクを再採点し、閾値は再ランキング後の低スコア結果を除外します。再ランキングを設定していない場合、知識ベース設定には類似度閾値は表示されません。

</details>

<details>

<summary>ローカル埋め込みモデルをダウンロードしたら完全オフラインになりますか？</summary>

必ずしもそうではありません。解析、OCR、再ランキング、チャットもすべてローカル機能を使って初めて、完全なオフラインフローになります。

</details>

<details>

<summary>元のファイルやWebページを変更すると自動更新されますか？</summary>

されません。ファイル、ノート、Webページはインポート時の内容で資料が作成されます。同名資料を再追加して【置換】を選び、その後で検索テストを完了してください。

</details>

<details>

<summary>軽量バックアップには知識ベースのファイルが含まれますか？</summary>

完全な知識ベースデータファイルは含まれません。移行や削除の前には完全バックアップを使用し、復元後に資料と検索結果を確認してください。

</details>

## 設定の説明：診断ベースライン

| 項目        | 推奨の出発点              | どんな場合にのみ調整するか                 |
| --------- | ------------------- | ----------------------------- |
| Top K     | 6                   | 正しいチャンクが切り取られているか、ノイズが多すぎる    |
| 類似度しきい値   | 再ランキングを設定したら0.0から開始 | 低スコアのノイズが明らかで、正しいチャンクにまだ余裕がある |
| チャンク      | デフォルトのスマート分割を維持     | 条件と結論が分断されている、またはチャンクが長すぎる    |
| 埋め込みモデル   | BM25だけでは不十分なときに追加   | 口語的な言い回しや同義表現で安定してヒットしない      |
| リランキングモデル | 候補は正しいが順序が不安定なときに追加 | 解析エラーや本文欠落の修復には使わない           |

## ユーザー事例

小林さんは「宿泊費基準」の質問にチャットで誤答が返るのに気づきました。まず同じ質問で検索テストを行うと、正しいソースがそもそも出てきません。本文を開くと、2カラムPDFの順序が崩れていることが分かりました。処理器を変更して再インデックスすると、検索は正しくなり、チャットの回答も正常に戻りました。

この過程では解析器の変数を1つだけ変えたため、Top K、Chunk、閾値を同時に大きくして運よく当てるのではなく、根本原因を特定できました。

{% hint style="warning" %}
それでも解決しない場合は、アプリのバージョン、OS、処理器、埋め込み・再ランキングモデル、完全なエラー、匿名化した最小サンプル、検索結果、期待するソースを記録してください。
{% endhint %}

## 続きを読む

<table data-view="cards"><thead><tr><th></th><th></th><th data-hidden data-card-target data-type="content-ref"></th></tr></thead><tbody><tr><td><strong>文書解析とOCR</strong></td><td>スキャン、順序崩れ、表の欠落を解決します。</td><td><a href="/pages/4a183fc375a74312acee8cc1115baf07eeaacdf2">/pages/4a183fc375a74312acee8cc1115baf07eeaacdf2</a></td></tr><tr><td><strong>モデルと検索設定</strong></td><td>埋め込み、再ランキング、閾値、再構築を理解します。</td><td><a href="/pages/552981e5e3388b3c03d9768a3befa7afa506edbe">/pages/552981e5e3388b3c03d9768a3befa7afa506edbe</a></td></tr><tr><td><strong>データ、プライバシー、保守</strong></td><td>バックアップとクラウドサービスの境界を確認します。</td><td><a href="/pages/1731dc3d21dfd63a18e7784003c212f3d875d167">/pages/1731dc3d21dfd63a18e7784003c212f3d875d167</a></td></tr></tbody></table>


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.cherryai.com.cn/docs/jp/knowledge-base/troubleshooting.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
