> For the complete documentation index, see [llms.txt](https://docs.cherryai.com.cn/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.cherryai.com.cn/docs/jp/knowledge-base/sources.md).

# 資料の追加と整理

ナレッジベースはファイル、Cherry Studio のノート、ローカルディレクトリ、単一のWebアドレスに対応しています。インポート後は、処理状態、本文、Chunks を確認し、資料が更新されたら再インデックスしてください。

{% hint style="info" %}
完了基準は「ファイルが一覧に表示されたこと」ではなく、資料が読めて、Chunks が完全で、実際の質問で正しい参照元を呼び出せることです。
{% endhint %}

## 正しい入口を選ぶ

<figure><img src="/files/82377b2a71ca10f68f1abd005dfc4bf682ba9635" alt="知识库中的文件、笔记、目录和链接四种资料入口"><figcaption><p>資料の種類に応じて入口を選びます。少量のファイルは【ファイル】、同種ファイルの集合は【ディレクトリ】、Cherry Studio の内容は【ノート】、公開Webページは【リンク】です。</p></figcaption></figure>

| 入口     | どんな資料に適しているか               | インポート後の関係                 | 主な注意事項                                         |
| ------ | -------------------------- | ------------------------- | ---------------------------------------------- |
| ファイル   | PDF、Office、Markdown、テキストなど | ホストされたコピーを保存する            | 一度に最大20項目まで選択可能                                |
| ノート    | Cherry Studio で整理済みの内容     | インポート時点の内容スナップショット        | 元のノートを後で変更しても自動同期されません                         |
| ディレクトリ | 同じテーマに属する一群のローカルファイル       | ディレクトリの内容に基づいて資料エントリを作成する | 無関係なディレクトリをまとめてインポートしない                        |
| リンク    | 単独で公開アクセス可能なWebページ         | 取得時点のWebページのスナップショットを保存する | ログインページ、スクリプト描画、またはアクセス制限のあるページは不完全になる可能性があります |

{% hint style="warning" %}
対応ファイルには PDF、DOCX、DOC、PPTX、XLSX、XLS、MD、TXT、CSV、HTML、EPUB が含まれます。スキャン版PDFや画像ベースの内容では OCR の確認も必要です。
{% endhint %}

## 資料を追加して確認する

{% stepper %}
{% step %}

### 1. 資料ソースを選択する

ナレッジベースを開き、資料追加ボタンをクリックして、【ファイル】、【ノート】、【ディレクトリ】、または【リンク】を選択します。
{% endstep %}

{% step %}

### 2. 選択した内容を確認する

ファイルとノートは一括選択できます。一度の対話的追加は最大20項目です。資料が多い場合は分割して追加するか、ディレクトリ入口を使用してください。
{% endstep %}

{% step %}

### 3. 同名の競合を処理する

新しい資料が既存エントリと同名の場合は、【すべて保持】または【置換】を選びます。制度、マニュアル、ノートのスナップショットを更新する場合は、通常【置換】を選びます。

{% hint style="warning" %}
【すべて保持】を選ぶと、新旧両方の内容が検索に参加します。どうしても異なる版を並行して検索する必要がある場合だけにし、名称に日付や版番号を明記してください。
{% endhint %}
{% endstep %}

{% step %}

### 4. 処理の完了を待つ

資料はコピー、読み取り、分割、インデックス作成などの段階を経ます。埋め込みモデルを設定していない場合はベクトルは作成されませんが、キーワードインデックスは作成されます。

<figure><img src="/files/33438f8060e398ac476e2ef4640044bcd0903fa7" alt="包含多条已处理资料的员工差旅制度知识库"><figcaption><p>資料が利用可能な状態になったら、本文とChunksを抽出確認してください。</p></figcaption></figure>
{% endstep %}

{% step %}

### 5. 本文とChunksを抽出確認する

資料を開いて本文を確認するか、資料行のメニューから Chunks を表示します。見出しの順序、表、OCR テキスト、重要文が誤って分割されていないかを重点的に確認してください。
{% endstep %}

{% step %}

### 6. 検索テストを完了する

答えが明確に出る質問で、正しい参照元と断片が返るか確認します。資料を更新した後も、同じ質問セットで再テストしてください。

<figure><img src="/files/d8982815154240ab637b79f323235a39b82f910b" alt="召回测试中的来源、相关度、片段内容和排序"><figcaption><p>最終確認では、結果が返るかどうかだけでなく、参照元、断片の完全性、並び順を見ます。</p></figcaption></figure>
{% endstep %}
{% endstepper %}

## 資料の状態と対処方法

| 現象               | 考えられる原因                       | 対処方法                         |
| ---------------- | ----------------------------- | ---------------------------- |
| 長時間処理中           | ファイルが大きい、パーサーまたはモデルが利用不可      | 元ファイル、文書処理、埋め込みモデルを確認する      |
| エラー表示            | コピー、読み取り、分割、またはインデックス作成に失敗    | エラーメッセージを開き、失敗した段階に応じて対処する   |
| 本文の欠落または文字化け     | ファイル処理器が適合していない、スキャン内容にOCRがない | 文書の処理方法を変更するか、OCRを設定する       |
| Chunk に重要文がない    | 分割境界が適切でない                    | 分割を調整してから【再インデックス】を実行する      |
| 新旧バージョンが同時にヒットする | 同名資料で【すべて保持】を選んだ              | 古いエントリを削除するか、再インポートして【置換】を選ぶ |

## 再インデックスと削除

分割、パーサー、または埋め込み設定を変更しても、既存エントリには自動で新設定は適用されません。単一の資料に【再インデックス】を実行するか、資料をまとめて選択して再インデックスしてください。

{% hint style="danger" %}
エントリを削除すると、現在のナレッジベースにあるホストされたコピーとインデックスが削除されます。元のファイルや元のノートは削除されませんが、削除前にナレッジベース内に唯一のコピーがないか確認してください。
{% endhint %}

## 設定の説明

| 設定項目     | 製品のデフォルト値 | 推奨の開始値           | 役割                        | 適用場面                | 注意事項                        |
| -------- | --------- | ---------------- | ------------------------- | ------------------- | --------------------------- |
| 一度に追加する数 | 最大20項目    | まず少数の代表的な資料を追加する | 一度のインポート規模を抑える            | 初回のベース作成またはトラブルシュート | 大量インポート前に解析と検索を先に検証する       |
| 同名処理     | 競合時に選択する  | 資料更新時は【置換】を優先する  | 新旧エントリを共存させるかどうかを決める      | 制度、マニュアル、ノートの更新     | 【すべて保持】では古い内容が検索に含まれる可能性がある |
| 再インデックス  | 手動実行      | 設定変更後に実行する       | 古い資料に新しい解析、分割、またはモデルを適用する | 資料を調整または修復する        | 完了後は必ず検索テストをやり直す            |

## ユーザー事例

小林さんは毎月出張規定を更新しています。彼は新しいファイルを同じ名前でインポートし、【置換】を選択します。資料処理が完了したら本文とChunksを抽出確認し、固定の質問で宿泊、交通、承認ルールをテストします。

完了基準は、古い規則が検索結果に出ないこと、新しい規則の条件と金額が安定してヒットすることです。

## よくある質問

<details>

<summary>元のノートを変更すると、ナレッジベースは自動更新されますか？</summary>

いいえ。ノートはその時点の内容のスナップショットとしてインポートされます。変更後は再追加して【置換】を選ぶか、対応する資料に【再インデックス】を実行する必要があります。

</details>

<details>

<summary>Webページの一部しか取得されないのはなぜですか？</summary>

ログインが必要なページ、スクリプト描画に依存するページ、またはアクセス制限のあるページは完全に取得できない場合があります。本文をファイルやノートに保存してからインポートする方法に切り替えられます。

</details>

<details>

<summary>ナレッジベースのエントリを削除すると元ファイルも削除されますか？</summary>

元ファイルや元のノートは削除されませんが、ナレッジベース内のホストされたコピーとインデックスは削除されます。

</details>

## 続きを読む

<table data-view="cards"><thead><tr><th></th><th></th><th data-hidden data-card-target data-type="content-ref"></th></tr></thead><tbody><tr><td><strong>文書解析とOCR</strong></td><td>本文の欠落、文字化け、スキャン文書を処理する。</td><td><a href="/pages/4a183fc375a74312acee8cc1115baf07eeaacdf2">/pages/4a183fc375a74312acee8cc1115baf07eeaacdf2</a></td></tr><tr><td><strong>資料と再現を確認する</strong></td><td>固定の質問で検索品質を検収する。</td><td><a href="/pages/e3b03b5648a5fd135fedd068ff34a7f23055261c">/pages/e3b03b5648a5fd135fedd068ff34a7f23055261c</a></td></tr><tr><td><strong>データ、プライバシー、保守</strong></td><td>バックアップ、削除、サービスの境界について理解する。</td><td><a href="/pages/1731dc3d21dfd63a18e7784003c212f3d875d167">/pages/1731dc3d21dfd63a18e7784003c212f3d875d167</a></td></tr></tbody></table>


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.cherryai.com.cn/docs/jp/knowledge-base/sources.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
