> For the complete documentation index, see [llms.txt](https://docs.cherryai.com.cn/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.cherryai.com.cn/docs/jp/knowledge-base/sources.md).

# 資料の追加と整理

ナレッジベースはファイル、Cherry Studio のノート、ローカルディレクトリ、単一のWebページURLをサポートします。インポート後は処理状態、本文、Chunks を確認し、資料が更新されたら再インデックスしてください。

{% hint style="info" %}
完了基準は「ファイルが一覧に表示されたこと」ではなく、資料が読めて、Chunks が完全で、実際の質問で正しい出典を呼び出せることです。
{% endhint %}

## 正しい入口を選ぶ

<figure><img src="/files/82377b2a71ca10f68f1abd005dfc4bf682ba9635" alt="知识库中的文件、笔记、目录和链接四种资料入口"><figcaption><p>資料の出所に応じて入口を選択します。少量のファイルは【ファイル】、同種ファイルの集まりは【ディレクトリ】、Cherry Studio の内容は【ノート】、公開Webページは【リンク】を使います。</p></figcaption></figure>

| 入口     | どのような資料に適しているか             | インポート後の関係                | 主な注意事項                                      |
| ------ | -------------------------- | ------------------------ | ------------------------------------------- |
| ファイル   | PDF、Office、Markdown、テキストなど | ホストされたコピーを保存する           | 一度に最大20項目まで選択可能                             |
| ノート    | Cherry Studio で整理済みの内容     | インポート時点の内容スナップショット       | 元のノートへのその後の変更は自動同期されません                     |
| ディレクトリ | 同じテーマのローカルファイルの一群          | ディレクトリ内容に基づいて資料エントリを作成する | 関係のないディレクトリをまとめてインポートしないでください               |
| リンク    | 単一の公開アクセス可能なWebページ         | 取得時点のWebページスナップショットを保存する | ログインページ、スクリプト描画、またはアクセス制限のあるページは不完全な場合があります |

{% hint style="warning" %}
サポートされるファイルには PDF、DOCX、DOC、PPTX、XLSX、XLS、MD、TXT、CSV、HTML、EPUB が含まれます。スキャン版PDFや画像ベースの内容は OCR の確認も必要です。
{% endhint %}

## 資料の追加と検収

{% stepper %}
{% step %}

### 1. 資料ソースを選ぶ

ナレッジベースを開き、資料追加ボタンをクリックして、【ファイル】、【ノート】、【ディレクトリ】、または【リンク】を選択します。
{% endstep %}

{% step %}

### 2. 選択した内容を確認する

ファイルとノートはまとめて選択できます。一度の対話的追加は最大20項目までです。資料が多い場合は分割して追加するか、ディレクトリエントリを使用してください。
{% endstep %}

{% step %}

### 3. 同名の競合を処理する

新しい資料と既存エントリが同名の場合は、【すべて保持】または【置換】を選択します。制度、マニュアル、ノートのスナップショットを更新する場合は通常【置換】を選びます。

{% hint style="warning" %}
【すべて保持】を選ぶと、新旧両方の内容が検索対象になります。異なる版を並行して検索する必要が本当にある場合だけそうし、名前に日付や版を明記してください。
{% endhint %}
{% endstep %}

{% step %}

### 4. 処理完了を待つ

資料はコピー、読み取り、分割、インデックス作成などの段階を経ます。埋め込みモデルが未設定の場合はベクトルは作成されませんが、キーワードインデックスは作成されます。

<figure><img src="/files/33438f8060e398ac476e2ef4640044bcd0903fa7" alt="包含多条已处理资料的员工差旅制度知识库"><figcaption><p>資料が利用可能な状態になったら、本文と Chunks を抽出確認してください。</p></figcaption></figure>
{% endstep %}

{% step %}

### 5. 本文と Chunks を抽出確認する

資料を開いて本文を確認するか、資料行のメニューから Chunks を確認します。見出しの順序、表、OCR テキスト、重要な文が誤って分割されていないかを重点的に確認してください。
{% endstep %}

{% step %}

### 6. 検索テストを完了する

答えが一意に定まる質問を使って、正しい出典と断片が呼び出せるか確認します。資料を更新した後も、同じ質問セットで再テストしてください。

<figure><img src="/files/d8982815154240ab637b79f323235a39b82f910b" alt="召回测试中的来源、相关度、片段内容和排序"><figcaption><p>最終検収では、結果が返るかどうかだけでなく、出典、断片の完全性、並び順を確認します。</p></figcaption></figure>
{% endstep %}
{% endstepper %}

## 資料の状態と対処方法

| 現象                  | 考えられる原因                           | 対処方法                         |
| ------------------- | --------------------------------- | ---------------------------- |
| 長時間処理中              | ファイルが大きい、パーサーまたはモデルが利用不可          | 元ファイル、ドキュメント処理、埋め込みモデルを確認する  |
| エラーを表示              | コピー、読み取り、分割、またはインデックス作成に失敗        | エラーメッセージを開き、失敗した段階に応じて対処する   |
| 本文が欠落または文字化け        | ファイル処理器が適していない、スキャン内容が OCR されていない | ドキュメント処理方法を変更するか、OCR を設定する   |
| Chunk に重要な文が含まれていない | 分割境界が適切でない                        | 分割を調整してから【再インデックス】を実行する      |
| 新旧バージョンの両方がヒットする    | 同名資料で【すべて保持】を選択した                 | 古いエントリを削除するか、再インポートして【置換】を選ぶ |

## 再インデックスと削除

分割、パーサー、または埋め込み設定を変更しても、既存エントリには自動で新設定は適用されません。単一の資料に【再インデックス】を実行するか、資料をまとめて選択して再インデックスしてください。

{% hint style="danger" %}
エントリを削除すると、現在のナレッジベース内にあるホストコピーとインデックスが削除されます。元のファイルや元のノートは削除されませんが、削除前にナレッジベース内に唯一のコピーがないか必ず確認してください。
{% endhint %}

## 設定説明

| 設定項目     | 製品のデフォルト値 | 推奨開始値            | 役割                        | 適用シーン                      | 注意事項                       |
| -------- | --------- | ---------------- | ------------------------- | -------------------------- | -------------------------- |
| 一度に追加する数 | 最大20項目    | まず少量の代表的な資料を追加する | 一度のインポート規模を抑える            | 初回のナレッジベース作成またはトラブルシューティング | 大量インポートの前に、解析と検索を先に検証する    |
| 同名の処理    | 競合時に選ぶ    | 更新資料は【置換】を優先する   | 新旧エントリを共存させるかを決める         | 制度、マニュアル、ノートの更新            | 【すべて保持】では古い内容が検索に混ざる可能性がある |
| 再インデックス  | 手動で実行する   | 設定変更後に実行する       | 古い資料に新しい解析、分割、またはモデルを適用する | 資料を調整または修復する               | 完了後は必ず検索テストをやり直す           |

## ユーザー事例

小林さんは毎月出張規程を更新しています。新しいファイルを同じ名前でインポートし、【置換】を選択します。資料の処理が終わったら本文と Chunks を抽出確認し、固定の質問で宿泊、交通、承認ルールをテストします。

完了基準は、古い規則が検索結果に出てこないこと、新しい規則の条件と金額が安定してヒットすることです。

## よくある質問

<details>

<summary>元のノートを変更すると、ナレッジベースは自動更新されますか？</summary>

いいえ。ノートのインポートはその時点の内容スナップショットです。変更後は再度追加して【置換】を選ぶか、該当資料に【再インデックス】を実行してください。

</details>

<details>

<summary>Webページはなぜ一部しか取得されないのですか？</summary>

ログインが必要、スクリプト描画に依存している、またはアクセス制限があるWebページは完全に取得できない場合があります。本文をファイルまたはノートとして保存してからインポートする方法に切り替えられます。

</details>

<details>

<summary>ナレッジベースのエントリを削除すると元ファイルも削除されますか？</summary>

元のファイルや元のノートは削除されませんが、ナレッジベース内のホストコピーとインデックスは削除されます。

</details>

## 続きを読む

<table data-view="cards"><thead><tr><th></th><th></th><th data-hidden data-card-target data-type="content-ref"></th></tr></thead><tbody><tr><td><strong>ドキュメント解析とOCR</strong></td><td>本文の欠落、文字化け、スキャン内容を処理する。</td><td><a href="/pages/4a183fc375a74312acee8cc1115baf07eeaacdf2">/pages/4a183fc375a74312acee8cc1115baf07eeaacdf2</a></td></tr><tr><td><strong>資料とリコールを確認する</strong></td><td>固定の質問で検索品質を検証する。</td><td><a href="/pages/e3b03b5648a5fd135fedd068ff34a7f23055261c">/pages/e3b03b5648a5fd135fedd068ff34a7f23055261c</a></td></tr><tr><td><strong>データ、プライバシー、保守</strong></td><td>バックアップ、削除、サービス境界について理解する。</td><td><a href="/pages/1731dc3d21dfd63a18e7784003c212f3d875d167">/pages/1731dc3d21dfd63a18e7784003c212f3d875d167</a></td></tr></tbody></table>


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.cherryai.com.cn/docs/jp/knowledge-base/sources.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
