> For the complete documentation index, see [llms.txt](https://docs.cherryai.com.cn/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.cherryai.com.cn/docs/russian/knowledge-base/sources.md).

# Добавление и организация материалов

База знаний поддерживает файлы, заметки Cherry Studio, локальные каталоги и один веб-адрес. После импорта также нужно проверить статус обработки, основной текст и чанки, а при обновлении материалов — выполнить повторную индексацию.

{% hint style="info" %}
Критерий завершения — не «файл уже появился в списке», а то, что материал читается, чанки полные и реальные вопросы возвращают правильный источник.
{% endhint %}

## Выберите правильный вход

<figure><img src="/files/77fc943b4bbb69d5840dcad640406e0a5e5464cd" alt="知识库中的文件、笔记、目录和链接四种资料入口"><figcaption><p>Выбирайте вход в зависимости от источника материала: для небольшого числа файлов — «Файл», для набора однотипных файлов — «Каталог», для содержимого Cherry Studio — «Заметки», для публичных веб-страниц — «Ссылка».</p></figcaption></figure>

| Вход    | Для каких материалов подходит                  | Связь после импорта                                      | Основные замечания                                                                                |
| ------- | ---------------------------------------------- | -------------------------------------------------------- | ------------------------------------------------------------------------------------------------- |
| Файл    | PDF, Office, Markdown, текстовые и другие      | Сохранить размещённую копию                              | Не более 20 элементов за один раз                                                                 |
| Заметки | Содержимое, уже организованное в Cherry Studio | Снимок содержимого на момент импорта                     | Последующие изменения исходной заметки не синхронизируются автоматически                          |
| Каталог | Набор локальных файлов по одной теме           | Создать записи материалов на основе содержимого каталога | Не импортируйте целиком нерелевантные каталоги                                                    |
| Ссылка  | Одна публично доступная веб-страница           | Сохранить снимок веб-страницы при сканировании           | Страницы входа, рендеринг через скрипты или страницы с ограниченным доступом могут быть неполными |

{% hint style="warning" %}
Поддерживаются файлы PDF, DOCX, DOC, PPTX, XLSX, XLS, MD, TXT, CSV, HTML и EPUB. Для отсканированных PDF или контента в виде изображений также нужно проверить OCR.
{% endhint %}

## Добавить и принять материалы

{% stepper %}
{% step %}

### 1. Выберите источник материалов

Откройте базу знаний, нажмите кнопку добавления материалов и выберите «Файл», «Заметка», «Каталог» или «Ссылка».
{% endstep %}

{% step %}

### 2. Подтвердите выбранное содержимое

Файлы и заметки можно выбирать пакетно; за одну интерактивную операцию можно добавить не более 20 элементов. Если материалов больше, добавляйте их по частям или используйте вход через каталог.
{% endstep %}

{% step %}

### 3. Обработайте конфликт одинаковых имён

Если новый материал имеет то же имя, что и существующая запись, выберите «Оставить все» или «Заменить». При обновлении регламентов, руководств и снимков заметок обычно выбирают «Заменить».

{% hint style="warning" %}
Выбор «Оставить все» позволит старому и новому содержимому одновременно участвовать в выдаче. Делайте так только если действительно нужно параллельно искать разные версии, и указывайте в названии дату или версию.
{% endhint %}
{% endstep %}

{% step %}

### 4. Дождитесь завершения обработки

Материал проходит этапы копирования, чтения, разбиения и индексирования. Если не настроена модель эмбеддингов, векторы не создаются, но индекс по ключевым словам всё равно строится.

<figure><img src="/files/1cf4d0a00254df70879003cbc51ada96ac36c215" alt="包含多条已处理资料的员工差旅制度知识库"><figcaption><p>После того как материал станет доступен, проверьте основной текст и чанки.</p></figcaption></figure>
{% endstep %}

{% step %}

### 5. Проверьте основной текст и чанки

Откройте материал, чтобы посмотреть основной текст, или проверьте чанки через меню строки материала. Особое внимание уделите порядку заголовков, таблицам, OCR-тексту и тому, не были ли ключевые предложения ошибочно разделены.
{% endstep %}

{% step %}

### 6. Завершите тест выдачи

Проверьте правильный источник и фрагмент с помощью вопроса, на который есть однозначный ответ. После обновления материала также повторно протестируйте тем же набором вопросов.

<figure><img src="/files/1e072bb8082483e7bfbf7dab3b4aa1e770755b45" alt="召回测试中的来源、相关度、片段内容和排序"><figcaption><p>Итоговая приёмка должна смотреть на источник, полноту фрагмента и порядок ранжирования, а не только на то, возвращается ли результат.</p></figcaption></figure>
{% endstep %}
{% endstepper %}

## Статус материала и способы обработки

| Симптом                                  | Возможная причина                                                         | Способ обработки                                                               |
| ---------------------------------------- | ------------------------------------------------------------------------- | ------------------------------------------------------------------------------ |
| Долго обрабатывается                     | Большой файл, парсер или модель недоступны                                | Проверьте исходный файл, обработку документа и модель эмбеддингов              |
| Отображается ошибка                      | Сбой при копировании, чтении, разбиении или индексировании                | Откройте сообщение об ошибке и устраните проблему на этапе, где произошёл сбой |
| Основной текст отсутствует или искажён   | Не подходит обработчик файла, отсканированный контент не прошёл OCR       | Измените способ обработки документа или настройте OCR                          |
| В чанке отсутствует ключевое предложение | Неподходящие границы разбиения                                            | После настройки разбиения выполните «Повторную индексацию»                     |
| Старые и новые версии совпадают          | При выборе для материалов с одинаковым именем использовано «Оставить все» | Удалите старую запись или импортируйте снова и выберите «Заменить»             |

## Повторная индексация и удаление

После изменения настроек разбиения, парсера или эмбеддингов старые записи не будут автоматически использовать новые настройки. Используйте «Повторную индексацию» для отдельного материала или выберите несколько материалов и выполните повторную индексацию.

{% hint style="danger" %}
Удаление записи удаляет размещённую копию и индекс в текущей базе знаний. Это не удаляет исходный файл или исходную заметку, но перед удалением всё же проверьте, является ли база знаний единственной копией.
{% endhint %}

## Описание конфигурации

| Параметр конфигурации         | Значение по умолчанию в продукте | Рекомендуемая отправная точка                                | Роль                                                                         | Сценарий применения                          | Примечания                                                                             |
| ----------------------------- | -------------------------------- | ------------------------------------------------------------ | ---------------------------------------------------------------------------- | -------------------------------------------- | -------------------------------------------------------------------------------------- |
| Количество за одно добавление | До 20 элементов                  | Сначала добавьте небольшое число репрезентативных материалов | Контролируйте объём одного импорта                                           | Первичное создание базы или отладка          | Перед массовым импортом сначала проверьте парсинг и выдачу                             |
| Обработка одинаковых имён     | Выберите при конфликте           | Для обновляемых материалов предпочтительнее «Заменить»       | Определяет, будут ли новые и старые записи сосуществовать                    | Обновление регламентов, руководств и заметок | «Оставить все» может привести к тому, что старое содержимое будет участвовать в выдаче |
| Повторная индексация          | Выполнить вручную                | Выполнить после изменения настроек                           | Позволяет старым материалам использовать новый парсинг, разбиение или модель | Настройка или исправление материала          | После завершения обязательно снова выполните тест выдачи                               |

## Кейс пользователя

Сяо Линь каждый месяц обновляет правила командировок. Он импортирует новый файл с тем же именем и выбирает «Заменить», а после завершения обработки выборочно проверяет основной текст и чанки, затем тестирует правила проживания, транспорта и согласования с помощью фиксированных вопросов.

Критерий завершения: старые правила больше не появляются в результатах выдачи, а условия и суммы новых правил стабильно находятся.

## Частые вопросы

<details>

<summary>Если изменить исходную заметку, база знаний обновится автоматически?</summary>

Нет. При импорте заметки сохраняется снимок её содержимого на тот момент. После изменений нужно добавить её заново и выбрать «Заменить», либо выполнить «Повторную индексацию» для соответствующего материала.

</details>

<details>

<summary>Почему с веб-страницы захватывается только часть содержимого?</summary>

Страницы, требующие входа, зависящие от рендеринга скриптами или имеющие ограничения доступа, могут не захватываться полностью. Можно сохранить основной текст в файл или заметку и затем импортировать их.

</details>

<details>

<summary>Удаление записи базы знаний удаляет исходный файл?</summary>

Нет, исходный файл или исходная заметка не удаляются, но размещённая копия и индекс в базе знаний удаляются.

</details>

## Продолжить чтение

<table data-view="cards"><thead><tr><th></th><th></th><th data-hidden data-card-target data-type="content-ref"></th></tr></thead><tbody><tr><td><strong>Парсинг документов и OCR</strong></td><td>Работа с отсутствующим основным текстом, искажениями и отсканированным содержимым.</td><td><a href="/pages/53bb043e136eac8710d3cc6e17df25221eec9694">/pages/53bb043e136eac8710d3cc6e17df25221eec9694</a></td></tr><tr><td><strong>Проверка материалов и извлечения</strong></td><td>Проверьте качество поиска с помощью фиксированных вопросов.</td><td><a href="/pages/cb186404cc8d9f393c6d0efdfa6b1a265c83510f">/pages/cb186404cc8d9f393c6d0efdfa6b1a265c83510f</a></td></tr><tr><td><strong>Данные, конфиденциальность и обслуживание</strong></td><td>Изучите границы резервного копирования, удаления и сервиса.</td><td><a href="/pages/c8a6f1b5836ae79ec3b4c719c9c7f566343b544e">/pages/c8a6f1b5836ae79ec3b4c719c9c7f566343b544e</a></td></tr></tbody></table>


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.cherryai.com.cn/docs/russian/knowledge-base/sources.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
