よくある質問
ナレッジベースの問題に遭遇したら、まず失敗がインポート、解析、分割、検索、回答のどの段階で起きているかを判断します。一度に変える変数は1つだけにすると、どの調整が本当に有効か分かります。
5ステップでの素早い切り分け
3
4
問題はどこにフィードバックすべきか

スクリーンショット、ログ、サンプル資料には API Key、社内ファイルの内容、メールアドレス、ローカルの機密パスを公開しないでください。
作成とインポート
解析と検索
会話と Agent
モデル、データ、バックアップ
設定説明:診断の基準値
項目
推奨の出発点
どんな場合にのみ調整するか
Top K
6
正しい断片が切り落とされる、またはノイズが多すぎる
類似度閾値
再ランキングを設定して 0.0 から開始
低スコアのノイズが目立ち、正しい断片にもまだ余裕がある
Chunk
デフォルトのスマート分割を維持
条件と結論が分断されている、または断片が長すぎる
埋め込みモデル
BM25 で不足する場合に追加
口語的な質問や同義表現で安定してヒットしない
再ランキングモデル
候補は正しいが順序が安定しないときに追加
解析エラーや欠落本文の修復には使わない
ユーザー事例
小林さんは「宿泊費基準」がチャットで誤って答えられることに気づきました。まず同じ質問で検索テストを行うと、正しいソースがまったく出てきませんでした。本文を開くと、2段組PDFの順序が崩れていることが分かりました。プロセッサを変更して再インデックスすると、検索は正しくなり、チャットの回答も正常に戻りました。
この過程では解析器の変数を1つだけ変更したため、Top K、Chunk、閾値を同時にいじって運任せにするのではなく、根本原因を確認できました。
それでも解決しない場合は、アプリのバージョン、OS、プロセッサ、埋め込みモデルと再ランキングモデル、完全なエラー、匿名化した最小サンプル、検索結果、期待するソースを記録してください。
続きを読む
最終更新
役に立ちましたか?

