For the complete documentation index, see llms.txt. This page is also available as Markdown.

全局記憶

一般對話入面嘅 AI 冇長期記憶 —— 每開一個新話題,都要重新自我介紹。

全局記憶為 AI 提供長期記憶能力:開啟之後,AI 會跨對話記住同你有關嘅關鍵資訊(職業、偏好、慣用語氣、長期事實等),新對話可以直接調用。

推薦先閱讀 概念入門 搞清記憶同其他功能之間嘅關係。

開啟前要準備兩樣嘢

全局記憶涉及兩類工作:

  • 理解同整理記憶:需要一個對話模型(同平時聊天用嘅同類)

  • 儲存同檢索記憶:需要一個「嵌入模型」

嵌入模型嘅作用係將每條記憶轉成數字向量,AI 透過比較向量相似度快速搵出相關記憶。呢類專用細模型體積細、速度快、調用成本低。

請先喺 設定 → 模型服務 入面配置好至少一個 Provider,並 同時添加一個對話模型同一個嵌入模型。以 CherryIN 為例:喺 Provider 詳情頁撳 取得模型列表,喺彈窗頂部切到「嵌入」分類,至少加 1 個(推薦 bge-m3 或者 text-embedding-3-small)。

開啟全局記憶

  1. 打開 設定 → 全局記憶

  2. 撳右上角 全局記憶 開關

未啟用狀態:右上角灰色開關 + 空狀態「暫無記憶」

開關第一次打開時,會自動彈出 記憶設定 對話框,要求選擇模型:

必填項:LLM 模型 + 嵌入模型
  • LLM 模型:揀任何一個你已配置嘅對話模型

  • 嵌入模型:揀任何一個你已添加嘅 Embedding 模型

  • 嵌入維度:可以留空,由 Embedding 模型預設維度自動決定

填完之後撳 確定。系統級別嘅全局記憶就咁開啟完成。

仲要喺每個助手入面「都」開一次

步驟:

  1. 入到對話頁,撳助手列表入面嘅目標助手 → 編輯(或者喺助手庫建立新助手時)

  2. 喺助手設定入面搵到 全局記憶 開關,撳開佢

  3. 之後嗰個助手喺新對話入面會自動讀取同更新記憶庫

先為常用嘅「預設助手」開一次,之後就一勞永逸。

嵌入模型下拉顯示「暫無數據」點算

最常見嘅卡位:你揀完 LLM 模型之後,嵌入模型下拉係「暫無數據」。

典型卡位:LLM 已揀(CherryIN),嵌入下拉顯示「暫無數據」

原因:你嘅 Provider 入面冇任何 Embedding 模型可以揀。解決方法:

  1. 關閉而家個對話框(撳 取消

  2. 前往 設定 → 模型服務 → 你嘅 Provider

  3. 取得模型列表,喺彈窗頂部 Tab 切到 嵌入

  4. 添加 1–2 個嵌入模型(例如 bge-m3text-embedding-3-small 等)

  5. 返去 設定 → 全局記憶,重新打開開關

用戶管理

全局記憶係按「用戶」分組。預設提供一個 預設用戶,你亦可以為家人或者團隊成員分別建立獨立嘅記憶庫:

  • 用戶管理 右邊 +👤 圖示 → 輸入新用戶 ID 建立

  • 切換唔同用戶之後,下方 記憶列表 同統計會獨立顯示

添加、查看同刪除記憶

開啟之後:

  • 添加你第一條記憶 或者 + 添加記憶,喺彈窗入面輸入內容然後儲存

  • 透過 搜尋記憶… 輸入框可以按關鍵字篩選

  • 每條記憶都可以單獨編輯或者刪除

  • 喺更多操作選單入面可選 重置記憶 / 重置用戶記憶,清空而家呢個用戶嘅全部記憶(不可恢復,請小心使用)

Token 消耗

開啟全局記憶之後,每次對話都會額外消耗一定 token:

  • 提取問題向量、檢索候選記憶

  • 令 LLM 評估需唔需要寫入新記憶 + 寫入操作

如果對成本敏感,可以只喺最常用嘅 1-2 個助手入面開啟全局記憶,其他助手維持關閉。

全局記憶而家處於 Beta 階段,未來版本可能會調整入口同欄位命名,本頁以應用內實際顯示為準。

提示同技巧

  • 第一次啟用之後,可以喺 添加你第一條記憶 入面寫一條 關於你自己嘅簡介(職業、關注方向、偏好語氣等),後續對話會自動參考

  • 如果唔想某啲助手用記憶,請到該助手設定入面單獨關閉「全局記憶」

  • 長期使用建議定期清理過時記憶,避免污染上下文


💡 獲取幫助與提交反饋

如果您喺配置或者使用過程中遇到任何疑問、Bug 或有功能改進建議,請參考 反饋與建議 入面提供嘅官方渠道。

最後更新

呢個有冇幫助?