最後更新
呢個有冇幫助?
LM Studio 係一款流行嘅本地大模型 GUI,支援下載、量化同喺本機推理各種開源模型。Cherry Studio 可以做前端連接到 LM Studio 嘅本地服務,喺保留本地私隱嘅同時獲得更好嘅對話體驗。
由 LM Studio 官網 下載同安裝客戶端
喺 LM Studio 入面下載至少一個模型(推薦先試 Llama 3.x 8B 或 Qwen 系列)
打開 LM Studio 頂部 Server Tab,撳 Start Server(預設端口 1234)
打開 設定 → 模型服務,搵到 LM Studio Provider 入去詳情頁
API 地址 預設 http://localhost:1234,如果改過 LM Studio 端口,請同步修改
API 密鑰 可留空(本地推理唔需要鑑權),或者喺 LM Studio 入面開啟鑑權後填入
撳 獲取模型列表,Cherry Studio 會自動拉取 LM Studio 已載入嘅模型
模型列表係空嘅? LM Studio 只會暴露已 Load 到記憶體嘅模型,冇 Load 嘅唔會出喺列表入面。返去 LM Studio 先 Load 模型,再嚟「獲取模型列表」。
私隱敏感對話
揀細模型(8B 以下)喺本機跑,完全離線
Apple Silicon(M 系晶片)
LM Studio 用 MLX 後端,效率明顯高過 llama.cpp
嵌入模型
LM Studio 亦可載入嵌入模型,用於 全局記憶 同知識庫
形態
圖形介面 + Server
命令列 / 後台服務
模型管理
GUI 瀏覽/下載
ollama pull
API
OpenAI 相容
OpenAI 相容
適合
偏好圖形互動嘅用戶
偏好命令列 / Docker 部署
兩者都可以接入 Cherry Studio,按個人偏好揀就得。
Cherry Studio 連唔上:確認 LM Studio 入面嘅 Server 係咪已經 Start(綠點狀態)
回應超慢:模型太大/顯存不足,換細啲嘅模型或者更大量化(例如 Q4 → Q3)
亂碼/輸出截斷:上下文長度超過模型限制,喺 LM Studio 入面調高 n_ctx
如果您喺配置或使用過程中遇到任何疑問、Bug 或有功能改進建議,請參考 反饋同建議 入面提供嘅官方渠道。
最後更新
呢個有冇幫助?
呢個有冇幫助?