For the complete documentation index, see llms.txt. This page is also available as Markdown.

LM Studio

LM Studio 係一款流行嘅 本地大模型圖形介面,支援下載、量化,同埋喺本機推理各種開源模型。Cherry Studio 可以做前端連接到 LM Studio 嘅本地服務,喺保留本地私隱嘅同時獲得更好嘅對話體驗。

前置準備

  1. LM Studio 官網 下載並安裝客戶端

  2. 喺 LM Studio 入面下載至少一個模型(建議先試 Llama 3.x 8B 或 Qwen 系列)

  3. 打開 LM Studio 頂部 Server Tab,撳 Start Server(默認端口 1234

喺 Cherry Studio 配置

  • 打開 設定 → 模型服務,搵到 LM Studio Provider 入去詳情頁

  • API 地址 預設 http://localhost:1234,如果改咗 LM Studio 端口請同步修改

  • API 密鑰 可留空(本機推理無需鑑權),或喺 LM Studio 中開啟鑑權後填入

  • 獲取模型列表,Cherry Studio 會自動攞取 LM Studio 已載入嘅模型

模型列表係空嘅? LM Studio 只會暴露 Load 入內存 嘅模型,冇 Load 嘅唔會出現喺列表入面。返去 LM Studio 先 Load 模型,再嚟「獲取模型列表」。

推薦用法

場景
建議

私隱敏感對話

揀細模型(8B 以下)喺本機跑,完全離線

Apple Silicon(M 系晶片)

LM Studio 用 MLX 後端,效率明顯高過 llama.cpp

嵌入模型

LM Studio 都可以載入嵌入模型,用嚟做知識庫

同 Ollama 嘅分別

LM Studio

Ollama

形態

圖形介面 + Server

命令行 / 後台服務

模型管理

GUI 瀏覽/下載

ollama pull

API

OpenAI 相容

OpenAI 相容

適合

偏好圖形互動嘅用戶

偏好命令行/Docker 部署

兩者都可以接入 Cherry Studio,按個人偏好揀就得。

常見問題

  • Cherry Studio 連唔上:確認 LM Studio 入面嘅 Server 係咪已經 Start(綠點狀態)

  • 回應超慢:模型太大/顯存唔夠,換細啲模型或者量化得再多啲(例如 Q4 → Q3)

  • 亂碼/輸出截斷:上下文長度超過模型限制,喺 LM Studio 中調高 n_ctx


攞幫助同提交意見

如果您喺配置或使用過程中遇到任何疑問、Bug 或有功能改善建議,請參考 反饋與建議 入面提供嘅官方渠道。

最後更新

呢個有冇幫助?