对话-助手
对话界面是 Cherry Studio 最常用的页面,但其结构包含 两个层次:助手 → 对话。理解这一结构有助于更高效地使用各类对话功能。
助手与对话的关系
简单类比:
助手 = 一个角色(如"产品文档助理"、"代码 reviewer")
对话 = 与该角色的一段交流(如周一讨论"重构方案"、周二讨论"bug 报告")
也就是说:一个助手下可创建多个对话,所有对话共用该助手的人设与参数(提示词、模型、温度等),无需每次重新设定 AI 的角色与风格。
助手
助手为 AI 设定固定角色 —— 由系统提示词 + 模型参数预设组成。
系统默认助手:通用助手,未设特殊提示词,可直接使用
更专项的助手:在下方 助手库 浏览现成预设,或自行创建
对话
每个助手下可创建多个对话(即多段独立聊天)。各对话之间相互独立,但共享所属助手的设置。
适用场景示例:
同一个"代码助手"下分别开"项目 A 重构"、"项目 B bug"两个对话,独立管理
同一个"翻译助手"下开多个对话,分别处理不同文章

助手库
助手列表里的助手从哪来?除了系统默认助手,你可以从 助手库 添加,或自己创建。助手库是一个 助手预设市场,提供大量"角色 + 提示词 + 参数"模板,添加后就会出现在对话页的助手列表里。
进入助手库
在对话页左侧的助手列表顶部,点击 展示方式 图标(漏斗状),在弹出菜单中选择【管理助手】。
在打开的「管理助手」页面右上角,点击【助手库】按钮,即可进入助手预设市场。

在助手库中查找助手
分类筛选:按
全部/精选与多个用途分类(职业、商业、工具、语言、办公、通用、写作、编程、情感、教育、创意、学术、设计、艺术、娱乐、生活 等)筛选,分类名旁的数字为该类的助手数量搜索:顶部搜索框可在所有分类内按关键词查找
预览:点击助手卡片可看到该助手的系统提示词、推荐模型、参数预设
添加到我的助手
点击助手卡片上的 添加 按钮,即可把该预设加入你的助手列表
之后在对话页助手列表中即可看到该助手
创建自己的助手
在「管理助手」页面右上角点击【新建助手】,会打开与 编辑助手 相同的对话框,可分标签页填写:
基础:头像、名称、描述、该助手的默认模型、分组
模型:温度、Top-P、最大 Token 数等模型参数(详见下方 助手设置)
提示词:决定该助手的角色与行为;输入框右上角的闪电按钮即【AI 优化提示词】,可用 全局默认助手模型 把当前内容改写得更结构化
知识库:关联已建好的 知识库
MCP:为该助手启用 MCP 工具

模型选择:既可以在 基础 标签页为助手指定一个默认模型,也可以随时在对话页面顶部的模型下拉菜单中临时切换。未指定助手默认模型时,将使用 全局默认对话模型。
导入与管理
「管理助手」页面右上角提供三个动作按钮:
新建助手:打开 编辑助手对话框 从零创建一个助手
助手库:进入上面介绍的助手预设市场
导入助手:打开「从外部导入」对话框,导入他人分享的助手
「管理助手」页面本身用于集中管理已添加的助手,支持批量删除、批量导出。
【从外部导入】对话框提供三种一次性导入方式,导入完成后助手即出现在你的助手列表中:
文件上传:拖入或选择一个 JSON 文件
剪贴板:直接粘贴助手的 JSON 文本
URL 导入:填入 JSON 链接(出于安全考虑,当前仅支持 GitHub Gist、raw.githubusercontent.com 等来源)

何时使用助手库,何时使用智能体?
对话框内按钮

输入框下方的工具栏 默认只显示 4 个常用工具,其余功能收在末尾的 【+】输入快捷面板 中。想改默认显示哪些工具,点【+】→【自定义工具栏】。
默认工具栏
新对话
在当前助手内创建一个新对话
网络搜索
把网页搜索结果作为上下文返回给模型,需先在 联网模式 中配置;部分模型也可改用「模型内置」搜索
知识库
把一个已建好的 知识库 作为上下文
+(输入快捷面板)
打开下面这一组更多工具与操作
输入快捷面板(+)
点击 +,或直接在输入框里输入 /,都会打开这个面板。面板支持 ↑↓ 选择、Tab / 回车 确认、ESC 关闭。
上传附件
上传图片或文档;图片需模型支持视觉能力,文档会被解析为上下文
生成图片
让当前对话模型生成图片;需先在【设置】→【默认模型】中配置画图模型。专门的生图请去 绘画
提示词管理
插入并管理预设提示词,详见 输入工具栏与效率工具
MCP
查看并启用当前对话可用的 MCP 服务器
引用笔记
从 笔记 中选一篇作为附件引用
清除上下文
保留消息,但让模型"忘掉"之前的对话(截断上下文)
自定义工具栏
选择默认工具栏上显示哪些工具
已添加到输入框的图片会显示为附件标记。鼠标悬停可快速预览;点击附件,或用键盘聚焦后按 Enter / Space,可打开完整图片预览。
"清除上下文"不会删消息:消息仍留在对话里,只是让模型从此刻起重新认识你,不再记得此前的内容。
输入框右侧
展开 / 收起(输入框右上角):放大输入框,便于输入长文
思考(右下角下拉,显示为「默认」):调整模型的推理强度,仅在所选模型支持推理时可调;不支持的模型会提示「当前模型不支持调整推理强度」
发送:发送消息(默认 Enter,可在 快捷键 中改)
通过键盘触发
输入框的提示里已经写明了两个快捷输入:
/:打开输入快捷面板,选择工具或操作(与点击 + 等价)@:引用一个已有话题,把它的内容带进当前对话
在【设置】→【外观】→【输入设置】中打开 显示预估 Token 数 后,输入框还会显示预估的 Token 消耗,供参考(不同模型分词方式不同,实际计费以模型提供商为准)。
对话设置
对话界面的 消息显示 与 输入相关 偏好现在统一放在 设置 → 外观 中,对所有助手的所有对话全局生效;模型参数 则按助手单独设置。
消息显示与输入设置
以下偏好都在 设置 → 外观 里调整,完整说明见 外观:
消息显示:消息样式(气泡 / 简洁)、使用衬线字体、消息字体大小、思考内容自动折叠、显示消息大纲、代码显示行号 / 代码块可折叠 / 代码块可换行、代码风格、数学公式渲染等
输入相关:发送快捷键、显示预估 Token 数、Markdown 渲染输入消息、删除消息前确认等
模型参数
助手设置
在助手列表中 右键点击 需要设置的助手,在弹出菜单中选择【编辑助手】,即可打开助手编辑对话框。
编辑助手
助手设置作用于该助手下的所有对话。
编辑对话框左侧分为五个标签页:
基础:头像、名称、描述、该助手的默认模型、分组
模型:温度、Top-P、最大 Token 数、流式输出、上下文管理、自定义参数等模型参数
提示词:即 prompt,可以参照 智能体 页面的提示词写法来编辑内容
知识库:关联已建好的 知识库
MCP:为该助手启用 MCP 服务器

默认模型(基础标签页)
在「基础」标签页可为该助手固定一个默认模型;不设置时则跟随 全局默认对话模型。
助手的默认模型优先级高于全局默认对话模型。当不设置助手默认模型时,助手默认模型 = 全局默认对话模型。你也可以随时在对话页面顶部的模型下拉菜单中临时切换模型。
模型参数(模型标签页)
以下参数都在「模型」标签页中调整。
温度 (Temperature) :
温度参数控制模型生成文本的随机性和创造性程度(默认值为 0.7)。具体表现为:
低温度值(0-0.3):
输出更确定、更专注
适合代码生成、数据分析等需要准确性的场景
倾向于选择最可能的词汇输出
中等温度值(0.4-0.7):
平衡了创造性和连贯性
适合日常对话、一般性写作
推荐用于聊天机器人对话(0.5 左右)
高温度值(0.8-1.0):
产生更具创造性和多样性的输出
适合创意写作、头脑风暴等场景
但可能降低文本的连贯性
Top P (核采样):
默认值为 1,值越小,AI 生成的内容越单调,也越容易理解;值越大,AI 回复的词汇范围越大,越多样化。
核采样通过控制词汇选择的概率阈值来影响输出:
较小值(0.1-0.3):
仅考虑最高概率的词汇
输出更保守、更可控
适合代码注释、技术文档等场景
中等值(0.4-0.6):
平衡词汇多样性和准确性
适合一般对话和写作任务
较大值(0.7-1.0):
考虑更广泛的词汇选择
产生更丰富多样的内容
适合创意写作等需要多样化表达的场景
这两个参数可以独立使用或组合使用
根据具体任务类型选择合适的参数值
建议通过实验找到最适合特定应用场景的参数组合
以上内容仅供参考和了解概念,所给参数范围不一定适合所有模型,具体可参考模型相关文档给出的参数建议。
上下文管理
控制随请求一起发送给模型的历史上下文如何处理。开启后此助手使用自定义的上下文管理设置(如自动压缩较长历史、按阈值截断),关闭时跟随全局设置。上下文越长,模型记住的信息越多,但消耗的 token 也越多。
最大工具调用轮次
限制助手在一次回复中连续调用工具的轮数。新建助手默认使用 100 轮,可在 1–1000 之间设置;已有助手会保留原来的值,旧配置常见为 20 轮。
如果出现“达到工具调用轮次上限”一类提示,可适当提高此项,或把任务拆小后重试。轮数越高,工具链运行可能越久,也可能消耗更多 Token;普通对话无需主动调高。
开启消息长度限制 (MaxToken)
单次回答最大 Token 数,在大语言模型中,max token(最大令牌数)是一个关键参数,它直接影响模型生成回答的质量和长度。
如:在 CherryStudio 当中填写好 key 后测试模型是否连通时,只需要知道模型是否有正确返回消息而不需特定内容,这种情况下设置 MaxToken 为 1 即可。
多数模型的 MaxToken 上限为 32k Tokens,当然也有 64k,甚至更多的,具体需要到对应介绍页面查看。
具体设置多少取决于自己的需要,当然也可以参考以下建议。
建议:
普通聊天:500-800
短文生成:800-2000
代码生成:2000-3600
长文生成:4000 及以上 (需要模型本身支持)
一般情况下模型生成的回答将被限制在 MaxToken 的范围内,当然也有可能会出现被截断(如写长代码时)或表达不完整等情况出现,特殊情况下也需要根据实际情况来灵活调整。
流式输出(Stream)
流式输出是一种数据处理方式,它允许数据以连续的流形式进行传输和处理,而不是一次性发送所有数据。这种方式使得数据可以在生成后立即被处理和输出,极大地提高了实时性和效率。
在 CherryStudio 客户端等类似环境下简单来说就是打字机效果。
关闭后(非流):模型生成完信息后整段一次性输出(想象一下微信收到消息的感觉);
打开时:逐字输出,可以理解为大模型每生成一个字就立马发送给你,直到全部发送完。
如果某些特殊模型不支持流式输出需要将该开关关闭,比如 刚开始 只支持非流的 o1-mini 等。
自定义参数
在请求体(body)中加入额外请求参数,如 presence_penalty 等字段,一般人一般情况下用不到。
上述 top-p、maxtokens、stream 等参数就是这些参数之一。
填法:参数名称—参数类型(文本、数字等)—值,参考文档:点击前往
各个模型提供商都或多或少有自己独有的参数,需要到提供商的文档中寻找使用方法
自定义参数优先级高于内置参数。即自定义参数如果与内置参数重复,则自定义参数会覆盖内置参数。
如:自定义参数中设置
model为gpt-4o后,在对话中无论选择哪个模型都使用的是gpt-4o模型。
使用 参数名称:undefined 的设置可排除参数。
获取帮助与提交反馈
如果您在配置或使用过程中遇到任何疑问、Bug 或有功能改进建议,请参考 反馈与建议 中提供的官方渠道。
最后更新于
这有帮助吗?