最后更新于
这有帮助吗?
Groq(注意:不是 xAI 的 Grok)是一个以 LPU 硬件加速、超低延迟 见长的推理服务,主要托管 Llama / Mixtral / Whisper 等开源模型,输出速度通常是普通云推理的几倍。
前往 GroqCloud 注册账号
API Keys → Create API Key,复制 gsk_... 密钥
打开 设置 → 模型服务,找到 Groq Provider 进入详情页
API 密钥 填入 gsk_...
API 地址 默认 https://api.groq.com/openai/v1,无需修改
点击 获取模型列表
llama-3.3-70b-versatile
通用对话,速度极快
llama-3.1-8b-instant
简单任务,毫秒级响应
mixtral-8x7b-32768
长上下文
whisper-large-v3
语音转文字
实时聊天机器人:Groq 的"几乎瞬时响应"很适合 IM 接入(搭配 频道)
大量并发:每秒 token 数显著高于普通云推理
不在乎模型最新:Groq 主要托管 Llama 系等开源模型,没有 GPT-5 / Claude-4 这种闭源模型
Grok(xAI)和 Groq 经常被混淆。在 Cherry Studio Provider 列表中是两个独立条目,请注意区分。
如果您在配置或使用过程中遇到任何疑问、Bug 或有功能改进建议,请参考 反馈与建议 中提供的官方渠道。
最后更新于
这有帮助吗?
这有帮助吗?