Groq
Groq (обратите внимание: это не Grok от xAI) — это сервис, основанный на аппаратном ускорении LPU, сверхнизкой задержке и отличается как сервис инференса; в основном размещает открытые модели вроде Llama / Mixtral / Whisper, а скорость вывода обычно в несколько раз выше, чем у обычного облачного инференса.
Получить API Key
Перейдите в GroqCloud Регистрация аккаунта
API Keys→Создать API-ключ, скопируйтеgsk_...ключ
в настройках Cherry Studio
Включить
Настройки → Сервисы моделей, найдите Groq Provider — перейдите на страницу с подробностямиAPI-ключ введите
gsk_...API-адрес По умолчанию
https://api.groq.com/openai/v1, не нужно изменятьНажмите Получить список моделей
Рекомендуемое использование
llama-3.3-70b-versatile
универсальные диалоги, очень высокая скорость
llama-3.1-8b-instant
простые задачи, отклик за миллисекунды
mixtral-8x7b-32768
длинный контекст
whisper-large-v3
речь в текст
Сценарий применения
чат-бот в реальном времени:«Почти мгновенный отклик» Groq отлично подходит для интеграции в мессенджеры (в сочетании с каналы)
массовой параллельностью:число токенов в секунду значительно выше, чем у обычного облачного инференса
если не важна новизна модели:Groq в основном размещает открытые модели вроде Llama и др., а не закрытые модели вроде GPT-5 / Claude-4
Различайте Grok и Groq
Компания
xAI (Маск)
Groq Inc.
Основной акцент
собственная большая модель + подключение к интернету
аппаратное обеспечение LPU + инференс открытых моделей
Модель
grok-4 и другие собственные
llama-3.x и другие открытые
Grok (xAI) и Groq часто путают. В списке Provider в Cherry Studio это два отдельных пункта, пожалуйста, не перепутайте их.
Получить помощь и отправить отзыв
Если у вас в процессе настройки или использования возникнут какие-либо вопросы, баги или предложения по улучшению функций, пожалуйста, обратитесь к Отзывы и предложения официальным каналам, указанным там.
Последнее обновление
Это было полезно?