For the complete documentation index, see llms.txt. This page is also available as Markdown.

Groq

Groq (обратите внимание: это не Grok от xAI) — это сервис, основанный на аппаратном ускорении LPU, сверхнизкой задержке и отличается как сервис инференса; в основном размещает открытые модели вроде Llama / Mixtral / Whisper, а скорость вывода обычно в несколько раз выше, чем у обычного облачного инференса.

Получить API Key

  • Перейдите в GroqCloud Регистрация аккаунта

  • API KeysСоздать API-ключ, скопируйте gsk_... ключ

в настройках Cherry Studio

  • Включить Настройки → Сервисы моделей, найдите Groq Provider — перейдите на страницу с подробностями

  • API-ключ введите gsk_...

  • API-адрес По умолчанию https://api.groq.com/openai/v1, не нужно изменять

  • Нажмите Получить список моделей

Рекомендуемое использование

Модель
Подходящие сценарии

llama-3.3-70b-versatile

универсальные диалоги, очень высокая скорость

llama-3.1-8b-instant

простые задачи, отклик за миллисекунды

mixtral-8x7b-32768

длинный контекст

whisper-large-v3

речь в текст

Сценарий применения

  • чат-бот в реальном времени:«Почти мгновенный отклик» Groq отлично подходит для интеграции в мессенджеры (в сочетании с каналы)

  • массовой параллельностью:число токенов в секунду значительно выше, чем у обычного облачного инференса

  • если не важна новизна модели:Groq в основном размещает открытые модели вроде Llama и др., а не закрытые модели вроде GPT-5 / Claude-4

Различайте Grok и Groq

Grok

Groq

Компания

xAI (Маск)

Groq Inc.

Основной акцент

собственная большая модель + подключение к интернету

аппаратное обеспечение LPU + инференс открытых моделей

Модель

grok-4 и другие собственные

llama-3.x и другие открытые


Получить помощь и отправить отзыв

Если у вас в процессе настройки или использования возникнут какие-либо вопросы, баги или предложения по улучшению функций, пожалуйста, обратитесь к Отзывы и предложения официальным каналам, указанным там.

Последнее обновление

Это было полезно?