For the complete documentation index, see llms.txt. This page is also available as Markdown.

Данные моделей

  • Следующая информация носит справочный характер; если есть ошибки, можно связаться для исправления. У некоторых моделей из‑за разных поставщиков сервиса размер контекста и сведения о модели также могут отличаться;

  • При вводе данных на клиенте нужно преобразовывать «k» в фактическое значение (теоретически 1k = 1024 токена; 1m = 1024k токенов), например 8k = 8×1024=8192 токена. В практическом использовании рекомендуется просто умножать на ×1000, чтобы избежать ошибок, например 8k = 8×1000=8000, 1m = 1×1000000=1000000;

  • Максимальный вывод «-» означает, что в официальных источниках не удалось найти явную информацию о максимальном выводе этой модели.

Название модели
Максимальный ввод
Максимальный вывод
Вызов функций
Возможности модели
поставщика
Описание

360gpt-pro

8k

-

Не поддерживается

Диалог

360AI_360gpt

Флагманская крупная модель уровня сотен миллиардов параметров серии 360智脑 с наилучшими результатами, широко подходит для сложных задач в разных областях.

360gpt-turbo

7k

-

Не поддерживается

Диалог

360AI_360gpt

Крупная модель уровня десятков миллиардов параметров, сочетающая производительность и качество; подходит для сценариев с высокими требованиями к производительности/стоимости.

360gpt-turbo-responsibility-8k

8k

-

Не поддерживается

Диалог

360AI_360gpt

Крупная модель уровня десятков миллиардов параметров, сочетающая производительность и качество; подходит для сценариев с высокими требованиями к производительности/стоимости.

360gpt2-pro

8k

-

Не поддерживается

Диалог

360AI_360gpt

Флагманская крупная модель уровня сотен миллиардов параметров серии 360智脑 с наилучшими результатами, широко подходит для сложных задач в разных областях.

claude-3-5-sonnet-20240620

200k

16k

Не поддерживается

Диалог, распознавание изображений

Anthropic_claude

Снимок, выпущенный 20 июня 2024 года. Claude 3.5 Sonnet — это модель, сочетающая производительность и скорость, которая при высокой скорости обеспечивает первоклассное качество и поддерживает мультимодальный ввод.

claude-3-5-haiku-20241022

200k

16k

Не поддерживается

Диалог

Anthropic_claude

Снимок, выпущенный 22 октября 2024 года. Claude 3.5 Haiku улучшен во всех навыках, включая кодирование, использование инструментов и рассуждение. Будучи самой быстрой моделью в серии Anthropic, она обеспечивает быстрое время отклика и подходит для приложений, требующих высокой интерактивности и низкой задержки, таких как пользовательские чат-боты и мгновенное автодополнение кода. Она также отлично подходит для специализированных задач, таких как извлечение данных и модерация контента в реальном времени, что делает её универсальным инструментом для широкого применения в разных отраслях. Не поддерживает ввод изображений.

claude-3-5-sonnet-20241022

200k

8K

Не поддерживается

Диалог, распознавание изображений

Anthropic_claude

Снимок, выпущенный 22 октября 2024 года. Claude 3.5 Sonnet предлагает возможности, превосходящие Opus, и скорость выше, чем у Sonnet, при сохранении той же цены, что и у Sonnet. Sonnet особенно силён в программировании, data science, обработке изображений и агентных задачах.

claude-3-5-sonnet-latest

200K

8k

Не поддерживается

Диалог, распознавание изображений

Anthropic_claude

Динамически указывает на последнюю версию Claude 3.5 Sonnet. Claude 3.5 Sonnet предлагает возможности, превосходящие Opus, и скорость выше, чем у Sonnet, при сохранении той же цены, что и у Sonnet. Sonnet особенно силён в программировании, data science, обработке изображений и агентных задачах; данная модель указывает на последнюю версию.

claude-3-haiku-20240307

200k

4k

Не поддерживается

Диалог, распознавание изображений

Anthropic_claude

Claude 3 Haiku — самая быстрая и компактная модель Anthropic, созданная для почти мгновенных ответов. Она обладает быстрой и точной целевой производительностью.

claude-3-opus-20240229

200k

4k

Не поддерживается

Диалог, распознавание изображений

Anthropic_claude

Claude 3 Opus — самая мощная модель Anthropic для обработки высокосложных задач. Она демонстрирует выдающиеся результаты по производительности, интеллекту, плавности и пониманию.

claude-3-sonnet-20240229

200k

8k

Не поддерживается

Диалог, распознавание изображений

Anthropic_claude

Снимок, выпущенный 29 февраля 2024 года. Sonnet особенно силён в: - Кодировании: может самостоятельно писать, редактировать и запускать код, а также обладает способностями к рассуждению и устранению неполадок - Data science: усиливает человеческую экспертизу в data science; при использовании множества инструментов для получения инсайтов способен работать с неструктурированными данными - Обработке изображений: отлично интерпретирует диаграммы, графики и изображения, точно транскрибирует текст, чтобы получать инсайты, выходящие за рамки самого текста - Агентных задачах: отлично использует инструменты, особенно подходит для агентных задач (то есть сложных задач решения проблем в несколько шагов, требующих взаимодействия с другими системами)

google/gemma-2-27b-it

8k

-

Не поддерживается

Диалог

Google_gamma

Gemma — это лёгкое, передовое семейство открытых моделей, разработанное Google и построенное на тех же исследованиях и технологиях, что и модели Gemini. Эти модели представляют собой большие языковые модели только декодера, поддерживают английский язык и предоставляют открытые веса в вариантах предварительного обучения и дообучения инструкциями. Модели Gemma подходят для различных задач генерации текста, включая вопросы и ответы, суммаризацию и рассуждение.

google/gemma-2-9b-it

8k

-

Не поддерживается

Диалог

Google_gamma

Gemma — одно из лёгких, передовых семейств открытых моделей, разработанных Google. Это большая языковая модель только декодера, поддерживающая английский язык и предоставляющая открытые веса, вариант предварительного обучения и вариант дообучения инструкциями. Модели Gemma подходят для различных задач генерации текста, включая вопросы и ответы, суммаризацию и рассуждение. Эта модель 9B была обучена на 8 триллионах токенов.

gemini-1.5-pro

2m

8k

Не поддерживается

Диалог

Google_gemini

Последняя стабильная версия Gemini 1.5 Pro. Как мощная мультимодальная модель, она может обрабатывать до 60 тысяч строк кода или 2 000 страниц текста. Особенно подходит для задач, требующих сложного рассуждения.

gemini-1.0-pro-001

33k

8k

Не поддерживается

Диалог

Google_gemini

Это стабильная версия Gemini 1.0 Pro. Как NLP-модель, она специализируется на многокруговых текстовых и кодовых чатах, а также на генерации кода. Эта модель будет выведена из эксплуатации 15 февраля 2025 года; рекомендуется перейти на модели серии 1.5.

gemini-1.0-pro-002

32k

8k

Не поддерживается

Диалог

Google_gemini

Это стабильная версия Gemini 1.0 Pro. Как NLP-модель, она специализируется на многокруговых текстовых и кодовых чатах, а также на генерации кода. Эта модель будет выведена из эксплуатации 15 февраля 2025 года; рекомендуется перейти на модели серии 1.5.

gemini-1.0-pro-latest

33k

8k

Не поддерживается

Диалог, устарела или скоро устареет

Google_gemini

Это последняя версия Gemini 1.0 Pro. Как NLP-модель, она специализируется на многокруговых текстовых и кодовых чатах, а также на генерации кода. Эта модель будет выведена из эксплуатации 15 февраля 2025 года; рекомендуется перейти на модели серии 1.5.

gemini-1.0-pro-vision-001

16k

2k

Не поддерживается

Диалог

Google_gemini

Это визуальная версия Gemini 1.0 Pro. Эта модель будет выведена из эксплуатации 15 февраля 2025 года; рекомендуется перейти на модели серии 1.5.

gemini-1.0-pro-vision-latest

16k

2k

Не поддерживается

Распознавание изображений

Google_gemini

Это последняя визуальная версия Gemini 1.0 Pro. Эта модель будет выведена из эксплуатации 15 февраля 2025 года; рекомендуется перейти на модели серии 1.5.

gemini-1.5-flash

1m

8k

Не поддерживается

Диалог, распознавание изображений

Google_gemini

Это последняя стабильная версия Gemini 1.5 Flash. Как сбалансированная мультимодальная модель, она может обрабатывать аудио, изображения, видео и текстовый ввод.

gemini-1.5-flash-001

1m

8k

Не поддерживается

Диалог, распознавание изображений

Google_gemini

Это стабильная версия Gemini 1.5 Flash. Она предоставляет те же базовые функции, что и gemini-1.5-flash, но с фиксированной версией, что подходит для использования в production-среде.

gemini-1.5-flash-002

1m

8k

Не поддерживается

Диалог, распознавание изображений

Google_gemini

Это стабильная версия Gemini 1.5 Flash. Она предоставляет те же базовые функции, что и gemini-1.5-flash, но с фиксированной версией, что подходит для использования в production-среде.

gemini-1.5-flash-8b

1m

8k

Не поддерживается

Диалог, распознавание изображений

Google_gemini

Gemini 1.5 Flash-8B — новейшая мультимодальная модель искусственного интеллекта от Google, специально разработанная для эффективной обработки крупномасштабных задач. Модель имеет 8 миллиардов параметров и поддерживает ввод текста, изображений, аудио и видео, подходя для различных сценариев, таких как чат, транскрибация и перевод. По сравнению с другими моделями Gemini, Flash-8B оптимизирована по скорости и экономичности и особенно подходит пользователям, чувствительным к стоимости. Её rate limit был удвоен, что позволяет разработчикам эффективнее обрабатывать крупномасштабные задачи. Кроме того, Flash-8B использует технологию «дистилляции знаний», извлекая ключевые знания из более крупной модели, обеспечивая лёгкость и эффективность при сохранении основных возможностей

gemini-1.5-flash-exp-0827

1m

8k

Не поддерживается

Диалог, распознавание изображений

Google_gemini

Это экспериментальная версия Gemini 1.5 Flash, которая регулярно обновляется, чтобы включать последние улучшения. Подходит для исследовательского тестирования и прототипирования, не рекомендуется для production-среды.

gemini-1.5-flash-latest

1m

8k

Не поддерживается

Диалог, распознавание изображений

Google_gemini

Это передовая версия Gemini 1.5 Flash, которая регулярно обновляется, чтобы включать последние улучшения. Подходит для исследовательского тестирования и прототипирования, не рекомендуется для production-среды.

gemini-1.5-pro-001

2m

8k

Не поддерживается

Диалог, распознавание изображений

Google_gemini

Это стабильная версия Gemini 1.5 Pro, которая обеспечивает фиксированное поведение модели и характеристики производительности. Подходит для production-среды, где требуется стабильность.

gemini-1.5-pro-002

2m

8k

Не поддерживается

Диалог, распознавание изображений

Google_gemini

Это стабильная версия Gemini 1.5 Pro, которая обеспечивает фиксированное поведение модели и характеристики производительности. Подходит для production-среды, где требуется стабильность.

gemini-1.5-pro-exp-0801

2m

8k

Не поддерживается

Диалог, распознавание изображений

Google_gemini

Экспериментальная версия Gemini 1.5 Pro. Как мощная мультимодальная модель, она может обрабатывать до 60 тысяч строк кода или 2 000 страниц текста. Особенно подходит для задач, требующих сложного рассуждения.

gemini-1.5-pro-exp-0827

2m

8k

Не поддерживается

Диалог, распознавание изображений

Google_gemini

Экспериментальная версия Gemini 1.5 Pro. Как мощная мультимодальная модель, она может обрабатывать до 60 тысяч строк кода или 2 000 страниц текста. Особенно подходит для задач, требующих сложного рассуждения.

gemini-1.5-pro-latest

2m

8k

Не поддерживается

Диалог, распознавание изображений

Google_gemini

Это последняя версия Gemini 1.5 Pro, динамически указывающая на последний снимок

gemini-2.0-flash

1m

8k

Не поддерживается

Диалог, распознавание изображений

Google_gemini

Gemini 2.0 Flash — новейшая модель Google, которая по сравнению с версией 1.5 обеспечивает более высокую скорость первого токена (TTFT), сохраняя при этом качество на уровне Gemini Pro 1.5; модель заметно улучшена в мультимодальном понимании, кодовых возможностях, выполнении сложных инструкций и вызове функций, что позволяет обеспечивать более плавный и мощный интеллектуальный опыт.

gemini-2.0-flash-exp

100k

8k

Поддерживается

Диалог, распознавание изображений

Google_gemini

Gemini 2.0 Flash внедряет мультимодальный realtime API, улучшенную скорость и производительность, повышение качества, усиленные агентные возможности, а также функции генерации изображений и преобразования речи.

gemini-2.0-flash-lite-preview-02-05

1M

8k

Не поддерживается

Диалог, распознавание изображений

Google_gemini

Gemini 2.0 Flash-Lite — новейшая выпущенная Google экономичная AI-модель, которая при той же скорости, что и 1.5 Flash, обеспечивает лучшее качество; поддерживает контекстное окно в 1 миллион токенов и может обрабатывать мультимодальные задачи, такие как изображения, аудио и код; как самая экономичная модель Google на данный момент, использует упрощённую единую ценовую стратегию и особенно подходит для крупномасштабных сценариев, чувствительных к стоимости.

gemini-2.0-flash-thinking-exp

40k

8k

Не поддерживается

Диалог, рассуждение

Google_gemini

gemini-2.0-flash-thinking-exp — экспериментальная модель, которая может генерировать «процесс мышления», переживаемый при формировании ответа. Поэтому по сравнению с базовой моделью Gemini 2.0 Flash ответы в режиме «thinking» обладают более сильными возможностями рассуждения.

gemini-2.0-flash-thinking-exp-01-21

1m

64k

Не поддерживается

Диалог, рассуждение

Google_gemini

Gemini 2.0 Flash Thinking EXP-01-21 — новейшая AI-модель Google, ориентированная на повышение возможностей рассуждения и качества взаимодействия с пользователем. Модель обладает мощными способностями к рассуждению, особенно хорошо проявляет себя в математике и программировании, а также поддерживает контекстное окно до 1 миллиона токенов, подходя для сложных задач и сценариев глубокого анализа. Её уникальность в том, что она может генерировать процесс мышления, повышая понятность рассуждений ИИ, а также поддерживает нативное выполнение кода, усиливая гибкость и практическую ценность взаимодействия. Благодаря оптимизации алгоритмов модель уменьшает логические противоречия, дополнительно повышая точность и согласованность ответов.

gemini-2.0-flash-thinking-exp-1219

40k

8k

Не поддерживается

Диалог, рассуждение, распознавание изображений

Google_gemini

gemini-2.0-flash-thinking-exp-1219 — экспериментальная модель, которая может генерировать «процесс мышления», переживаемый при формировании ответа. Поэтому по сравнению с базовой моделью Gemini 2.0 Flash ответы в режиме «thinking» обладают более сильными возможностями рассуждения.

gemini-2.0-pro-exp-01-28

2m

64k

Не поддерживается

Диалог, распознавание изображений

Google_gemini

Предзагруженная модель, ещё не запущена

gemini-2.0-pro-exp-02-05

2m

8k

Не поддерживается

Диалог, распознавание изображений

Google_gemini

Gemini 2.0 Pro Exp 02-05 — новейшая экспериментальная модель Google, выпущенная в феврале 2024 года, с выдающимися результатами в мировых знаниях, генерации кода и понимании длинных текстов; модель поддерживает сверхдлинное контекстное окно в 2 миллиона токенов и может обрабатывать 2 часа видео, 22 часа аудио, более 60 тысяч строк кода и более 1,4 миллиона слов; как часть серии Gemini 2.0, модель использует новую стратегию обучения Flash Thinking, что значительно повышает производительность и выводит её в лидеры по многим рейтингам LLM, демонстрируя мощные комплексные возможности.

gemini-exp-1114

8k

4k

Не поддерживается

Диалог, распознавание изображений

Google_gemini

Это экспериментальная модель, выпущенная 14 ноября 2024 года, с основным фокусом на улучшении качества.

gemini-exp-1121

8k

4k

Не поддерживается

Диалог, распознавание изображений, код

Google_gemini

Это экспериментальная модель, выпущенная 21 ноября 2024 года, с улучшенными возможностями кодирования, рассуждения и зрения.

gemini-exp-1206

8k

4k

Не поддерживается

Диалог, распознавание изображений

Google_gemini

Это экспериментальная модель, выпущенная 6 декабря 2024 года, с улучшенными возможностями кодирования, рассуждения и зрения.

gemini-exp-latest

8k

4k

Не поддерживается

Диалог, распознавание изображений

Google_gemini

Это экспериментальная модель, динамически указывающая на последнюю версию

gemini-pro

33k

8k

Не поддерживается

Диалог

Google_gemini

То же, что gemini-1.0-pro, псевдоним gemini-1.0-pro

gemini-pro-vision

16k

2k

Не поддерживается

Диалог, распознавание изображений

Google_gemini

Это визуальная версия Gemini 1.0 Pro. Эта модель будет выведена из эксплуатации 15 февраля 2025 года; рекомендуется перейти на модели серии 1.5.

grok-2

128k

-

Не поддерживается

Диалог

Grok_grok

Новая версия модели grok, выпущенная X.ai 12.12.2024.

grok-2-1212

128k

-

Не поддерживается

Диалог

Grok_grok

Новая версия модели grok, выпущенная X.ai 12.12.2024.

grok-2-latest

128k

-

Не поддерживается

Диалог

Grok_grok

Новая версия модели grok, выпущенная X.ai 12.12.2024.

grok-2-vision-1212

32k

-

Не поддерживается

Диалог, распознавание изображений

Grok_grok

Визуальная версия модели grok, выпущенная X.ai 12.12.2024.

grok-beta

100k

-

Не поддерживается

Диалог

Grok_grok

По производительности сопоставима с Grok 2, но с улучшенными эффективностью, скоростью и функциями.

grok-vision-beta

8k

-

Не поддерживается

Диалог, распознавание изображений

Grok_grok

Новейшая модель понимания изображений может обрабатывать различные визуальные данные, включая документы, диаграммы, скриншоты и фотографии.

internlm/internlm2_5-20b-chat

32k

-

Поддерживается

Диалог

internlm

InternLM2.5-20B-Chat — это открытая крупная диалоговая модель, разработанная на базе архитектуры InternLM2. Модель имеет 20 миллиардов параметров и отлично проявляет себя в математическом рассуждении, превосходя модели Llama3 и Gemma2-27B того же масштаба. Возможности вызова инструментов у InternLM2.5-20B-Chat значительно улучшены: она поддерживает сбор информации со сотен веб-страниц для анализа и рассуждения, а также обладает более сильным пониманием инструкций, выбором инструментов и рефлексией над результатами.

meta-llama/Llama-3.2-11B-Vision-Instruct

8k

-

Не поддерживается

Диалог, распознавание изображений

Meta_llama

На данный момент модели серии Llama умеют обрабатывать не только текстовые данные, но и изображения; некоторые модели Llama3.2 добавили функцию визуального понимания. Эта модель поддерживает одновременный ввод текста и изображений, понимает изображения и выводит текстовую информацию.

meta-llama/Llama-3.2-3B-Instruct

32k

-

Не поддерживается

Диалог

Meta_llama

Многоязычная большая языковая модель (LLM) Meta Llama 3.2, где 1B и 3B — это лёгкие модели, способные работать на edge-устройствах и мобильных устройствах; данная модель — версия 3B.

meta-llama/Llama-3.2-90B-Vision-Instruct

8k

-

Не поддерживается

Диалог, распознавание изображений

Meta_llama

На данный момент модели серии Llama умеют обрабатывать не только текстовые данные, но и изображения; некоторые модели Llama3.2 добавили функцию визуального понимания. Эта модель поддерживает одновременный ввод текста и изображений, понимает изображения и выводит текстовую информацию.

meta-llama/Llama-3.3-70B-Instruct

131k

-

Не поддерживается

Диалог

Meta_llama

Новейшая 70B LLM от Meta, сопоставимая по производительности с llama 3.1 405B.

meta-llama/Meta-Llama-3.1-405B-Instruct

32k

-

Не поддерживается

Диалог

Meta_llama

Коллекция многоязычных больших языковых моделей (LLM) Meta Llama 3.1 представляет собой набор предварительно обученных и дообученных по инструкциям генеративных моделей размеров 8B, 70B и 405B; данная модель — версия 405B. Текстовые модели Llama 3.1 с дообучением инструкциями (8B, 70B, 405B) оптимизированы для многоязычного диалога и превосходят многие доступные open-source и закрытые чат-модели по распространённым отраслевым бенчмаркам.

meta-llama/Meta-Llama-3.1-70B-Instruct

32k

-

Не поддерживается

Диалог

Meta_llama

Meta Llama 3.1 — семейство многоязычных больших языковых моделей, разработанное Meta, включающее предварительно обученные и дообученные по инструкциям варианты с тремя масштабами параметров: 8B, 70B и 405B. Эта модель 70B, дообученная по инструкциям, оптимизирована для сценариев многоязычного диалога и показывает отличные результаты в ряде отраслевых бенчмарков. Модель обучалась на более чем 15 триллионах открытых данных и использует такие техники, как supervised fine-tuning и reinforcement learning with human feedback для повышения полезности и безопасности.

meta-llama/Meta-Llama-3.1-8B-Instruct

32k

-

Не поддерживается

Диалог

Meta_llama

Коллекция многоязычных больших языковых моделей (LLM) Meta Llama 3.1 представляет собой набор предварительно обученных и дообученных по инструкциям генеративных моделей размеров 8B, 70B и 405B; данная модель — версия 8B. Текстовые модели Llama 3.1 с дообучением инструкциями (8B, 70B, 405B) оптимизированы для многоязычного диалога и превосходят многие доступные open-source и закрытые чат-модели по распространённым отраслевым бенчмаркам.

abab5.5-chat

16k

-

Поддерживается

Диалог

Minimax_abab

Сценарии диалогов с китайскими персонажами

abab5.5s-chat

8k

-

Поддерживается

Диалог

Minimax_abab

Сценарии диалогов с китайскими персонажами

abab6.5g-chat

8k

-

Поддерживается

Диалог

Minimax_abab

Сценарии диалогов с персонажами на английском и других языках

abab6.5s-chat

245k

-

Поддерживается

Диалог

Minimax_abab

Общий сценарий

abab6.5t-chat

8k

-

Поддерживается

Диалог

Minimax_abab

Сценарии диалогов с китайскими персонажами

chatgpt-4o-latest

128k

16k

Не поддерживается

Диалог, распознавание изображений

OpenAI

Версия модели chatgpt-4o-latest постоянно указывает на версию GPT-4o, используемую в ChatGPT, и обновляется как можно быстрее при серьёзных изменениях.

gpt-4o-2024-11-20

128k

16k

Поддерживается

Диалог

OpenAI

Последний снимок gpt-4o от 20 ноября 2024 года.

gpt-4o-audio-preview

128k

16k

Не поддерживается

Диалог

OpenAI

Модель OpenAI для диалогов в реальном времени с голосом

gpt-4o-audio-preview-2024-10-01

128k

16k

Поддерживается

Диалог

OpenAI

Модель OpenAI для диалогов в реальном времени с голосом

o1

128k

32k

Не поддерживается

Диалог, рассуждение, распознавание изображений

OpenAI

Новая модель рассуждения от OpenAI для сложных задач, требующих широких общих знаний. Модель имеет контекст 200k, на данный момент это самая сильная модель в мире, поддерживает распознавание изображений

o1-mini-2024-09-12

128k

64k

Не поддерживается

Диалог, рассуждение

OpenAI

Фиксированная снимковая версия o1-mini; меньше и быстрее, чем o1-preview, на 80% дешевле и хорошо показывает себя в генерации кода и операциях с небольшим контекстом.

o1-preview-2024-09-12

128k

32k

Не поддерживается

Диалог, рассуждение

OpenAI

Фиксированная снимковая версия o1-preview

gpt-3.5-turbo

16k

4k

Поддерживается

Диалог

OpenAI_gpt-3

На основе GPT-3.5: GPT-3.5 Turbo — улучшенная версия, созданная на базе модели GPT-3.5, разработанная OpenAI. Цель по производительности: предназначена для повышения скорости рассуждения, эффективности обработки и использования ресурсов за счёт оптимизации структуры модели и алгоритмов. Увеличенная скорость рассуждения: по сравнению с GPT-3.5, GPT-3.5 Turbo обычно может обеспечивать более высокую скорость вывода при тех же аппаратных условиях, что особенно полезно для приложений с крупномасштабной обработкой текста. Более высокая пропускная способность: при обработке большого числа запросов или данных GPT-3.5 Turbo может обеспечивать более высокую параллельную производительность, тем самым повышая общую пропускную способность системы. Оптимизированное потребление ресурсов: при сохранении производительности может снижать требования к аппаратным ресурсам (таким как память и вычислительные ресурсы), что помогает уменьшить эксплуатационные расходы и повысить масштабируемость системы. Широкий спектр задач обработки естественного языка: GPT-3.5 Turbo подходит для различных задач NLP, включая, помимо прочего, генерацию текста, семантическое понимание, диалоговые системы, машинный перевод и т. д. Инструменты разработчика и поддержка API: предоставляет удобные для интеграции и использования разработчиками API-интерфейсы, поддерживающие быструю разработку и развёртывание приложений.

gpt-3.5-turbo-0125

16k

4k

Поддерживается

Диалог

OpenAI_gpt-3

Обновлённый GPT 3.5 Turbo, с более высокой точностью обработки запросов в нужном формате, а также исправлена ошибка, вызывавшая проблемы с кодировкой текста при вызове функций на неанглийских языках. Возвращает до 4 096 выходных токенов.

gpt-3.5-turbo-0613

16k

4k

Поддерживается

Диалог

OpenAI_gpt-3

Обновлённая фиксированная снимковая версия GPT 3.5 Turbo. Сейчас устарела

gpt-3.5-turbo-1106

16k

4k

Поддерживается

Диалог

OpenAI_gpt-3

С улучшенным следованием инструкциям, режимом JSON, воспроизводимым выводом, параллельным вызовом функций и т. д. Возвращает до 4 096 выходных токенов.

gpt-3.5-turbo-16k

16k

4k

Поддерживается

Диалог, устарела или скоро устареет

OpenAI_gpt-3

(устарело)

gpt-3.5-turbo-16k-0613

16k

4k

Поддерживается

Диалог, устарела или скоро устареет

OpenAI_gpt-3

Снимок gpt-3.5-turbo от 13 июня 2023 года. (устарело)

gpt-3.5-turbo-instruct

4k

4k

Поддерживается

Диалог

OpenAI_gpt-3

Возможности, аналогичные моделям эпохи GPT-3. Совместим с устаревшим endpoint Completions, не подходит для Chat Completions.

gpt-3.5o

16k

4k

Не поддерживается

Диалог

OpenAI_gpt-3

То же, что gpt-4o-lite

gpt-4

8k

8k

Поддерживается

Диалог

OpenAI_gpt-4

В настоящее время указывает на gpt-4-0613.

gpt-4-0125-preview

128k

4k

Поддерживается

Диалог

OpenAI_gpt-4

Новейшая модель GPT-4, созданная для уменьшения случаев «лени», когда модель не завершает задачу. Возвращает до 4 096 выходных токенов.

gpt-4-0314

8k

8k

Поддерживается

Диалог

OpenAI_gpt-4

Снимок GPT-4 от 14 марта 2023 года

gpt-4-0613

8k

8k

Поддерживается

Диалог

OpenAI_gpt-4

Снимок GPT-4 от 13 июня 2023 года, с улучшенной поддержкой вызова функций.

gpt-4-1106-preview

128k

4k

Поддерживается

Диалог

OpenAI_gpt-4

Модель GPT-4 Turbo с улучшенным следованием инструкциям, режимом JSON, воспроизводимым выводом, вызовом функций и т. д. Возвращает до 4 096 выходных токенов. Это preview-модель.

gpt-4-32k

32k

4k

Поддерживается

Диалог

OpenAI_gpt-4

gpt-4-32k будет устаревшей 2025-06-06.

gpt-4-32k-0613

32k

4k

Поддерживается

Диалог, устарела или скоро устареет

OpenAI_gpt-4

Будет устаревшей 2025-06-06.

gpt-4-turbo

128k

4k

Поддерживается

Диалог

OpenAI_gpt-4

Последняя версия модели GPT-4 Turbo получила визуальные возможности и поддерживает обработку визуальных запросов через JSON-режим и вызов функций. Текущая версия этой модели — gpt-4-turbo-2024-04-09.

gpt-4-turbo-2024-04-09

128k

4k

Поддерживается

Диалог

OpenAI_gpt-4

Модель GPT-4 Turbo с визуальными возможностями. Теперь визуальные запросы могут реализовываться через JSON-режим и вызов функций. Текущая версия gpt-4-turbo — именно эта версия.

gpt-4-turbo-preview

128k

4k

Поддерживается

Диалог, распознавание изображений

OpenAI_gpt-4

В настоящее время указывает на gpt-4-0125-preview.

gpt-4o

128k

16k

Поддерживается

Диалог, распознавание изображений

OpenAI_gpt-4

Флагманская модель OpenAI с высоким уровнем интеллекта, подходящая для сложных многошаговых задач. GPT-4o дешевле и быстрее, чем GPT-4 Turbo.

gpt-4o-2024-05-13

128k

4k

Поддерживается

Диалог, распознавание изображений

OpenAI_gpt-4

Оригинальный снимок gpt-4o от 13 мая 2024 года.

gpt-4o-2024-08-06

128k

16k

Поддерживается

Диалог, распознавание изображений

OpenAI_gpt-4

Первый снимок с поддержкой структурированного вывода. gpt-4o в настоящее время указывает на эту версию.

gpt-4o-mini

128k

16k