Данные моделей
Следующая информация носит справочный характер; если есть ошибки, можно связаться для исправления. У некоторых моделей из‑за разных поставщиков сервиса размер контекста и сведения о модели также могут отличаться;
При вводе данных на клиенте нужно преобразовывать «k» в фактическое значение (теоретически 1k = 1024 токена; 1m = 1024k токенов), например 8k = 8×1024=8192 токена. В практическом использовании рекомендуется просто умножать на ×1000, чтобы избежать ошибок, например 8k = 8×1000=8000, 1m = 1×1000000=1000000;
Максимальный вывод «-» означает, что в официальных источниках не удалось найти явную информацию о максимальном выводе этой модели.
360gpt-pro
8k
-
Не поддерживается
Диалог
360AI_360gpt
Флагманская крупная модель уровня сотен миллиардов параметров серии 360智脑 с наилучшими результатами, широко подходит для сложных задач в разных областях.
360gpt-turbo
7k
-
Не поддерживается
Диалог
360AI_360gpt
Крупная модель уровня десятков миллиардов параметров, сочетающая производительность и качество; подходит для сценариев с высокими требованиями к производительности/стоимости.
360gpt-turbo-responsibility-8k
8k
-
Не поддерживается
Диалог
360AI_360gpt
Крупная модель уровня десятков миллиардов параметров, сочетающая производительность и качество; подходит для сценариев с высокими требованиями к производительности/стоимости.
360gpt2-pro
8k
-
Не поддерживается
Диалог
360AI_360gpt
Флагманская крупная модель уровня сотен миллиардов параметров серии 360智脑 с наилучшими результатами, широко подходит для сложных задач в разных областях.
claude-3-5-sonnet-20240620
200k
16k
Не поддерживается
Диалог, распознавание изображений
Anthropic_claude
Снимок, выпущенный 20 июня 2024 года. Claude 3.5 Sonnet — это модель, сочетающая производительность и скорость, которая при высокой скорости обеспечивает первоклассное качество и поддерживает мультимодальный ввод.
claude-3-5-haiku-20241022
200k
16k
Не поддерживается
Диалог
Anthropic_claude
Снимок, выпущенный 22 октября 2024 года. Claude 3.5 Haiku улучшен во всех навыках, включая кодирование, использование инструментов и рассуждение. Будучи самой быстрой моделью в серии Anthropic, она обеспечивает быстрое время отклика и подходит для приложений, требующих высокой интерактивности и низкой задержки, таких как пользовательские чат-боты и мгновенное автодополнение кода. Она также отлично подходит для специализированных задач, таких как извлечение данных и модерация контента в реальном времени, что делает её универсальным инструментом для широкого применения в разных отраслях. Не поддерживает ввод изображений.
claude-3-5-sonnet-20241022
200k
8K
Не поддерживается
Диалог, распознавание изображений
Anthropic_claude
Снимок, выпущенный 22 октября 2024 года. Claude 3.5 Sonnet предлагает возможности, превосходящие Opus, и скорость выше, чем у Sonnet, при сохранении той же цены, что и у Sonnet. Sonnet особенно силён в программировании, data science, обработке изображений и агентных задачах.
claude-3-5-sonnet-latest
200K
8k
Не поддерживается
Диалог, распознавание изображений
Anthropic_claude
Динамически указывает на последнюю версию Claude 3.5 Sonnet. Claude 3.5 Sonnet предлагает возможности, превосходящие Opus, и скорость выше, чем у Sonnet, при сохранении той же цены, что и у Sonnet. Sonnet особенно силён в программировании, data science, обработке изображений и агентных задачах; данная модель указывает на последнюю версию.
claude-3-haiku-20240307
200k
4k
Не поддерживается
Диалог, распознавание изображений
Anthropic_claude
Claude 3 Haiku — самая быстрая и компактная модель Anthropic, созданная для почти мгновенных ответов. Она обладает быстрой и точной целевой производительностью.
claude-3-opus-20240229
200k
4k
Не поддерживается
Диалог, распознавание изображений
Anthropic_claude
Claude 3 Opus — самая мощная модель Anthropic для обработки высокосложных задач. Она демонстрирует выдающиеся результаты по производительности, интеллекту, плавности и пониманию.
claude-3-sonnet-20240229
200k
8k
Не поддерживается
Диалог, распознавание изображений
Anthropic_claude
Снимок, выпущенный 29 февраля 2024 года. Sonnet особенно силён в: - Кодировании: может самостоятельно писать, редактировать и запускать код, а также обладает способностями к рассуждению и устранению неполадок - Data science: усиливает человеческую экспертизу в data science; при использовании множества инструментов для получения инсайтов способен работать с неструктурированными данными - Обработке изображений: отлично интерпретирует диаграммы, графики и изображения, точно транскрибирует текст, чтобы получать инсайты, выходящие за рамки самого текста - Агентных задачах: отлично использует инструменты, особенно подходит для агентных задач (то есть сложных задач решения проблем в несколько шагов, требующих взаимодействия с другими системами)
google/gemma-2-27b-it
8k
-
Не поддерживается
Диалог
Google_gamma
Gemma — это лёгкое, передовое семейство открытых моделей, разработанное Google и построенное на тех же исследованиях и технологиях, что и модели Gemini. Эти модели представляют собой большие языковые модели только декодера, поддерживают английский язык и предоставляют открытые веса в вариантах предварительного обучения и дообучения инструкциями. Модели Gemma подходят для различных задач генерации текста, включая вопросы и ответы, суммаризацию и рассуждение.
google/gemma-2-9b-it
8k
-
Не поддерживается
Диалог
Google_gamma
Gemma — одно из лёгких, передовых семейств открытых моделей, разработанных Google. Это большая языковая модель только декодера, поддерживающая английский язык и предоставляющая открытые веса, вариант предварительного обучения и вариант дообучения инструкциями. Модели Gemma подходят для различных задач генерации текста, включая вопросы и ответы, суммаризацию и рассуждение. Эта модель 9B была обучена на 8 триллионах токенов.
gemini-1.5-pro
2m
8k
Не поддерживается
Диалог
Google_gemini
Последняя стабильная версия Gemini 1.5 Pro. Как мощная мультимодальная модель, она может обрабатывать до 60 тысяч строк кода или 2 000 страниц текста. Особенно подходит для задач, требующих сложного рассуждения.
gemini-1.0-pro-001
33k
8k
Не поддерживается
Диалог
Google_gemini
Это стабильная версия Gemini 1.0 Pro. Как NLP-модель, она специализируется на многокруговых текстовых и кодовых чатах, а также на генерации кода. Эта модель будет выведена из эксплуатации 15 февраля 2025 года; рекомендуется перейти на модели серии 1.5.
gemini-1.0-pro-002
32k
8k
Не поддерживается
Диалог
Google_gemini
Это стабильная версия Gemini 1.0 Pro. Как NLP-модель, она специализируется на многокруговых текстовых и кодовых чатах, а также на генерации кода. Эта модель будет выведена из эксплуатации 15 февраля 2025 года; рекомендуется перейти на модели серии 1.5.
gemini-1.0-pro-latest
33k
8k
Не поддерживается
Диалог, устарела или скоро устареет
Google_gemini
Это последняя версия Gemini 1.0 Pro. Как NLP-модель, она специализируется на многокруговых текстовых и кодовых чатах, а также на генерации кода. Эта модель будет выведена из эксплуатации 15 февраля 2025 года; рекомендуется перейти на модели серии 1.5.
gemini-1.0-pro-vision-001
16k
2k
Не поддерживается
Диалог
Google_gemini
Это визуальная версия Gemini 1.0 Pro. Эта модель будет выведена из эксплуатации 15 февраля 2025 года; рекомендуется перейти на модели серии 1.5.
gemini-1.0-pro-vision-latest
16k
2k
Не поддерживается
Распознавание изображений
Google_gemini
Это последняя визуальная версия Gemini 1.0 Pro. Эта модель будет выведена из эксплуатации 15 февраля 2025 года; рекомендуется перейти на модели серии 1.5.
gemini-1.5-flash
1m
8k
Не поддерживается
Диалог, распознавание изображений
Google_gemini
Это последняя стабильная версия Gemini 1.5 Flash. Как сбалансированная мультимодальная модель, она может обрабатывать аудио, изображения, видео и текстовый ввод.
gemini-1.5-flash-001
1m
8k
Не поддерживается
Диалог, распознавание изображений
Google_gemini
Это стабильная версия Gemini 1.5 Flash. Она предоставляет те же базовые функции, что и gemini-1.5-flash, но с фиксированной версией, что подходит для использования в production-среде.
gemini-1.5-flash-002
1m
8k
Не поддерживается
Диалог, распознавание изображений
Google_gemini
Это стабильная версия Gemini 1.5 Flash. Она предоставляет те же базовые функции, что и gemini-1.5-flash, но с фиксированной версией, что подходит для использования в production-среде.
gemini-1.5-flash-8b
1m
8k
Не поддерживается
Диалог, распознавание изображений
Google_gemini
Gemini 1.5 Flash-8B — новейшая мультимодальная модель искусственного интеллекта от Google, специально разработанная для эффективной обработки крупномасштабных задач. Модель имеет 8 миллиардов параметров и поддерживает ввод текста, изображений, аудио и видео, подходя для различных сценариев, таких как чат, транскрибация и перевод. По сравнению с другими моделями Gemini, Flash-8B оптимизирована по скорости и экономичности и особенно подходит пользователям, чувствительным к стоимости. Её rate limit был удвоен, что позволяет разработчикам эффективнее обрабатывать крупномасштабные задачи. Кроме того, Flash-8B использует технологию «дистилляции знаний», извлекая ключевые знания из более крупной модели, обеспечивая лёгкость и эффективность при сохранении основных возможностей
gemini-1.5-flash-exp-0827
1m
8k
Не поддерживается
Диалог, распознавание изображений
Google_gemini
Это экспериментальная версия Gemini 1.5 Flash, которая регулярно обновляется, чтобы включать последние улучшения. Подходит для исследовательского тестирования и прототипирования, не рекомендуется для production-среды.
gemini-1.5-flash-latest
1m
8k
Не поддерживается
Диалог, распознавание изображений
Google_gemini
Это передовая версия Gemini 1.5 Flash, которая регулярно обновляется, чтобы включать последние улучшения. Подходит для исследовательского тестирования и прототипирования, не рекомендуется для production-среды.
gemini-1.5-pro-001
2m
8k
Не поддерживается
Диалог, распознавание изображений
Google_gemini
Это стабильная версия Gemini 1.5 Pro, которая обеспечивает фиксированное поведение модели и характеристики производительности. Подходит для production-среды, где требуется стабильность.
gemini-1.5-pro-002
2m
8k
Не поддерживается
Диалог, распознавание изображений
Google_gemini
Это стабильная версия Gemini 1.5 Pro, которая обеспечивает фиксированное поведение модели и характеристики производительности. Подходит для production-среды, где требуется стабильность.
gemini-1.5-pro-exp-0801
2m
8k
Не поддерживается
Диалог, распознавание изображений
Google_gemini
Экспериментальная версия Gemini 1.5 Pro. Как мощная мультимодальная модель, она может обрабатывать до 60 тысяч строк кода или 2 000 страниц текста. Особенно подходит для задач, требующих сложного рассуждения.
gemini-1.5-pro-exp-0827
2m
8k
Не поддерживается
Диалог, распознавание изображений
Google_gemini
Экспериментальная версия Gemini 1.5 Pro. Как мощная мультимодальная модель, она может обрабатывать до 60 тысяч строк кода или 2 000 страниц текста. Особенно подходит для задач, требующих сложного рассуждения.
gemini-1.5-pro-latest
2m
8k
Не поддерживается
Диалог, распознавание изображений
Google_gemini
Это последняя версия Gemini 1.5 Pro, динамически указывающая на последний снимок
gemini-2.0-flash
1m
8k
Не поддерживается
Диалог, распознавание изображений
Google_gemini
Gemini 2.0 Flash — новейшая модель Google, которая по сравнению с версией 1.5 обеспечивает более высокую скорость первого токена (TTFT), сохраняя при этом качество на уровне Gemini Pro 1.5; модель заметно улучшена в мультимодальном понимании, кодовых возможностях, выполнении сложных инструкций и вызове функций, что позволяет обеспечивать более плавный и мощный интеллектуальный опыт.
gemini-2.0-flash-exp
100k
8k
Поддерживается
Диалог, распознавание изображений
Google_gemini
Gemini 2.0 Flash внедряет мультимодальный realtime API, улучшенную скорость и производительность, повышение качества, усиленные агентные возможности, а также функции генерации изображений и преобразования речи.
gemini-2.0-flash-lite-preview-02-05
1M
8k
Не поддерживается
Диалог, распознавание изображений
Google_gemini
Gemini 2.0 Flash-Lite — новейшая выпущенная Google экономичная AI-модель, которая при той же скорости, что и 1.5 Flash, обеспечивает лучшее качество; поддерживает контекстное окно в 1 миллион токенов и может обрабатывать мультимодальные задачи, такие как изображения, аудио и код; как самая экономичная модель Google на данный момент, использует упрощённую единую ценовую стратегию и особенно подходит для крупномасштабных сценариев, чувствительных к стоимости.
gemini-2.0-flash-thinking-exp
40k
8k
Не поддерживается
Диалог, рассуждение
Google_gemini
gemini-2.0-flash-thinking-exp — экспериментальная модель, которая может генерировать «процесс мышления», переживаемый при формировании ответа. Поэтому по сравнению с базовой моделью Gemini 2.0 Flash ответы в режиме «thinking» обладают более сильными возможностями рассуждения.
gemini-2.0-flash-thinking-exp-01-21
1m
64k
Не поддерживается
Диалог, рассуждение
Google_gemini
Gemini 2.0 Flash Thinking EXP-01-21 — новейшая AI-модель Google, ориентированная на повышение возможностей рассуждения и качества взаимодействия с пользователем. Модель обладает мощными способностями к рассуждению, особенно хорошо проявляет себя в математике и программировании, а также поддерживает контекстное окно до 1 миллиона токенов, подходя для сложных задач и сценариев глубокого анализа. Её уникальность в том, что она может генерировать процесс мышления, повышая понятность рассуждений ИИ, а также поддерживает нативное выполнение кода, усиливая гибкость и практическую ценность взаимодействия. Благодаря оптимизации алгоритмов модель уменьшает логические противоречия, дополнительно повышая точность и согласованность ответов.
gemini-2.0-flash-thinking-exp-1219
40k
8k
Не поддерживается
Диалог, рассуждение, распознавание изображений
Google_gemini
gemini-2.0-flash-thinking-exp-1219 — экспериментальная модель, которая может генерировать «процесс мышления», переживаемый при формировании ответа. Поэтому по сравнению с базовой моделью Gemini 2.0 Flash ответы в режиме «thinking» обладают более сильными возможностями рассуждения.
gemini-2.0-pro-exp-01-28
2m
64k
Не поддерживается
Диалог, распознавание изображений
Google_gemini
Предзагруженная модель, ещё не запущена
gemini-2.0-pro-exp-02-05
2m
8k
Не поддерживается
Диалог, распознавание изображений
Google_gemini
Gemini 2.0 Pro Exp 02-05 — новейшая экспериментальная модель Google, выпущенная в феврале 2024 года, с выдающимися результатами в мировых знаниях, генерации кода и понимании длинных текстов; модель поддерживает сверхдлинное контекстное окно в 2 миллиона токенов и может обрабатывать 2 часа видео, 22 часа аудио, более 60 тысяч строк кода и более 1,4 миллиона слов; как часть серии Gemini 2.0, модель использует новую стратегию обучения Flash Thinking, что значительно повышает производительность и выводит её в лидеры по многим рейтингам LLM, демонстрируя мощные комплексные возможности.
gemini-exp-1114
8k
4k
Не поддерживается
Диалог, распознавание изображений
Google_gemini
Это экспериментальная модель, выпущенная 14 ноября 2024 года, с основным фокусом на улучшении качества.
gemini-exp-1121
8k
4k
Не поддерживается
Диалог, распознавание изображений, код
Google_gemini
Это экспериментальная модель, выпущенная 21 ноября 2024 года, с улучшенными возможностями кодирования, рассуждения и зрения.
gemini-exp-1206
8k
4k
Не поддерживается
Диалог, распознавание изображений
Google_gemini
Это экспериментальная модель, выпущенная 6 декабря 2024 года, с улучшенными возможностями кодирования, рассуждения и зрения.
gemini-exp-latest
8k
4k
Не поддерживается
Диалог, распознавание изображений
Google_gemini
Это экспериментальная модель, динамически указывающая на последнюю версию
gemini-pro
33k
8k
Не поддерживается
Диалог
Google_gemini
То же, что gemini-1.0-pro, псевдоним gemini-1.0-pro
gemini-pro-vision
16k
2k
Не поддерживается
Диалог, распознавание изображений
Google_gemini
Это визуальная версия Gemini 1.0 Pro. Эта модель будет выведена из эксплуатации 15 февраля 2025 года; рекомендуется перейти на модели серии 1.5.
grok-2
128k
-
Не поддерживается
Диалог
Grok_grok
Новая версия модели grok, выпущенная X.ai 12.12.2024.
grok-2-1212
128k
-
Не поддерживается
Диалог
Grok_grok
Новая версия модели grok, выпущенная X.ai 12.12.2024.
grok-2-latest
128k
-
Не поддерживается
Диалог
Grok_grok
Новая версия модели grok, выпущенная X.ai 12.12.2024.
grok-2-vision-1212
32k
-
Не поддерживается
Диалог, распознавание изображений
Grok_grok
Визуальная версия модели grok, выпущенная X.ai 12.12.2024.
grok-beta
100k
-
Не поддерживается
Диалог
Grok_grok
По производительности сопоставима с Grok 2, но с улучшенными эффективностью, скоростью и функциями.
grok-vision-beta
8k
-
Не поддерживается
Диалог, распознавание изображений
Grok_grok
Новейшая модель понимания изображений может обрабатывать различные визуальные данные, включая документы, диаграммы, скриншоты и фотографии.
internlm/internlm2_5-20b-chat
32k
-
Поддерживается
Диалог
internlm
InternLM2.5-20B-Chat — это открытая крупная диалоговая модель, разработанная на базе архитектуры InternLM2. Модель имеет 20 миллиардов параметров и отлично проявляет себя в математическом рассуждении, превосходя модели Llama3 и Gemma2-27B того же масштаба. Возможности вызова инструментов у InternLM2.5-20B-Chat значительно улучшены: она поддерживает сбор информации со сотен веб-страниц для анализа и рассуждения, а также обладает более сильным пониманием инструкций, выбором инструментов и рефлексией над результатами.
meta-llama/Llama-3.2-11B-Vision-Instruct
8k
-
Не поддерживается
Диалог, распознавание изображений
Meta_llama
На данный момент модели серии Llama умеют обрабатывать не только текстовые данные, но и изображения; некоторые модели Llama3.2 добавили функцию визуального понимания. Эта модель поддерживает одновременный ввод текста и изображений, понимает изображения и выводит текстовую информацию.
meta-llama/Llama-3.2-3B-Instruct
32k
-
Не поддерживается
Диалог
Meta_llama
Многоязычная большая языковая модель (LLM) Meta Llama 3.2, где 1B и 3B — это лёгкие модели, способные работать на edge-устройствах и мобильных устройствах; данная модель — версия 3B.
meta-llama/Llama-3.2-90B-Vision-Instruct
8k
-
Не поддерживается
Диалог, распознавание изображений
Meta_llama
На данный момент модели серии Llama умеют обрабатывать не только текстовые данные, но и изображения; некоторые модели Llama3.2 добавили функцию визуального понимания. Эта модель поддерживает одновременный ввод текста и изображений, понимает изображения и выводит текстовую информацию.
meta-llama/Llama-3.3-70B-Instruct
131k
-
Не поддерживается
Диалог
Meta_llama
Новейшая 70B LLM от Meta, сопоставимая по производительности с llama 3.1 405B.
meta-llama/Meta-Llama-3.1-405B-Instruct
32k
-
Не поддерживается
Диалог
Meta_llama
Коллекция многоязычных больших языковых моделей (LLM) Meta Llama 3.1 представляет собой набор предварительно обученных и дообученных по инструкциям генеративных моделей размеров 8B, 70B и 405B; данная модель — версия 405B. Текстовые модели Llama 3.1 с дообучением инструкциями (8B, 70B, 405B) оптимизированы для многоязычного диалога и превосходят многие доступные open-source и закрытые чат-модели по распространённым отраслевым бенчмаркам.
meta-llama/Meta-Llama-3.1-70B-Instruct
32k
-
Не поддерживается
Диалог
Meta_llama
Meta Llama 3.1 — семейство многоязычных больших языковых моделей, разработанное Meta, включающее предварительно обученные и дообученные по инструкциям варианты с тремя масштабами параметров: 8B, 70B и 405B. Эта модель 70B, дообученная по инструкциям, оптимизирована для сценариев многоязычного диалога и показывает отличные результаты в ряде отраслевых бенчмарков. Модель обучалась на более чем 15 триллионах открытых данных и использует такие техники, как supervised fine-tuning и reinforcement learning with human feedback для повышения полезности и безопасности.
meta-llama/Meta-Llama-3.1-8B-Instruct
32k
-
Не поддерживается
Диалог
Meta_llama
Коллекция многоязычных больших языковых моделей (LLM) Meta Llama 3.1 представляет собой набор предварительно обученных и дообученных по инструкциям генеративных моделей размеров 8B, 70B и 405B; данная модель — версия 8B. Текстовые модели Llama 3.1 с дообучением инструкциями (8B, 70B, 405B) оптимизированы для многоязычного диалога и превосходят многие доступные open-source и закрытые чат-модели по распространённым отраслевым бенчмаркам.
abab5.5-chat
16k
-
Поддерживается
Диалог
Minimax_abab
Сценарии диалогов с китайскими персонажами
abab5.5s-chat
8k
-
Поддерживается
Диалог
Minimax_abab
Сценарии диалогов с китайскими персонажами
abab6.5g-chat
8k
-
Поддерживается
Диалог
Minimax_abab
Сценарии диалогов с персонажами на английском и других языках
abab6.5s-chat
245k
-
Поддерживается
Диалог
Minimax_abab
Общий сценарий
abab6.5t-chat
8k
-
Поддерживается
Диалог
Minimax_abab
Сценарии диалогов с китайскими персонажами
chatgpt-4o-latest
128k
16k
Не поддерживается
Диалог, распознавание изображений
OpenAI
Версия модели chatgpt-4o-latest постоянно указывает на версию GPT-4o, используемую в ChatGPT, и обновляется как можно быстрее при серьёзных изменениях.
gpt-4o-2024-11-20
128k
16k
Поддерживается
Диалог
OpenAI
Последний снимок gpt-4o от 20 ноября 2024 года.
gpt-4o-audio-preview
128k
16k
Не поддерживается
Диалог
OpenAI
Модель OpenAI для диалогов в реальном времени с голосом
gpt-4o-audio-preview-2024-10-01
128k
16k
Поддерживается
Диалог
OpenAI
Модель OpenAI для диалогов в реальном времени с голосом
o1
128k
32k
Не поддерживается
Диалог, рассуждение, распознавание изображений
OpenAI
Новая модель рассуждения от OpenAI для сложных задач, требующих широких общих знаний. Модель имеет контекст 200k, на данный момент это самая сильная модель в мире, поддерживает распознавание изображений
o1-mini-2024-09-12
128k
64k
Не поддерживается
Диалог, рассуждение
OpenAI
Фиксированная снимковая версия o1-mini; меньше и быстрее, чем o1-preview, на 80% дешевле и хорошо показывает себя в генерации кода и операциях с небольшим контекстом.
o1-preview-2024-09-12
128k
32k
Не поддерживается
Диалог, рассуждение
OpenAI
Фиксированная снимковая версия o1-preview
gpt-3.5-turbo
16k
4k
Поддерживается
Диалог
OpenAI_gpt-3
На основе GPT-3.5: GPT-3.5 Turbo — улучшенная версия, созданная на базе модели GPT-3.5, разработанная OpenAI. Цель по производительности: предназначена для повышения скорости рассуждения, эффективности обработки и использования ресурсов за счёт оптимизации структуры модели и алгоритмов. Увеличенная скорость рассуждения: по сравнению с GPT-3.5, GPT-3.5 Turbo обычно может обеспечивать более высокую скорость вывода при тех же аппаратных условиях, что особенно полезно для приложений с крупномасштабной обработкой текста. Более высокая пропускная способность: при обработке большого числа запросов или данных GPT-3.5 Turbo может обеспечивать более высокую параллельную производительность, тем самым повышая общую пропускную способность системы. Оптимизированное потребление ресурсов: при сохранении производительности может снижать требования к аппаратным ресурсам (таким как память и вычислительные ресурсы), что помогает уменьшить эксплуатационные расходы и повысить масштабируемость системы. Широкий спектр задач обработки естественного языка: GPT-3.5 Turbo подходит для различных задач NLP, включая, помимо прочего, генерацию текста, семантическое понимание, диалоговые системы, машинный перевод и т. д. Инструменты разработчика и поддержка API: предоставляет удобные для интеграции и использования разработчиками API-интерфейсы, поддерживающие быструю разработку и развёртывание приложений.
gpt-3.5-turbo-0125
16k
4k
Поддерживается
Диалог
OpenAI_gpt-3
Обновлённый GPT 3.5 Turbo, с более высокой точностью обработки запросов в нужном формате, а также исправлена ошибка, вызывавшая проблемы с кодировкой текста при вызове функций на неанглийских языках. Возвращает до 4 096 выходных токенов.
gpt-3.5-turbo-0613
16k
4k
Поддерживается
Диалог
OpenAI_gpt-3
Обновлённая фиксированная снимковая версия GPT 3.5 Turbo. Сейчас устарела
gpt-3.5-turbo-1106
16k
4k
Поддерживается
Диалог
OpenAI_gpt-3
С улучшенным следованием инструкциям, режимом JSON, воспроизводимым выводом, параллельным вызовом функций и т. д. Возвращает до 4 096 выходных токенов.
gpt-3.5-turbo-16k
16k
4k
Поддерживается
Диалог, устарела или скоро устареет
OpenAI_gpt-3
(устарело)
gpt-3.5-turbo-16k-0613
16k
4k
Поддерживается
Диалог, устарела или скоро устареет
OpenAI_gpt-3
Снимок gpt-3.5-turbo от 13 июня 2023 года. (устарело)
gpt-3.5-turbo-instruct
4k
4k
Поддерживается
Диалог
OpenAI_gpt-3
Возможности, аналогичные моделям эпохи GPT-3. Совместим с устаревшим endpoint Completions, не подходит для Chat Completions.
gpt-3.5o
16k
4k
Не поддерживается
Диалог
OpenAI_gpt-3
То же, что gpt-4o-lite
gpt-4
8k
8k
Поддерживается
Диалог
OpenAI_gpt-4
В настоящее время указывает на gpt-4-0613.
gpt-4-0125-preview
128k
4k
Поддерживается
Диалог
OpenAI_gpt-4
Новейшая модель GPT-4, созданная для уменьшения случаев «лени», когда модель не завершает задачу. Возвращает до 4 096 выходных токенов.
gpt-4-0314
8k
8k
Поддерживается
Диалог
OpenAI_gpt-4
Снимок GPT-4 от 14 марта 2023 года
gpt-4-0613
8k
8k
Поддерживается
Диалог
OpenAI_gpt-4
Снимок GPT-4 от 13 июня 2023 года, с улучшенной поддержкой вызова функций.
gpt-4-1106-preview
128k
4k
Поддерживается
Диалог
OpenAI_gpt-4
Модель GPT-4 Turbo с улучшенным следованием инструкциям, режимом JSON, воспроизводимым выводом, вызовом функций и т. д. Возвращает до 4 096 выходных токенов. Это preview-модель.
gpt-4-32k
32k
4k
Поддерживается
Диалог
OpenAI_gpt-4
gpt-4-32k будет устаревшей 2025-06-06.
gpt-4-32k-0613
32k
4k
Поддерживается
Диалог, устарела или скоро устареет
OpenAI_gpt-4
Будет устаревшей 2025-06-06.
gpt-4-turbo
128k
4k
Поддерживается
Диалог
OpenAI_gpt-4
Последняя версия модели GPT-4 Turbo получила визуальные возможности и поддерживает обработку визуальных запросов через JSON-режим и вызов функций. Текущая версия этой модели — gpt-4-turbo-2024-04-09.
gpt-4-turbo-2024-04-09
128k
4k
Поддерживается
Диалог
OpenAI_gpt-4
Модель GPT-4 Turbo с визуальными возможностями. Теперь визуальные запросы могут реализовываться через JSON-режим и вызов функций. Текущая версия gpt-4-turbo — именно эта версия.
gpt-4-turbo-preview
128k
4k
Поддерживается
Диалог, распознавание изображений
OpenAI_gpt-4
В настоящее время указывает на gpt-4-0125-preview.
gpt-4o
128k
16k
Поддерживается
Диалог, распознавание изображений
OpenAI_gpt-4
Флагманская модель OpenAI с высоким уровнем интеллекта, подходящая для сложных многошаговых задач. GPT-4o дешевле и быстрее, чем GPT-4 Turbo.
gpt-4o-2024-05-13
128k
4k
Поддерживается
Диалог, распознавание изображений
OpenAI_gpt-4
Оригинальный снимок gpt-4o от 13 мая 2024 года.
gpt-4o-2024-08-06
128k
16k
Поддерживается
Диалог, распознавание изображений
OpenAI_gpt-4
Первый снимок с поддержкой структурированного вывода. gpt-4o в настоящее время указывает на эту версию.
gpt-4o-mini
128k
16k