For the complete documentation index, see llms.txt. This page is also available as Markdown.

モデルデータ

  • 以下の情報は参考用です。誤りがあればご連絡いただければ修正します。一部モデルは提供元が異なるため、コンテキストサイズやモデル情報も異なる場合があります;

  • クライアントでデータを入力する際は「k」を実際の数値に変換する必要があります(理論上 1k=1024 tokens;1m=1024k tokens)。例えば 8k は 8×1024=8192 tokens です。実際の使用時には×1000としておけばエラーを防げます。例えば 8k は 8×1000=8000、1m=1×1000000=1000000 です;

  • 最大出力が「-」のものは、公式からそのモデルの明確な最大出力情報を取得できなかったものです。

モデル名
最大入力
最大出力
関数呼び出し
モデル能力
プロバイダー
概要

360gpt-pro

8k

-

非対応

会話

360AI_360gpt

360知脳シリーズで最も性能の良い主力の1000億級大規模モデルで、幅広い分野の複雑なタスクシーンに適しています。

360gpt-turbo

7k

-

非対応

会話

360AI_360gpt

性能と効果を両立した100億級大規模モデルで、性能/コスト要件が高いシーンに適しています。

360gpt-turbo-responsibility-8k

8k

-

非対応

会話

360AI_360gpt

性能と効果を両立した100億級大規模モデルで、性能/コスト要件が高いシーンに適しています。

360gpt2-pro

8k

-

非対応

会話

360AI_360gpt

360知脳シリーズで最も性能の良い主力の1000億級大規模モデルで、幅広い分野の複雑なタスクシーンに適しています。

claude-3-5-sonnet-20240620

200k

16k

非対応

会話,画像認識

Anthropic_claude

2024年6月20日にリリースされたスナップショット版。Claude 3.5 Sonnet は、性能と速度のバランスが取れたモデルで、高速性を保ちながらトップクラスの性能を提供し、マルチモーダル入力をサポートします。

claude-3-5-haiku-20241022

200k

16k

非対応

会話

Anthropic_claude

2024年10月22日にリリースされたスナップショット版。Claude 3.5 Haiku は、コーディング、ツール利用、推論を含む各種スキルが向上しています。Anthropicシリーズで最も高速なモデルとして、迅速な応答時間を提供し、ユーザー向けチャットボットや即時コード補完のような、高いインタラクティブ性と低遅延を要するアプリに適しています。データ抽出やリアルタイムコンテンツ審査などの専門タスクでも優れた性能を発揮し、各業界で広く使える多用途ツールです。画像入力はサポートしていません。

claude-3-5-sonnet-20241022

200k

8K

非対応

会話,画像認識

Anthropic_claude

2024年10月22日にリリースされたスナップショット版。Claude 3.5 Sonnet は、Opus を上回る能力と Sonnet より速い速度を提供しつつ、Sonnet と同じ価格を維持しています。Sonnet は特にプログラミング、データサイエンス、視覚処理、エージェントタスクに優れています。

claude-3-5-sonnet-latest

200K

8k

非対応

会話,画像認識

Anthropic_claude

最新の Claude 3.5 Sonnet 版を動的に指します。Claude 3.5 Sonnet は、Opus を上回る能力と Sonnet より速い速度を提供しつつ、Sonnet と同じ価格を維持しています。Sonnet は特にプログラミング、データサイエンス、視覚処理、エージェントタスクに優れており、このモデルは最新バージョンを指します。

claude-3-haiku-20240307

200k

4k

非対応

会話,画像認識

Anthropic_claude

Claude 3 Haiku は Anthropic の最速かつ最もコンパクトなモデルで、ほぼ即時の応答を実現するよう設計されています。高速で正確な定向性能を備えています。

claude-3-opus-20240229

200k

4k

非対応

会話,画像認識

Anthropic_claude

Claude 3 Opus は、Anthropic が高度に複雑なタスクの処理に向けて提供する最も強力なモデルです。性能、知性、流暢さ、理解力の面で卓越しています。

claude-3-sonnet-20240229

200k

8k

非対応

会話,画像認識

Anthropic_claude

2024年2月29日にリリースされたスナップショット版。Sonnet は特に以下に優れています: - コーディング:自律的にコードを作成・編集・実行でき、推論とトラブルシューティング能力を備えています - データサイエンス:人間のデータサイエンス専門知識を強化し、複数のツールを使って洞察を得る際に非構造化データを扱えます - 視覚処理:図表、グラフ、画像の解釈に優れ、テキストを正確に転記してテキスト以上の洞察を得られます - エージェントタスク:ツール利用に優れ、エージェントタスク(他のシステムとのやり取りを必要とする複雑な多段階の問題解決タスク)に最適です

google/gemma-2-27b-it

8k

-

非対応

会話

Google_gamma

Gemma は Google が開発した軽量で最先端のオープンモデルシリーズで、Gemini モデルと同じ研究と技術を用いて構築されています。これらのモデルはデコーダー専用の大規模言語モデルで、英語に対応し、事前学習版と指示微調整版の両方でオープンウェイトを提供します。Gemma モデルは、Q&A、要約、推論を含むさまざまなテキスト生成タスクに適しています。

google/gemma-2-9b-it

8k

-

非対応

会話

Google_gamma

Gemma は Google が開発した軽量で最先端のオープンモデルシリーズの一つです。デコーダー専用の大規模言語モデルで、英語に対応し、オープンウェイトの事前学習版と指示微調整版を提供します。Gemma モデルは、Q&A、要約、推論を含むさまざまなテキスト生成タスクに適しています。この 9B モデルは 8 兆 tokens で学習されています。

gemini-1.5-pro

2m

8k

非対応

会話

Google_gemini

Gemini 1.5 Pro の最新安定版です。強力なマルチモーダルモデルとして、最大 6万行のコードまたは 2,000ページのテキストを処理できます。特に複雑な推論を必要とするタスクに適しています。

gemini-1.0-pro-001

33k

8k

非対応

会話

Google_gemini

これは Gemini 1.0 Pro の安定版です。NLP モデルとして、複数ターンのテキスト・コードチャットやコード生成などのタスクを専門に処理します。このモデルは 2025年2月15日に廃止予定で、1.5 系列モデルへの移行が推奨されます。

gemini-1.0-pro-002

32k

8k

非対応

会話

Google_gemini

これは Gemini 1.0 Pro の安定版です。NLP モデルとして、複数ターンのテキスト・コードチャットやコード生成などのタスクを専門に処理します。このモデルは 2025年2月15日に廃止予定で、1.5 系列モデルへの移行が推奨されます。

gemini-1.0-pro-latest

33k

8k

非対応

会話,廃止済みまたは廃止予定

Google_gemini

これは Gemini 1.0 Pro の最新版です。NLP モデルとして、複数ターンのテキスト・コードチャットやコード生成などのタスクを専門に処理します。このモデルは 2025年2月15日に廃止予定で、1.5 系列モデルへの移行が推奨されます。

gemini-1.0-pro-vision-001

16k

2k

非対応

会話

Google_gemini

これは Gemini 1.0 Pro のビジョン版です。このモデルは 2025年2月15日に廃止予定で、1.5 系列モデルへの移行が推奨されます。

gemini-1.0-pro-vision-latest

16k

2k

非対応

画像認識

Google_gemini

これは Gemini 1.0 Pro のビジョン最新版です。このモデルは 2025年2月15日に廃止予定で、1.5 系列モデルへの移行が推奨されます。

gemini-1.5-flash

1m

8k

非対応

会話,画像認識

Google_gemini

これは Gemini 1.5 Flash の最新安定版です。バランスの取れたマルチモーダルモデルとして、音声、画像、動画、テキスト入力を処理できます。

gemini-1.5-flash-001

1m

8k

非対応

会話,画像認識

Google_gemini

これは Gemini 1.5 Flash の安定版です。gemini-1.5-flash と同じ基本機能を提供しますが、バージョン固定で、本番環境での使用に適しています。

gemini-1.5-flash-002

1m

8k

非対応

会話,画像認識

Google_gemini

これは Gemini 1.5 Flash の安定版です。gemini-1.5-flash と同じ基本機能を提供しますが、バージョン固定で、本番環境での使用に適しています。

gemini-1.5-flash-8b

1m

8k

非対応

会話,画像認識

Google_gemini

Gemini 1.5 Flash-8B は Google の最新のマルチモーダル AI モデルで、大規模タスクを効率的に処理するよう設計されています。このモデルは 80億パラメータを持ち、テキスト、画像、音声、動画入力をサポートし、チャット、文字起こし、翻訳など多様な用途に適しています。他の Gemini モデルと比べて、Flash-8B は速度とコスト効率が最適化されており、特にコスト重視のユーザーに適しています。レート制限は2倍に引き上げられており、開発者はより効率的に大規模タスクを処理できます。さらに、Flash-8B は「知識蒸留」技術を採用し、より大きなモデルから重要な知識を抽出して、コア能力を維持しながら軽量かつ高効率を実現しています

gemini-1.5-flash-exp-0827

1m

8k

非対応

会話,画像認識

Google_gemini

これは Gemini 1.5 Flash の実験版で、最新の改良を含めるため定期的に更新されます。探索的テストやプロトタイプ開発に適しており、本番環境での使用は推奨されません。

gemini-1.5-flash-latest

1m

8k

非対応

会話,画像認識

Google_gemini

これは Gemini 1.5 Flash の最先端版で、最新の改良を含めるため定期的に更新されます。探索的テストやプロトタイプ開発に適しており、本番環境での使用は推奨されません。

gemini-1.5-pro-001

2m

8k

非対応

会話,画像認識

Google_gemini

これは Gemini 1.5 Pro の安定版で、固定されたモデル挙動と性能特性を提供します。安定性を必要とする本番環境に適しています。

gemini-1.5-pro-002

2m

8k

非対応

会話,画像認識

Google_gemini

これは Gemini 1.5 Pro の安定版で、固定されたモデル挙動と性能特性を提供します。安定性を必要とする本番環境に適しています。

gemini-1.5-pro-exp-0801

2m

8k

非対応

会話,画像認識

Google_gemini

Gemini 1.5 Pro の試験版です。強力なマルチモーダルモデルとして、最大 6万行のコードまたは 2,000ページのテキストを処理できます。特に複雑な推論を必要とするタスクに適しています。

gemini-1.5-pro-exp-0827

2m

8k

非対応

会話,画像認識

Google_gemini

Gemini 1.5 Pro の試験版です。強力なマルチモーダルモデルとして、最大 6万行のコードまたは 2,000ページのテキストを処理できます。特に複雑な推論を必要とするタスクに適しています。

gemini-1.5-pro-latest

2m

8k

非対応

会話,画像認識

Google_gemini

これは Gemini 1.5 Pro の最新版で、最新のスナップショット版を動的に指します

gemini-2.0-flash

1m

8k

非対応

会話,画像認識

Google_gemini

Gemini 2.0 Flash は Google の最新モデルで、1.5 版より初回生成速度(TTFT)が高速でありながら、Gemini Pro 1.5 に匹敵する品質を維持しています。このモデルはマルチモーダル理解、コード能力、複雑な指示実行、関数呼び出しなどで大幅に向上しており、より滑らかで強力な知能体験を提供できます。

gemini-2.0-flash-exp

100k

8k

対応

会話,画像認識

Google_gemini

Gemini 2.0 Flash はマルチモーダルのリアルタイム API、速度と性能の改善、品質向上、エージェント能力の強化を導入し、画像生成と音声変換機能も追加しました。

gemini-2.0-flash-lite-preview-02-05

1M

8k

非対応

会話,画像認識

Google_gemini

Gemini 2.0 Flash-Lite は Google の最新リリースの高コストパフォーマンス AI モデルで、1.5 Flash と同じ速度を保ちながら品質が向上しています。100万 tokens のコンテキストウィンドウをサポートし、画像・音声・コードなどのマルチモーダルタスクを処理できます。現在もっともコスト効率の高い Google のモデルとして、簡略化された単一価格戦略を採用し、特にコスト管理が必要な大規模アプリケーションに適しています。

gemini-2.0-flash-thinking-exp

40k

8k

非対応

会話,推論

Google_gemini

gemini-2.0-flash-thinking-exp は実験モデルで、応答を生成する際に経由した「思考プロセス」を出力できます。そのため、基本の Gemini 2.0 Flash と比べて、「思考モード」の応答はより強い推論能力を持ちます。

gemini-2.0-flash-thinking-exp-01-21

1m

64k

非対応

会話,推論

Google_gemini

Gemini 2.0 Flash Thinking EXP-01-21 は Google の最新の AI モデルで、推論能力とユーザー体験の向上に重点を置いています。このモデルは強力な推論能力を備え、特に数学とプログラミング分野で優れた性能を発揮し、最大 100 万 token のコンテキストウィンドウをサポートするため、複雑なタスクや詳細分析シーンに適しています。独自の特徴として、思考プロセスを生成して AI の思考を理解しやすくし、ネイティブコード実行にも対応して、対話の柔軟性と実用性を高めています。アルゴリズムの最適化により論理矛盾を減らし、回答の正確性と一貫性をさらに向上させています。

gemini-2.0-flash-thinking-exp-1219

40k

8k

非対応

会話,推論,画像認識

Google_gemini

gemini-2.0-flash-thinking-exp-1219 は実験モデルで、応答を生成する際に経由した「思考プロセス」を出力できます。そのため、基本の Gemini 2.0 Flash と比べて、「思考モード」の応答はより強い推論能力を持ちます。

gemini-2.0-pro-exp-01-28

2m

64k

非対応

会話,画像認識

Google_gemini

事前公開モデル,まだ公開されていません

gemini-2.0-pro-exp-02-05

2m

8k

非対応

会話,画像認識

Google_gemini

Gemini 2.0 Pro Exp 02-05 は Google の2024年2月リリースの最新実験モデルで、世界知識、コード生成、長文理解の面で優れています。このモデルは 200万 tokens の超長コンテキストウィンドウをサポートし、2時間の動画、22時間の音声、6万行超のコード、140万語超のコンテンツを処理できます。Gemini 2.0 シリーズの一部として、新しい Flash Thinking 学習戦略を採用し、性能が大幅に向上しており、複数の LLM ランキングで上位に位置し、強力な総合能力を示しています。

gemini-exp-1114

8k

4k

非対応

会話,画像認識

Google_gemini

2024年11月14日にリリースされた実験モデルで、主に品質改善に重点を置いています。

gemini-exp-1121

8k

4k

非対応

会話,画像認識,コード

Google_gemini

2024年11月21日にリリースされた実験モデルで、コーディング、推論、視覚能力が改善されています。

gemini-exp-1206

8k

4k

非対応

会話,画像認識

Google_gemini

2024年12月6日にリリースされた実験モデルで、コーディング、推論、視覚能力が改善されています。

gemini-exp-latest

8k

4k

非対応

会話,画像認識

Google_gemini

これは実験モデルで、最新バージョンを動的に指します

gemini-pro

33k

8k

非対応

会話

Google_gemini

gemini-1.0-pro と同じで、gemini-1.0-pro の別名です

gemini-pro-vision

16k

2k

非対応

会話,画像認識

Google_gemini

これは Gemini 1.0 Pro のビジョン版です。このモデルは 2025年2月15日に廃止予定で、1.5 系列モデルへの移行が推奨されます。

grok-2

128k

-

非対応

会話

Grok_grok

X.ai が2024.12.12にリリースした新バージョンの grok モデルです。

grok-2-1212

128k

-

非対応

会話

Grok_grok

X.ai が2024.12.12にリリースした新バージョンの grok モデルです。

grok-2-latest

128k

-

非対応

会話

Grok_grok

X.ai が2024.12.12にリリースした新バージョンの grok モデルです。

grok-2-vision-1212

32k

-

非対応

会話,画像認識

Grok_grok

X.ai が2024.12.12にリリースした grok のビジョン版モデルです。

grok-beta

100k

-

非対応

会話

Grok_grok

性能は Grok 2 と同等ですが、効率、速度、機能が向上しています。

grok-vision-beta

8k

-

非対応

会話,画像認識

Grok_grok

最新の画像理解モデルで、文書、図表、スクリーンショット、写真など、さまざまな視覚情報を処理できます。

internlm/internlm2_5-20b-chat

32k

-

対応

会話

internlm

InternLM2.5-20B-Chat は InternLM2 アーキテクチャを基に開発されたオープンソースの大規模対話モデルです。このモデルは200億パラメータを持ち、数学的推論で優れた性能を示し、同規模の Llama3 や Gemma2-27B を上回ります。InternLM2.5-20B-Chat はツール呼び出し能力が大幅に向上しており、数百のウェブページから情報を収集して分析・推論することをサポートし、指示理解、ツール選択、結果の反省能力も強化されています。

meta-llama/Llama-3.2-11B-Vision-Instruct

8k

-

非対応

会話,画像認識

Meta_llama

現在の Llama 系列モデルはテキストデータだけでなく画像データも処理できます。Llama3.2 の一部モデルには視覚理解機能が追加されており、このモデルはテキストと画像データを同時に入力でき、画像を理解してテキスト情報を出力します。

meta-llama/Llama-3.2-3B-Instruct

32k

-

非対応

会話

Meta_llama

Meta Llama 3.2 の多言語大規模言語モデル(LLM)で、1B と 3B はエッジデバイスやモバイルデバイス上で動作可能な軽量モデルです。本モデルは 3B 版です。

meta-llama/Llama-3.2-90B-Vision-Instruct

8k

-

非対応

会話,画像認識

Meta_llama

現在の Llama 系列モデルはテキストデータだけでなく画像データも処理できます。Llama3.2 の一部モデルには視覚理解機能が追加されており、このモデルはテキストと画像データを同時に入力でき、画像を理解してテキスト情報を出力します。

meta-llama/Llama-3.3-70B-Instruct

131k

-

非対応

会話

Meta_llama

Meta の最新 70B LLM で、性能は llama 3.1 405B に匹敵します。

meta-llama/Meta-Llama-3.1-405B-Instruct

32k

-

非対応

会話

Meta_llama

Meta Llama 3.1 の多言語大規模言語モデル(LLM)コレクションは、8B、70B、405B サイズの事前学習および指示微調整済み生成モデルの集合で、本モデルは 405B 版です。Llama 3.1 指示微調整テキストモデル(8B、70B、405B)は多言語対話向けに最適化されており、一般的な業界ベンチマークで多くの利用可能なオープンソース/クローズドソースのチャットモデルを上回ります。

meta-llama/Meta-Llama-3.1-70B-Instruct

32k

-

非対応

会話

Meta_llama

Meta Llama 3.1 は Meta が開発した多言語大規模言語モデル群で、8B、70B、405B の3種類のパラメータ規模の事前学習版と指示微調整版があります。この 70B 指示微調整モデルは多言語対話シーン向けに最適化されており、複数の業界ベンチマークで優れた成績を示しています。学習には 15兆 tokens を超える公開データが使用され、監督学習による微調整や人間のフィードバックによる強化学習などの技術で、モデルの有用性と安全性が向上されています。

meta-llama/Meta-Llama-3.1-8B-Instruct

32k

-

非対応

会話

Meta_llama

Meta Llama 3.1 の多言語大規模言語モデル(LLM)コレクションは、8B、70B、405B サイズの事前学習および指示微調整済み生成モデルの集合で、本モデルは 8B 版です。Llama 3.1 指示微調整テキストモデル(8B、70B、405B)は多言語対話向けに最適化されており、一般的な業界ベンチマークで多くの利用可能なオープンソース/クローズドソースのチャットモデルを上回ります。

abab5.5-chat

16k

-

対応

会話

Minimax_abab

中国語のキャラ設定対話シーン

abab5.5s-chat

8k

-

対応

会話

Minimax_abab

中国語のキャラ設定対話シーン

abab6.5g-chat

8k

-

対応

会話

Minimax_abab

英語など多言語のキャラ設定対話シーン

abab6.5s-chat

245k

-

対応

会話

Minimax_abab

汎用シーン

abab6.5t-chat

8k

-

対応

会話

Minimax_abab

中国語のキャラ設定対話シーン

chatgpt-4o-latest

128k

16k

非対応

会話,画像認識

OpenAI

chatgpt-4o-latest モデル版は、ChatGPT で使用される GPT-4o 版を継続的に指し、重大な変更がある場合は最速で更新されます。

gpt-4o-2024-11-20

128k

16k

対応

会話

OpenAI

2024年11月20日の最新 gpt-4o スナップショット版。

gpt-4o-audio-preview

128k

16k

非対応

会話

OpenAI

OpenAI のリアルタイム音声対話モデル

gpt-4o-audio-preview-2024-10-01

128k

16k

対応

会話

OpenAI

OpenAI のリアルタイム音声対話モデル

o1

128k

32k

非対応

会話,推論,画像認識

OpenAI

OpenAI の、幅広い常識を必要とする複雑なタスク向けの新しい推論モデルです。このモデルは 200k のコンテキストを持ち、現在世界最強クラスのモデルで、画像認識をサポートします

o1-mini-2024-09-12

128k

64k

非対応

会話,推論

OpenAI

o1-mini の固定スナップショット版。o1-preview より小さく高速で、コストは80%低く、コード生成と小さなコンテキストの操作で良好な性能を示します。

o1-preview-2024-09-12

128k

32k

非対応

会話,推論

OpenAI

o1-preview の固定スナップショット版

gpt-3.5-turbo

16k

4k

対応

会話

OpenAI_gpt-3

GPT-3.5 ベース:GPT-3.5 Turbo は GPT-3.5 モデルを基にした OpenAI 開発の改良版です。 性能目標:モデル構造とアルゴリズムの最適化により、推論速度、処理効率、リソース利用率を向上させることを目的としています。 向上した推論速度:GPT-3.5 と比べ、GPT-3.5 Turbo は同じハードウェア条件下で一般により高速な推論を提供でき、大規模テキスト処理が必要なアプリに特に有益です。 より高いスループット:大量のリクエストやデータを処理する際、GPT-3.5 Turbo はより高い並列処理能力を実現し、システム全体のスループットを向上させます。 最適化されたリソース消費:性能を維持しながら、ハードウェアリソース(メモリや計算資源など)への要求を下げている可能性があり、運用コスト削減とシステム拡張性向上に役立ちます。 幅広い自然言語処理タスク:GPT-3.5 Turbo はテキスト生成、意味理解、対話システム、機械翻訳など、さまざまな自然言語処理タスクに適しています。 開発者向けツールと API サポート:開発者が統合・利用しやすい API を提供し、アプリケーションの迅速な開発とデプロイをサポートします。

gpt-3.5-turbo-0125

16k

4k

対応

会話

OpenAI_gpt-3

更新された GPT 3.5 Turbo で、リクエスト形式への応答精度が向上し、非英語言語での関数呼び出しテキストのエンコード問題を引き起こしていたバグを修正しました。最大 4,096 個の出力トークンを返します。

gpt-3.5-turbo-0613

16k

4k

対応

会話

OpenAI_gpt-3

更新された GPT 3.5 Turbo の固定スナップショット版。現在は廃止済み

gpt-3.5-turbo-1106

16k

4k

対応

会話

OpenAI_gpt-3

指示追従、JSON モード、再現可能な出力、並列関数呼び出しなどが改善されています。最大 4,096 個の出力トークンを返します。

gpt-3.5-turbo-16k

16k

4k

対応

会話,廃止済みまたは廃止予定

OpenAI_gpt-3

(廃止済み)

gpt-3.5-turbo-16k-0613

16k

4k

対応

会話,廃止済みまたは廃止予定

OpenAI_gpt-3

gpt-3.5-turbo の 2023年6月13日スナップショット。(廃止済み)

gpt-3.5-turbo-instruct

4k

4k

対応

会話

OpenAI_gpt-3

GPT-3 時代のモデルに似た能力を持ちます。旧 Completions エンドポイントと互換性があり、Chat Completions には適していません。

gpt-3.5o

16k

4k

非対応

会話

OpenAI_gpt-3

gpt-4o-lite と同じ

gpt-4

8k

8k

対応

会話

OpenAI_gpt-4

現在は gpt-4-0613 を指しています。

gpt-4-0125-preview

128k

4k

対応

会話

OpenAI_gpt-4

最新の GPT-4 モデルで、「怠惰」状態、つまりモデルがタスクを完了しない状況を減らすよう設計されています。最大 4,096 個の出力トークンを返します。

gpt-4-0314

8k

8k

対応

会話

OpenAI_gpt-4

gpt-4 の 2023年3月14日スナップショット

gpt-4-0613

8k

8k

対応

会話

OpenAI_gpt-4

gpt-4 の 2023年6月13日スナップショットで、関数呼び出しサポートが強化されています。

gpt-4-1106-preview

128k

4k

対応

会話

OpenAI_gpt-4

GPT-4 Turbo モデルで、指示追従、JSON モード、再現可能な出力、関数呼び出しなどが改善されています。最大 4,096 個の出力トークンを返します。これはプレビューモデルです。

gpt-4-32k

32k

4k

対応

会話

OpenAI_gpt-4

gpt-4-32k は 2025-06-06 に廃止されます。

gpt-4-32k-0613

32k

4k

対応

会話,廃止済みまたは廃止予定

OpenAI_gpt-4

2025-06-06 に廃止されます。

gpt-4-turbo

128k

4k

対応

会話

OpenAI_gpt-4

最新版の GPT-4 Turbo モデルには視覚機能が追加され、JSON モードと関数呼び出しを通じて視覚リクエストを処理できます。このモデルの現在の版は gpt-4-turbo-2024-04-09 です。

gpt-4-turbo-2024-04-09

128k

4k

対応

会話

OpenAI_gpt-4

視覚機能付きの GPT-4 Turbo モデルです。現在、視覚リクエストは JSON モードと関数呼び出しで実現できます。gpt-4-turbo の現在の版はこの版です。

gpt-4-turbo-preview

128k

4k

対応

会話,画像認識

OpenAI_gpt-4

現在は gpt-4-0125-preview を指しています。

gpt-4o

128k

16k

対応

会話,画像認識

OpenAI_gpt-4

OpenAI の高知能フラッグシップモデルで、複雑な多段階タスクに適しています。GPT-4o は GPT-4 Turbo より安価で高速です。

gpt-4o-2024-05-13

128k

4k

対応

会話,画像認識

OpenAI_gpt-4

2024年5月13日の元の gpt-4o スナップショット。

gpt-4o-2024-08-06

128k

16k

対応

会話,画像認識

OpenAI_gpt-4

構造化出力をサポートする最初のスナップショットです。gpt-4o は現在この版を指しています。

gpt-4o-mini

128k

16k

対応

会話,画像認識

OpenAI_gpt-4