For the complete documentation index, see llms.txt. This page is also available as Markdown.

模型數據

  • 以下資訊僅供參考,如有錯誤可聯絡更正,部分模型嘅服務商唔同,其上下文大小同模型資訊可能都會有唔同;

  • 喺客戶端輸入數據時,需要將「k」轉換成實際數值(理論上 1k=1024 tokens;1m=1024k tokens),例如 8k 即係 8×1024=8192 tokens。建議實際使用時乘 1000 就得,避免報錯,例如 8k 即係 8×1000=8000,1m=1×1000000=1000000;

  • 最大輸出為「-」嘅,代表未喺官方查到該模型明確嘅最大輸出資訊。

模型名稱
最大輸入
最大輸出
函數調用
模型能力
服務商
簡介

360gpt-pro

8k

-

唔支援

對話

360AI_360gpt

360 智腦系列效果最好嘅主力千億級大模型,廣泛適用於各領域複雜任務場景。

360gpt-turbo

7k

-

唔支援

對話

360AI_360gpt

兼顧性能同效果嘅百億級大模型,適合對性能/成本要求較高嘅場景。

360gpt-turbo-responsibility-8k

8k

-

唔支援

對話

360AI_360gpt

兼顧性能同效果嘅百億級大模型,適合對性能/成本要求較高嘅場景。

360gpt2-pro

8k

-

唔支援

對話

360AI_360gpt

360 智腦系列效果最好嘅主力千億級大模型,廣泛適用於各領域複雜任務場景。

claude-3-5-sonnet-20240620

200k

16k

唔支援

對話,識圖

Anthropic_claude

於 2024 年 6 月 20 日發佈嘅快照版本,Claude 3.5 Sonnet 係一個平衡咗性能同速度嘅模型,喺保持高速嘅同時提供頂級性能,支援多模態輸入。

claude-3-5-haiku-20241022

200k

16k

唔支援

對話

Anthropic_claude

於 2024 年 10 月 22 日發佈嘅快照版本,Claude 3.5 Haiku 喺各項技能上都有所提升,包括編碼、工具使用同推理。作為 Anthropic 系列中速度最快嘅模型,佢提供快速回應時間,適合需要高互動性同低延遲嘅應用,例如面向用戶嘅聊天機械人同即時代碼補全。佢喺數據提取同實時內容審核等專業任務中亦表現出色,使佢成為各行各業廣泛應用嘅多功能工具。佢唔支援圖像輸入。

claude-3-5-sonnet-20241022

200k

8K

唔支援

對話,識圖

Anthropic_claude

於 2024 年 10 月 22 日發佈嘅快照版本,Claude 3.5 Sonnet 提供咗超越 Opus 嘅能力同比 Sonnet 更快嘅速度,同時保持同 Sonnet 一樣嘅價格。Sonnet 特別擅長編程、數據科學、視覺處理、代理任務。

claude-3-5-sonnet-latest

200K

8k

唔支援

對話,識圖

Anthropic_claude

動態指向最新嘅 Claude 3.5 Sonnet 版本,Claude 3.5 Sonnet 提供咗超越 Opus 嘅能力同比 Sonnet 更快嘅速度,同時保持同 Sonnet 一樣嘅價格。Sonnet 特別擅長編程、數據科學、視覺處理、代理任務,呢個模型指向最新版本。

claude-3-haiku-20240307

200k

4k

唔支援

對話,識圖

Anthropic_claude

Claude 3 Haiku 係 Anthropic 速度最快兼最緊湊嘅模型,旨在實現近乎即時嘅回應。佢具有快速而準確嘅定向性能。

claude-3-opus-20240229

200k

4k

唔支援

對話,識圖

Anthropic_claude

Claude 3 Opus 係 Anthropic 用嚟處理高度複雜任務嘅最強大模型。佢喺性能、智能、流暢性同理解力方面表現卓越。

claude-3-sonnet-20240229

200k

8k

唔支援

對話,識圖

Anthropic_claude

於 2024 年 2 月 29 日發佈嘅快照版本,Sonnet 特別擅長於:\n\n- 編碼:能夠自主編寫、編輯同運行代碼,並具備推理同故障排除能力\n- 數據科學:增強人類嘅數據科學專業知識;喺使用多種工具獲取洞察時,能夠處理非結構化數據\n- 視覺處理:擅長解讀圖表、圖形同圖像,準確轉錄文本以獲取超越文本本身嘅洞察\n- 代理任務:工具使用出色,非常適合處理代理任務(即需要同其他系統互動嘅複雜多步問題解決任務)

google/gemma-2-27b-it

8k

-

唔支援

對話

Google_gamma

Gemma 係由 Google 開發嘅輕量級、最先進嘅開放模型系列,採用同 Gemini 模型相同嘅研究同技術構建。呢啲模型係只解碼器大型語言模型,支援英文,提供預訓練同指令微調兩種變體嘅開放權重。Gemma 模型適用於各種文本生成任務,包括問答、摘要同推理。

google/gemma-2-9b-it

8k

-

唔支援

對話

Google_gamma

Gemma 係 Google 開發嘅輕量級、最先進嘅開放模型系列之一。佢係一個只解碼器大型語言模型,支援英文,提供開放權重、預訓練變體同指令微調變體。Gemma 模型適用於各種文本生成任務,包括問答、摘要同推理。呢個 9B 模型係用 8 萬億個 tokens 訓練而成。

gemini-1.5-pro

2m

8k

唔支援

對話

Google_gemini

Gemini 1.5 Pro 嘅最新穩定版本。作為一個強大嘅多模態模型,佢可以處理長達 6 萬行代碼或 2,000 頁文本。特別適合需要複雜推理嘅任務。

gemini-1.0-pro-001

33k

8k

唔支援

對話

Google_gemini

呢個係 Gemini 1.0 Pro 嘅穩定版本。作為一個 NLP 模型,佢專門處理多輪文本同代碼聊天以及代碼生成等任務。呢個模型將於 2025 年 2 月 15 日停用,建議遷移到 1.5 系列模型。

gemini-1.0-pro-002

32k

8k

唔支援

對話

Google_gemini

呢個係 Gemini 1.0 Pro 嘅穩定版本。作為一個 NLP 模型,佢專門處理多輪文本同代碼聊天以及代碼生成等任務。呢個模型將於 2025 年 2 月 15 日停用,建議遷移到 1.5 系列模型。

gemini-1.0-pro-latest

33k

8k

唔支援

對話,已棄用或即將棄用

Google_gemini

呢個係 Gemini 1.0 Pro 嘅最新版本。作為一個 NLP 模型,佢專門處理多輪文本同代碼聊天以及代碼生成等任務。呢個模型將於 2025 年 2 月 15 日停用,建議遷移到 1.5 系列模型。

gemini-1.0-pro-vision-001

16k

2k

唔支援

對話

Google_gemini

呢個係 Gemini 1.0 Pro 嘅視覺版本。呢個模型將於 2025 年 2 月 15 日停用,建議遷移到 1.5 系列模型。

gemini-1.0-pro-vision-latest

16k

2k

唔支援

識圖

Google_gemini

呢個係 Gemini 1.0 Pro 嘅視覺最新版本。呢個模型將於 2025 年 2 月 15 日停用,建議遷移到 1.5 系列模型。

gemini-1.5-flash

1m

8k

唔支援

對話,識圖

Google_gemini

呢個係 Gemini 1.5 Flash 嘅最新穩定版本。作為一個平衡嘅多模態模型,佢可以處理音頻、圖片、視頻同文本輸入。

gemini-1.5-flash-001

1m

8k

唔支援

對話,識圖

Google_gemini

呢個係 Gemini 1.5 Flash 嘅穩定版本。佢哋提供同 gemini-1.5-flash 相同嘅基本功能,但版本固定,適合生產環境使用。

gemini-1.5-flash-002

1m

8k

唔支援

對話,識圖

Google_gemini

呢個係 Gemini 1.5 Flash 嘅穩定版本。佢哋提供同 gemini-1.5-flash 相同嘅基本功能,但版本固定,適合生產環境使用。

gemini-1.5-flash-8b

1m

8k

唔支援

對話,識圖

Google_gemini

Gemini 1.5 Flash-8B 係谷歌最新推出嘅一款多模態人工智能模型,專為高效處理大規模任務而設計。呢個模型有 80 億個參數,能夠支援文本、圖像、音頻同視頻輸入,適用於多種應用場景,例如聊天、轉錄同翻譯等。相較其他 Gemini 模型,Flash-8B 喺速度同成本效益上都做咗優化,特別適合對成本敏感嘅用戶。佢嘅速率限制提升咗一倍,使開發者能夠更高效咁進行大規模任務處理。此外,Flash-8B 仲採用咗「知識蒸餾」技術,從更大嘅模型中提煉出關鍵知識,確保喺保持核心能力嘅同時做到輕量化同高效化

gemini-1.5-flash-exp-0827

1m

8k

唔支援

對話,識圖

Google_gemini

呢個係 Gemini 1.5 Flash 嘅實驗版本,會定期更新以包含最新改進。適合探索性測試同原型開發,不建議用於生產環境。

gemini-1.5-flash-latest

1m

8k

唔支援

對話,識圖

Google_gemini

呢個係 Gemini 1.5 Flash 嘅尖端版本,會定期更新以包含最新改進。適合探索性測試同原型開發,不建議用於生產環境。

gemini-1.5-pro-001

2m

8k

唔支援

對話,識圖

Google_gemini

呢個係 Gemini 1.5 Pro 嘅穩定版本,提供固定嘅模型行為同性能特徵。適合需要穩定性嘅生產環境使用。

gemini-1.5-pro-002

2m

8k

唔支援

對話,識圖

Google_gemini

呢個係 Gemini 1.5 Pro 嘅穩定版本,提供固定嘅模型行為同性能特徵。適合需要穩定性嘅生產環境使用。

gemini-1.5-pro-exp-0801

2m

8k

唔支援

對話,識圖

Google_gemini

Gemini 1.5 Pro 嘅試驗版本。作為一個強大嘅多模態模型,佢可以處理長達 6 萬行代碼或 2,000 頁文本。特別適合需要複雜推理嘅任務。

gemini-1.5-pro-exp-0827

2m

8k

唔支援

對話,識圖

Google_gemini

Gemini 1.5 Pro 嘅試驗版本。作為一個強大嘅多模態模型,佢可以處理長達 6 萬行代碼或 2,000 頁文本。特別適合需要複雜推理嘅任務。

gemini-1.5-pro-latest

2m

8k

唔支援

對話,識圖

Google_gemini

呢個係 Gemini 1.5 Pro 嘅最新版本,動態指向最新嘅快照版本

gemini-2.0-flash

1m

8k

唔支援

對話,識圖

Google_gemini

Gemini 2.0 Flash 係谷歌最新推出嘅模型,相比 1.5 版本有更快嘅首次生成速度(TTFT),同時保持咗同 Gemini Pro 1.5 相若嘅質量水平;呢個模型喺多模態理解、代碼能力、複雜指令執行同函數調用等方面都有明顯提升,從而可以提供更流暢同更強大嘅智能體驗。

gemini-2.0-flash-exp

100k

8k

支援

對話,識圖

Google_gemini

Gemini 2.0 Flash 引入多模態實時 API、改進速度同性能、提升質量、增強代理能力,並增加圖像生成同語音轉換功能。

gemini-2.0-flash-lite-preview-02-05

1M

8k

唔支援

對話,識圖

Google_gemini

Gemini 2.0 Flash-Lite 係谷歌最新發佈嘅高性價比 AI 模型,喺保持同 1.5 Flash 相同速度嘅同時質量更好;支援 100 萬 tokens 嘅上下文窗口,能夠處理圖像、音頻同代碼等多模態任務;作為目前谷歌成本效益最高嘅模型,採用簡化嘅單一定價策略,特別適合需要控制成本嘅大規模應用場景。

gemini-2.0-flash-thinking-exp

40k

8k

唔支援

對話,推理

Google_gemini

gemini-2.0-flash-thinking-exp 係一個實驗模型,佢可以生成喺作出回應時所經歷嘅「思考過程」。因此,相比基本嘅 Gemini 2.0 Flash 模型,「思考模式」嘅回應具有更強嘅推理能力。

gemini-2.0-flash-thinking-exp-01-21

1m

64k

唔支援

對話,推理

Google_gemini

Gemini 2.0 Flash Thinking EXP-01-21 係谷歌最新推出嘅人工智能模型,專注於提升推理能力同用戶互動體驗。呢個模型具備強大嘅推理能力,尤其喺數學同編程領域表現突出,並支援高達 100 萬 token 嘅上下文窗口,適用於複雜任務同深入分析場景。其獨特之處在於能夠生成思考過程,提高 AI 思維嘅可理解性,同時支援原生代碼執行,增強互動嘅靈活性同實用性。透過優化算法,模型減少咗邏輯矛盾,進一步提升咗回答嘅準確性同一致性。

gemini-2.0-flash-thinking-exp-1219

40k

8k

唔支援

對話,推理,識圖

Google_gemini

gemini-2.0-flash-thinking-exp-1219 係一個實驗模型,佢可以生成喺作出回應時所經歷嘅「思考過程」。因此,相比基本嘅 Gemini 2.0 Flash 模型,「思考模式」嘅回應具有更強嘅推理能力。

gemini-2.0-pro-exp-01-28

2m

64k

唔支援

對話,識圖

Google_gemini

預載模型,仲未上線

gemini-2.0-pro-exp-02-05

2m

8k

唔支援

對話,識圖

Google_gemini

Gemini 2.0 Pro Exp 02-05 係谷歌 2024 年 2 月發佈嘅最新實驗性模型,喺世界知識、代碼生成同長文本理解方面表現突出;呢個模型支援 200 萬 tokens 嘅超長上下文窗口,能處理 2 小時視頻、22 小時音頻、6 萬多行代碼同 140 萬多單詞嘅內容;作為 Gemini 2.0 系列嘅一部分,呢個模型採用咗新嘅 Flash Thinking 訓練策略,性能得到明顯提升,喺多個 LLM 評分榜單中名列前茅,展現出強大嘅綜合能力。

gemini-exp-1114

8k

4k

唔支援

對話,識圖

Google_gemini

呢個係一個實驗性模型,於 2024 年 11 月 14 日發佈,主要聚焦質量改進。

gemini-exp-1121

8k

4k

唔支援

對話,識圖,代碼

Google_gemini

呢個係一個實驗性模型,於 2024 年 11 月 21 日發佈,改進咗編碼、推理同視覺能力。

gemini-exp-1206

8k

4k

唔支援

對話,識圖

Google_gemini

呢個係一個實驗性模型,於 2024 年 12 月 6 日發佈,改進咗編碼、推理同視覺能力。

gemini-exp-latest

8k

4k

唔支援

對話,識圖

Google_gemini

呢個係一個實驗性模型,動態指向最新版本

gemini-pro

33k

8k

唔支援

對話

Google_gemini

同 gemini-1.0-pro 一樣,係 gemini-1.0-pro 嘅別名

gemini-pro-vision

16k

2k

唔支援

對話,識圖

Google_gemini

呢個係 Gemini 1.0 Pro 嘅視覺版本。呢個模型將於 2025 年 2 月 15 日停用,建議遷移到 1.5 系列模型。

grok-2

128k

-

唔支援

對話

Grok_grok

X.ai 於 2024.12.12 發佈嘅新版本 grok 模型。

grok-2-1212

128k

-

唔支援

對話

Grok_grok

X.ai 於 2024.12.12 發佈嘅新版本 grok 模型。

grok-2-latest

128k

-

唔支援

對話

Grok_grok

X.ai 於 2024.12.12 發佈嘅新版本 grok 模型。

grok-2-vision-1212

32k

-

唔支援

對話,識圖

Grok_grok

X.ai 於 2024.12.12 發佈嘅 grok 視覺版本模型。

grok-beta

100k

-

唔支援

對話

Grok_grok

性能同 Grok 2 相當,但效率、速度同功能都有提升。

grok-vision-beta

8k

-

唔支援

對話,識圖

Grok_grok

最新嘅圖像理解模型可以處理各種視覺資訊,包括文件、圖表、截圖同相片。

internlm/internlm2_5-20b-chat

32k

-

支援

對話

internlm

InternLM2.5-20B-Chat 係一個開源嘅大規模對話模型,基於 InternLM2 架構開發。呢個模型有 200 億參數,喺數學推理方面表現出色,超越咗同量級嘅 Llama3 同 Gemma2-27B 模型。InternLM2.5-20B-Chat 喺工具調用能力方面有明顯提升,支援從上百個網頁收集資訊進行分析推理,並具備更強嘅指令理解、工具選擇同結果反思能力。

meta-llama/Llama-3.2-11B-Vision-Instruct

8k

-

唔支援

對話,識圖

Meta_llama

目前 Llama 系列模型唔單止可以處理文本數據,亦都可以處理圖像數據;Llama3.2 嘅部分模型加入咗視覺理解功能,呢個模型支援同時輸入文本同圖像數據,對圖像進行理解並輸出文本資訊。

meta-llama/Llama-3.2-3B-Instruct

32k

-

唔支援

對話

Meta_llama

Meta Llama 3.2 多語言大語言模型(LLM),其中 1B、3B 係可以喺邊緣同移動設備上運行嘅輕量級模型,呢個模型係 3B 版本。

meta-llama/Llama-3.2-90B-Vision-Instruct

8k

-

唔支援

對話,識圖

Meta_llama

目前 Llama 系列模型唔單止可以處理文本數據,亦都可以處理圖像數據;Llama3.2 嘅部分模型加入咗視覺理解功能,呢個模型支援同時輸入文本同圖像數據,對圖像進行理解並輸出文本資訊。

meta-llama/Llama-3.3-70B-Instruct

131k

-

唔支援

對話

Meta_llama

Meta 最新款 70B LLM,性能同 llama 3.1 405B 相當。

meta-llama/Meta-Llama-3.1-405B-Instruct

32k

-

唔支援

對話

Meta_llama

Meta Llama 3.1 多語言大語言模型(LLM)集合係 8B、70B 同 405B 尺寸嘅預訓練同指令微調生成模型集合,呢個模型係 405B 版本。Llama 3.1 指令微調文本模型(8B、70B、405B)針對多語言對話進行咗優化,喺常見行業基準上優於好多可用嘅開源同閉源聊天模型。

meta-llama/Meta-Llama-3.1-70B-Instruct

32k

-

唔支援

對話

Meta_llama

Meta Llama 3.1 係由 Meta 開發嘅多語言大型語言模型家族,包括 8B、70B 同 405B 三種參數規模嘅預訓練同指令微調變體。呢個 70B 指令微調模型針對多語言對話場景進行咗優化,喺多項行業基準測試中表現優異。模型訓練使用咗超過 15 萬億個 tokens 嘅公開數據,並採用咗監督微調同人類反饋強化學習等技術嚟提升模型嘅有用性同安全性。

meta-llama/Meta-Llama-3.1-8B-Instruct

32k

-

唔支援

對話

Meta_llama

Meta Llama 3.1 多語言大語言模型(LLM)集合係 8B、70B 同 405B 尺寸嘅預訓練同指令微調生成模型集合,呢個模型係 8B 版本。Llama 3.1 指令微調文本模型(8B、70B、405B)針對多語言對話進行咗優化,喺常見行業基準上優於好多可用嘅開源同閉源聊天模型。

abab5.5-chat

16k

-

支援

對話

Minimax_abab

中文人設對話場景

abab5.5s-chat

8k

-

支援

對話

Minimax_abab

中文人設對話場景

abab6.5g-chat

8k

-

支援

對話

Minimax_abab

英文等多語種人設對話場景

abab6.5s-chat

245k

-

支援

對話

Minimax_abab

通用場景

abab6.5t-chat

8k

-

支援

對話

Minimax_abab

中文人設對話場景

chatgpt-4o-latest

128k

16k

唔支援

對話,識圖

OpenAI

chatgpt-4o-latest 模型版本持續指向 ChatGPT 中使用嘅 GPT-4o 版本,並喺有重大變化時最快更新。

gpt-4o-2024-11-20

128k

16k

支援

對話

OpenAI

2024 年 11 月 20 日嘅最新 gpt-4o 快照版本。

gpt-4o-audio-preview

128k

16k

唔支援

對話

OpenAI

OpenAI 嘅即時語音對話模型

gpt-4o-audio-preview-2024-10-01

128k

16k

支援

對話

OpenAI

OpenAI 嘅即時語音對話模型

o1

128k

32k

唔支援

對話,推理,識圖

OpenAI

OpenAI 針對複雜任務嘅新推理模型,該任務需要廣泛嘅常識。呢個模型有 200k 上下文,目前係全球最強模型,支援圖片識別

o1-mini-2024-09-12

128k

64k

唔支援

對話,推理

OpenAI

o1-mini 嘅固定快照版本,比 o1-preview 更細、更快,成本低 80%,喺代碼生成同小上下文操作方面表現良好。

o1-preview-2024-09-12

128k

32k

唔支援

對話,推理

OpenAI

o1-preview 嘅固定快照版本

gpt-3.5-turbo

16k

4k

支援

對話

OpenAI_gpt-3

基於 GPT-3.5: GPT-3.5 Turbo 係建立喺 GPT-3.5 模型基礎上嘅改良版本,由 OpenAI 開發。\n性能目標: 設計目的係透過優化模型結構同算法,提高模型嘅推理速度、處理效率同資源利用率。\n提升嘅推理速度: 相對於 GPT-3.5,GPT-3.5 Turbo 喺相同硬件條件下一般能夠提供更快嘅推理速度,對需要大規模文本處理嘅應用特別有幫助。\n更高嘅吞吐量: 喺處理大量請求或數據時,GPT-3.5 Turbo 可以實現更高嘅並發處理能力,從而提升整體系統吞吐量。\n優化嘅資源消耗: 喺保持性能嘅同時,可能降低咗對硬件資源(如記憶體同運算資源)嘅需求,有助於降低運行成本同提高系統可擴展性。\n廣泛嘅自然語言處理任務: GPT-3.5 Turbo 適用於多種自然語言處理任務,包括但不限於文本生成、語義理解、對話系統、機器翻譯等。\n開發者工具同 API 支援: 提供咗方便開發者整合同使用嘅 API 介面,支援快速開發同部署應用程式。

gpt-3.5-turbo-0125

16k

4k

支援

對話

OpenAI_gpt-3

更新後嘅 GPT 3.5 Turbo,對請求格式嘅準確性更高,並修復咗一個導致非英文語言函數調用文本編碼問題嘅錯誤。返回最多 4,096 個輸出令牌。

gpt-3.5-turbo-0613

16k

4k

支援

對話

OpenAI_gpt-3

更新後嘅 GPT 3.5 Turbo 固定快照版本。目前已棄用

gpt-3.5-turbo-1106

16k

4k

支援

對話

OpenAI_gpt-3

具有改進嘅指令跟隨、JSON 模式、可重現輸出、並行函數調用等。返回最多 4,096 個輸出令牌。

gpt-3.5-turbo-16k

16k

4k

支援

對話,已棄用或即將棄用

OpenAI_gpt-3

(已棄用)

gpt-3.5-turbo-16k-0613

16k

4k

支援

對話,已棄用或即將棄用

OpenAI_gpt-3

gpt-3.5-turbo 喺 2023 年 6 月 13 日嘅快照。(已棄用)

gpt-3.5-turbo-instruct

4k

4k

支援

對話

OpenAI_gpt-3

同 GPT-3 時代模型類似嘅能力。與遺留 Completions 端點兼容,不適用於 Chat Completions。

gpt-3.5o

16k

4k

唔支援

對話

OpenAI_gpt-3

同 gpt-4o-lite

gpt-4

8k

8k

支援

對話

OpenAI_gpt-4

目前指向 gpt-4-0613。

gpt-4-0125-preview

128k

4k

支援

對話

OpenAI_gpt-4

最新嘅 GPT-4 模型,旨在減少「懶惰」情況,即模型未完成任務。返回最多 4,096 個輸出令牌。

gpt-4-0314

8k

8k

支援

對話

OpenAI_gpt-4

gpt-4 2023 年 3 月 14 日嘅快照

gpt-4-0613

8k

8k

支援

對話

OpenAI_gpt-4

gpt-4 2023 年 6 月 13 日嘅快照,增強咗函數調用支援。

gpt-4-1106-preview

128k

4k

支援

對話

OpenAI_gpt-4

GPT-4 Turbo 模型,具有改進嘅指令跟隨、JSON 模式、可再現輸出、函數調用等。返回最多 4,096 個輸出令牌。呢個係預覽模型。

gpt-4-32k

32k

4k

支援

對話

OpenAI_gpt-4

gpt-4-32k 將於 2025-06-06 棄用。

gpt-4-32k-0613

32k

4k

支援

對話,已棄用或即將棄用

OpenAI_gpt-4

將於 2025-06-06 棄用。

gpt-4-turbo

128k

4k

支援

對話

OpenAI_gpt-4

最新版嘅 GPT-4 Turbo 模型新增咗視覺功能,支援透過 JSON 模式同函數調用嚟處理視覺請求。呢個模型當前版本係 gpt-4-turbo-2024-04-09。

gpt-4-turbo-2024-04-09

128k

4k

支援

對話

OpenAI_gpt-4

帶視覺功能嘅 GPT-4 Turbo 模型。而家,視覺請求能夠透過 JSON 模式同函數調用嚟實現。gpt-4-turbo 目前版本就係呢一版。

gpt-4-turbo-preview

128k

4k

支援

對話,識圖

OpenAI_gpt-4

目前指向 gpt-4-0125-preview。

gpt-4o

128k

16k

支援

對話,識圖

OpenAI_gpt-4

OpenAI 嘅高智能旗艦模型,適用於複雜嘅多步驟任務。GPT-4o 比 GPT-4 Turbo 更平宜、更快。

2024 年 5 月 13 日嘅原始 gpt-4o 快照。

128k

4k

支援

對話,識圖

OpenAI_gpt-4

gpt-4o-2024-05-13

gpt-4o-2024-08-06

128k

16k

支援

對話,識圖

OpenAI_gpt-4

支援結構化輸出嘅第一個快照。gpt-4o 目前指向呢個版本。

gpt-4o-mini

128k

16k

支援

對話,識圖

OpenAI_gpt-4

OpenAI 經濟實惠嘅 gpt-4o 版本,適用於快速、輕量級任務。GPT-4o mini 比 GPT-3.5 Turbo 更平宜,功能更強大。目前指向 gpt-4o-mini-2024-07-18。