For the complete documentation index, see llms.txt. This page is also available as Markdown.

視覺榜單

本頁展示 Arena AI 榜單前 30 名嘅每日快照,方便快速了解近期模型表現。完整榜單、篩選項同最新變化請到 Arena AI 官網睇。

本榜單評測多模態模型喺圖像理解類任務上嘅表現。

數據更新時間: 2026-09-01 13:25:31 UTC / 2026-09-01 21:25:31 CST(北京時間)

排行榜反映特定評測同用戶投票偏好,唔等同於模型喺你嘅任務入面一定更好。揀模型時仲要考慮價格、速度、上下文、工具調用、私隱同地區可用性。

前 30 名

排名
排名區間
模型
分數
票數
價格 $/百萬 Token
上下文

1

1-6

claude-fable-5 1

1313 (±8)

10,002

$10 / $50

1M

2

1-11

claude-opus-4-7-high 1

1301 (±7)

21,137

$5 / $25

1M

3

1-15

qwen3.8-max 1

1300 (±8)

7,244

$2 / $6

1M

4

1-14

claude-opus-4-7 1

1299 (±7)

21,457

$5 / $25

1M

5

1-14

claude-opus-4-6-high 1

1299 (±7)

20,883

$5 / $25

1M

6

2-25

muse-spark 1

1294 (±9)

5,585

N/A

N/A

7

2-24

claude-opus-4-6 1

1293 (±7)

25,210

$5 / $25

1M

8

1-29

muse-spark-1.2 (xHigh) 1

1292 (±15)

1,844

$1.25 / $4.25

N/A

9

2-26

claude-opus-5-high 1

1290 (±8)

8,271

$5 / $25

1M

10

2-27

gemini-3-pro 1

1289 (±8)

13,019

$2 / $12

1M

11

3-27

gpt-5.5 1

1286 (±7)

21,389

$5 / $30

1.1M

12

3-28

claude-opus-4-8-high 1

1285 (±7)

13,521

$5 / $25

1M

13

2-31

gemini-3.6-flash-high 1

1285 (±11)

3,816

$0.75 / $3.75

1M

14

3-29

gemini-3.5-flash-high 1

1284 (±8)

8,259

$0.75 / $4.50

1M

15

6-29

gpt-5.5-high 1

1284 (±7)

20,121

$5 / $30

1.1M

16

6-31

gemini-3.5-flash-medium 1

1283 (±8)

8,261

$0.75 / $4.50

1M

17

5-32

gpt-5.6-sol-xhigh 1

1282 (±9)

5,837

$4 / $20

N/A

18

6-32

grok-4.5 1

1282 (±9)

6,401

$2 / $6

500K

19

6-31

gpt-5.4-high 1

1281 (±7)

23,263

$1.25 / $7.50

1.1M

20

6-32

gpt-5.4 1

1281 (±7)

21,245

$1.25 / $7.50

1.1M

21

6-32

claude-opus-4-8 1

1279 (±7)

13,980

$5 / $25

1M

22

6-32

muse-spark-1.1 1

1279 (±9)

6,769

$1.25 / $4.25

1M

23

7-32

gpt-5.2-chat-latest-20260210 1

1279 (±7)

15,446

$1.75 / $14

128K

24

8-32

gemini-3.1-pro-preview 1

1278 (±6)

39,412

$1 / $6

1M

25

6-33

gpt-5.5-instant 1

1278 (±9)

7,225

$5 / $30

1.1M

26

9-33

claude-sonnet-4-6 1

1275 (±6)

25,610

$1.50 / $7.50

1M

27

6-42

glm-5.3-flash 1

1273 (±17)

1,389

$0.15 / $0.50

1M

28

11-34

gemini-3-flash 1

1272 (±5)

36,747

$0.50 / $3

1M

29

15-39

claude-sonnet-5-high 1

1267 (±8)

8,522

$2 / $10

1M

30

12-42

gemini-3.5-flash-lite 1

1266 (±11)

3,886

$0.15 / $1.25

1M

點樣睇呢張表

  • 排名 / 排名區間:Arena AI 根據對戰投票估算嘅相對名次;排名區間表示喺置信範圍內嘅名次波動。

  • 分數:相對評分,適合同一時間榜單入面嘅模型比較。

  • 票數 / 會話數:樣本量參考;樣本較少時,排名通常更容易波動。

  • 價格 $/百萬 Token:輸入 / 輸出每百萬 Token 嘅參考價格。

  • 上下文:模型支援嘅最大上下文長度。

揀模型時再確認三樣嘢

  1. Provider 係咪真係有提供呢個模型,同埋你嘅地區同帳戶係咪可用;

  2. API 價格、速率限制同上下文係咪適合你嘅任務;

  3. 用 3~5 個真實任務做小規模測試,唔好淨係睇總榜名次。

數據來源

數據來自 Arena AI 官方 視覺榜單,由 GitHub Actions 每日更新。模型價格、許可證同能力請以模型服務商官方資訊為準。

最後更新

呢個有冇幫助?