For the complete documentation index, see llms.txt. This page is also available as Markdown.

文生圖榜單

本頁展示 Arena AI 榜單前 30 名嘅每日快照,方便快速了解近期模型表現。完整榜單、篩選項同最新變化請到 Arena AI 官網睇。

本榜單評測文生圖模型根據文本提示生成圖像嘅能力。

數據更新時間: 2026-09-01 13:25:31 UTC / 2026-09-01 21:25:31 CST(北京時間)

排行榜反映特定評測同用戶投票偏好,唔等同於模型喺你嘅任務入面一定更好。揀模型時仲要考慮價格、速度、上下文、工具調用、私隱同地區可用性。

前 30 名

排名
排名區間
模型
分數
票數

1

1-1

gpt-image-2 (medium) 1

1382(±4)

75,014

2

2-3

mai-image-2.6-preview 1

1331(±8)

6,418

3

2-4

grok-imagine-image-2.0 (low) 1

1316(±12)初步

2,675

4

3-4

reve-2.1 1

1302(±8)

7,580

5

5-6

muse-image 1

1281(±6)

22,691

6

5-7

reve-2.0 1

1270(±6)

14,631

7

6-10

gemini-3.1-flash-image (nano-banana-2) [web-search] 1

1263(±5)

36,392

8

7-11

seedream-5.0-pro 1

1258(±5)

48,174

9

7-12

qwen-image-3.0-pro 1

1255(±7)

10,927

10

7-11

mai-image-2.5 1

1254(±4)

56,737

11

8-12

gemini-3.1-flash-lite-image (nano-banana-2-lite) 1

1251(±6)

16,381

12

10-13

gemini-3-pro-image-2k (nano-banana-pro) 1

1245(±3)

146,806

13

12-14

gpt-image-1.5-high-fidelity 1

1239(±3)

148,079

14

13-14

gemini-3-pro-image-preview (nano-banana-pro) 1

1232(±5)

82,738

15

15-15

ideogram-4.0-quality 1

1204(±5)

36,647

16

16-19

qwen-image-2.0-pro-2026-06-22 1

1191(±6)

12,013

17

16-19

uni-1.1-max 1

1188(±6)

13,468

18

16-21

uni-1.1 1

1183(±5)

32,214

19

16-21

mai-image-2 1

1183(±5)

49,180

20

18-25

Cosmos3-Super-Text2Image (Agentic) 1

1172(±9)

4,598

21

20-22

grok-imagine-image 1

1171(±3)

229,148

22

18-27

recraft-v4.1-utility-pro 1

1169(±11)

2,519

23

21-26

flux-2-max 1

1162(±4)

117,324

24

21-28

grok-imagine-image-pro 1

1161(±4)

93,631

25

22-29

flux-2-flex 1

1157(±3)

149,295

26

21-33

Cosmos3-Super-Text2Image 1

1156(±7)

7,625

27

24-31

flux-2-pro 1

1155(±3)

183,024

28

23-32

reve-v1.5 1

1154(±4)

36,762

29

25-33

hunyuan-image-3.0 1

1151(±3)

173,101

30

26-33

gemini-2.5-flash-image-preview (nano-banana) 1

1150(±2)

836,062

點樣睇呢張表

  • 排名 / 排名區間:Arena AI 根據文生圖對戰投票估算嘅相對名次;排名區間表示喺置信範圍內嘅名次波動。

  • 分數:相對評分,適合同一時間榜單入面嘅模型比較。

  • 票數:樣本量參考;樣本較少時,排名通常更容易波動。

揀模型時再確認三樣嘢

  1. Provider 係咪真係有提供呢個模型,同埋你嘅地區同帳戶係咪可用;

  2. API 價格、速率限制同上下文係咪適合你嘅任務;

  3. 用 3~5 個真實任務做小規模測試,唔好淨係睇總榜名次。

數據來源

數據來自 Arena AI 官方 文生圖榜單,由 GitHub Actions 每日更新。模型價格、許可證同能力請以模型服務商官方資訊為準。

最後更新

呢個有冇幫助?