For the complete documentation index, see llms.txt. This page is also available as Markdown.

テキストランキング

このページでは Arena AI 上位30位の毎日スナップショットで、最近のモデル性能を素早く把握できます。完全版ランキング、フィルター項目、最新の変化は Arena AI 公式サイトでご確認ください。

このランキングは Arena AI の中核となるテキスト対戦ランキングで、人間のブラインド投票対戦に基づいてモデルの相対的な実力を推定します。

データ更新時刻: 2026-09-01 13:25:31 UTC / 2026-09-01 21:25:31 CST (北京時間)

ランキングは特定の評価やユーザー投票の好みを反映するもので、あなたのタスクでそのモデルが必ずしも優れているとは限りません。モデルを選ぶ際は、価格、速度、コンテキスト、ツール呼び出し、プライバシー、地域での利用可否も考慮してください。

上位30位

順位
順位範囲
モデル
スコア
票数
価格 $/百万Token
コンテキスト

1

1-4

claude-fable-5 1

1507 (±5)

25,824

$10 / $50

1M

2

1-4

claude-opus-4-6-high 1

1505 (±4)

72,104

$5 / $25

1M

3

1-5

claude-opus-4-7-high 1

1502 (±4)

60,136

$5 / $25

1M

4

1-15

muse-spark-1.2 (xHigh) 1

1498 (±10)

3,247

$1.25 / $4.25

N/A

5

3-11

claude-opus-4-6 1

1497 (±3)

76,079

$5 / $25

1M

6

4-13

claude-opus-4-7 1

1494 (±4)

61,282

$5 / $25

1M

7

4-16

claude-opus-5-high 1

1492 (±5)

31,570

$5 / $25

1M

8

4-20

muse-spark-1.1 1

1490 (±5)

22,215

$1.25 / $4.25

N/A

9

4-22

gemini-3.7-flash-high 1

1490 (±8) 暫定

5,720

$0.75 / $3.57

1M

10

4-22

kimi-k3-max 1

1489 (±6)

16,586

N/A

N/A

11

4-22

muse-spark 1

1488 (±6)

13,574

N/A

N/A

12

5-22

claude-opus-5-max 1

1488 (±6)

15,398

$5 / $25

1M

13

6-21

gemini-3.1-pro-preview 1

1487 (±3)

101,163

$1 / $6

1M

14

6-22

gemini-3-pro 1

1486 (±4)

40,674

$2 / $12

1M

15

5-34

glm-5.3-max 1

1484 (±8)

5,820

$1.40 / $4.40

1M

16

8-28

gpt-5.5-high 1

1482 (±4)

61,604

$5 / $30

1.1M

17

7-31

gpt-5.6-sol-xhigh 1

1482 (±5)

21,537

$4 / $20

N/A

18

8-31

claude-opus-4-8-high 1

1481 (±4)

46,773

$5 / $25

1M

19

8-35

gemini-3.6-flash-high 1

1481 (±5)

20,190

$0.75 / $3.75

1M

20

8-37

qwen3.8-max 1

1479 (±6)

11,780

$2 / $6

1M

21

10-36

gemini-3.5-flash-high 1

1479 (±4)

32,174

$0.75 / $4.50

1M

22

15-37

gpt-5.5 1

1477 (±4)

62,975

$5 / $30

1.1M

23

15-38

gpt-5.4-high 1

1477 (±4)

60,614

$2.50 / $15

1.1M

24

15-39

gpt-5.2-chat-latest-20260210 1

1476 (±4)

34,229

$1.75 / $14

128K

25

15-45

grok-4.20-beta1 1

1475 (±5)

26,645

N/A

N/A

26

16-46

gemini-3-flash 1

1474 (±4)

30,242

$0.50 / $3

1M

27

9-50

qwen3.7-max-preview 1

1474 (±10)

3,712

$1.48 / $4.42

1M

28

16-46

gemini-3.5-flash-medium 1

1473 (±5)

30,593

$0.75 / $4.50

1M

29

15-48

gpt-5.5-instant 1

1473 (±5)

25,857

$5 / $30

1.1M

30

18-46

claude-opus-4-5-20251101-high-32k 1

1473 (±4)

36,267

$5 / $25

200K

この表の見方

  • 順位 / 順位範囲:Arena AI が対戦投票から推定した相対順位。順位範囲は、信頼区間内での順位の変動を示します。

  • スコア:相対スコア。同時点のランキング内のモデル比較に適しています。

  • 票数 / セッション数:サンプル数の目安。サンプルが少ないほど、順位は変動しやすくなります。

  • 価格 $/百万Token:入力 / 出力 100万Tokenあたりの参考価格。

  • コンテキスト:モデルがサポートする最大コンテキスト長。

モデル選択時にあらためて確認する3点

  1. Provider が実際にこのモデルを提供しているか、またあなたの地域とアカウントで利用可能か;

  2. API料金、レート制限、コンテキストがタスクに適しているか;

  3. 3〜5個の実タスクで小規模テストを行い、総合順位だけを見ないこと。

データ出典

データは Arena AI 公式テキストランキングで、GitHub Actions により毎日更新されます。モデルの価格、ライセンス、能力はモデル提供元の公式情報を基準にしてください。

最終更新

役に立ちましたか?