For the complete documentation index, see llms.txt. This page is also available as Markdown.

検索ランキング

このページに表示 Arena AI ランキング上位30件の日次スナップショットで、最近のモデルの性能を素早く把握できます。完全版のランキング、フィルター項目、最新の変更は Arena AI 公式サイトをご覧ください。

このランキングは、ネット接続検索 / 情報検索系タスクにおけるモデルの性能を評価します。

データ更新時刻: 2026-09-01 13:25:31 UTC / 2026-09-01 21:25:31 CST (北京时间)

ランキングは特定の評価とユーザー投票の傾向を反映したもので、あなたのタスクでそのモデルが必ずしも優れていることを意味しません。モデルを選ぶ際は、価格、速度、コンテキスト、ツール呼び出し、プライバシー、地域での利用可否も考慮してください。

上位30件

順位
順位レンジ
モデル
スコア
票数
価格 $/百万トークン
コンテキスト

1

1-2

gpt-5.6-sol-xhigh 1

1257 (±7)

29,663

$4 / $20

1.1M

2

1-2

claude-opus-4-6-search 1

1253 (±5)

134,699

$5 / $25

1M

3

3-5

gpt-5.5-search 1

1242 (±5)

89,873

$5 / $30

1.1M

4

3-6

claude-opus-4-7 1

1233 (±5)

91,394

$5 / $25

1M

5

3-7

claude-fable-5 1

1230 (±8)

41,795

$10 / $50

1M

6

4-8

ernie-5.1 1

1227 (±10)

3,788

N/A

N/A

7

5-8

claude-sonnet-4-6-search 1

1221 (±5)

134,905

$1.50 / $7.50

1M

8

6-13

grok-4.5 1

1213 (±7)

31,505

$2 / $6

500K

9

8-13

gemini-3.1-pro-grounding 1

1210 (±5)

113,282

N/A

N/A

10

8-16

gemini-3-pro-grounding 1

1207 (±6)

37,024

$2 / $12

N/A

11

8-16

gpt-5.2-search 1

1207 (±6)

52,712

$0.88 / $7

400K

12

8-17

claude-opus-4-8 1

1204 (±6)

70,998

$5 / $25

1M

13

8-17

grok-4.20-multi-agent-beta-0309 1

1204 (±5)

109,553

$1.25 / $2.50

1M

14

10-18

gpt-5.1-search 1

1199 (±5)

59,909

$0.63 / $5

400K

15

10-18

gemini-3-flash-grounding 1

1198 (±5)

149,334

N/A

N/A

16

10-18

gpt-5.4-search 1

1197 (±5)

110,116

$2.50 / $15

1.1M

17

12-18

claude-sonnet-5-search 1

1194 (±7)

40,230

$2 / $10

1M

18

14-19

grok-4.20-beta1 1

1189 (±6)

53,921

N/A

N/A

19

18-22

claude-opus-4-5-search 1

1180 (±6)

61,573

$5 / $25

200K

20

19-23

gpt-5.2-search-non-reasoning 1

1172 (±6)

75,658

$0.88 / $7

400K

21

19-23

grok-4-1-fast-search 1

1171 (±5)

81,507

$1.25 / $2.50

2M

22

19-23

grok-4-fast-search 1

1171 (±5)

41,794

$0.20 / $0.50

2M

23

20-24

grok-4.3 1

1165 (±5)

91,483

$1.25 / $2.50

1M

24

23-24

claude-sonnet-4-5-search 1

1158 (±5)

127,378

$1.50 / $7.50

1M

25

25-29

claude-opus-4-1-search 1

1148 (±5)

76,933

$15 / $75

200K

26

25-29

o3-search 1

1144 (±5)

20,644

$1 / $4

200K

27

25-30

gemini-2.5-pro-grounding 1

1142 (±5)

83,404

$0.63 / $5

1M

28

25-31

grok-4-search 1

1142 (±6)

19,108

$3 / $15

N/A

29

25-31

ppl-sonar-reasoning-pro-high 1

1139 (±6)

29,055

$1 / $1

127.1K

30

27-32

gpt-5-search 1

1133 (±6)

20,781

$0.63 / $5

400K

この表の見方

  • 順位 / 順位レンジ:Arena AI が対戦投票に基づいて推定した相対順位です。順位レンジは、信頼区間内での順位の変動を示します。

  • スコア:相対スコアで、同時点のランキングにあるモデル同士の比較に適しています。

  • 票数 / セッション数:サンプル数の目安です。サンプルが少ないほど、順位は通常変動しやすくなります。

  • 価格 $/百万トークン:入力 / 出力 100万トークンあたりの参考価格です。

  • コンテキスト:モデルがサポートする最大コンテキスト長です。

モデル選択時にもう一度確認する3つのこと

  1. Provider が実際にこのモデルを提供しているか、またあなたの地域やアカウントで利用可能か;

  2. API価格、レート制限、コンテキストがあなたのタスクに適しているか;

  3. 3~5個の実際のタスクで小規模テストを行い、総合ランキングの順位だけを見ないこと。

データソース

データは Arena AI 公式 検索ランキング、GitHub Actions により毎日更新されています。モデル価格、ライセンス、機能はモデル提供元の公式情報を基準にしてください。

最終更新

役に立ちましたか?