For the complete documentation index, see llms.txt. This page is also available as Markdown.

コード / Web開発ランキング

本ページに表示 Arena AI ランキング上位30位の毎日のスナップショットで、最近のモデルの性能を素早く把握できます。完全版ランキング、フィルター項目、最新の変更は Arena AI 公式サイトでご確認ください。

このランキングは、モデルの Web フロントエンド開発(HTML/CSS/JS)タスクでの実際の性能を評価しています。

データ更新日時: 2026-09-01 13:25:31 UTC / 2026-09-01 21:25:31 CST(北京時間)

ランキングは特定の評価とユーザー投票の傾向を反映したものであり、あなたのタスクで必ずしもそのモデルが優れていることを意味するものではありません。モデルを選ぶ際は、価格、速度、コンテキスト、ツール呼び出し、プライバシー、地域での利用可否も考慮してください。

上位30位

順位
順位レンジ
モデル
スコア
投票数
価格 $/100万トークン
コンテキスト

1

1-3

claude-opus-5-max 1

1688 (++8/-8)

10,098

$5/$25

1M

2

1-4

kimi-k3-max 1

1674 (++11/-11)

4,546

$3/$15

1M

3

1-4

qwen3.8-max 1

1669 (++12/-12) 暫定

3,219

$2/$6

1M

4

2-4

claude-opus-5-high 1

1661 (++8/-8)

10,164

$5/$25

1M

5

5-11

hy4-preview 1

1631 (++18/-18) 暫定

1,276

$0.83/$2.50

1M

6

5-11

grok-4.6-high 1

1629 (++17/-17) 暫定

1,532

$2/$6

500K

7

5-11

claude-fable-5 1

1628 (++8/-8)

9,001

$10/$50

1M

8

5-12

qwen3.8-flash-next 1

1622 (++16/-16) 暫定

1,778

$0.16/$0.47

1M

9

5-12

gpt-5.6-sol-xhigh (codex-harness) 1

1616 (++7/-7)

10,570

$4/$20

1.1M

10

5-13

glm-5.3-max 1

1608 (++13/-13)

2,560

$1.40/$4.40

1M

11

5-16

glm-5.3-flash 1

1606 (++16/-16)

1,593

$0.15/$0.50

1M

12

8-16

qwen3.8-27b 1

1598 (++12/-12)

3,163

$0.40/$3

該当なし

13

10-16

gemini-3.7-flash-high 1

1587 (++12/-12) 暫定

3,009

$0.75/$3.57

1M

14

11-16

glm-5.2-max 1

1585 (++8/-8)

9,494

$1.40/$4.40

1M

15

11-16

deepseek-v4-pro-high-20260813 1

1583 (++11/-11)

3,212

$1.32/$3.96

該当なし

16

11-17

deepseek-v4-flash-high 1

1580 (++11/-11)

3,852

$0.44/$1.32

1M

17

16-20

claude-opus-4-8-high 1

1563 (++7/-7)

12,537

$5/$25

1M

18

17-21

claude-opus-4-7 1

1557 (++6/-6)

15,374

$5/$25

1M

19

17-21

claude-opus-4-7-high 1

1557 (++6/-6)

15,867

$5/$25

1M

20

17-23

grok-4.5 1

1556 (++8/-8)

7,058

$2/$6

500K

21

18-27

claude-opus-4-6-high 1

1546 (++6/-6)

17,849

$5/$25

1M

22

21-27

claude-opus-4-8 1

1540 (++7/-7)

11,495

$5/$25

1M

23

20-27

muse-spark-1.1 1

1540 (++8/-8)

7,018

$1.25/$4.25

該当なし

24

21-27

gemini-3.6-flash-high 1

1538 (++8/-8)

7,592

$0.75/$3.75

1M

25

21-28

claude-sonnet-5-high 1

1537 (++8/-8)

8,032

$2/$10

1M

26

21-27

claude-opus-4-6 1

1536 (++6/-6)

19,016

$5/$25

1M

27

20-33

muse-spark-1.2 (xHigh) 1

1534 (++14/-14)

2,069

$1.25/$4.25

該当なし

28

26-36

seed-2.1-pro-preview 1

1522 (++8/-8)

8,331

該当なし

該当なし

29

27-33

claude-sonnet-4-6 1

1522 (++5/-5)

21,115

$1.50/$7.50

1M

30

27-36

gpt-5.6-terra-xhigh (codex-harness) 1

1519 (++8/-8)

6,470

$2/$12

1M

この表の見方

  • 順位 / 順位レンジ:Arena AI が対戦投票に基づいて推定した相対順位。順位レンジは、信頼区間内での順位の変動を示します。

  • スコア:相対スコア。同時点のランキング内にあるモデル同士の比較に適しています。

  • 投票数 / セッション数:サンプル数の目安。サンプルが少ないほど、順位は通常変動しやすくなります。

  • 価格 $/100万トークン:入力 / 出力 100万トークンあたりの参考価格。

  • コンテキスト:モデルが対応する最大コンテキスト長。

モデルを選ぶときに再確認すべき3点

  1. 提供元が実際にこのモデルを提供しているか、またあなたの地域とアカウントで利用可能か;

  2. API 価格、レート制限、コンテキストがあなたのタスクに適しているか;

  3. 3〜5件の実際のタスクで小規模テストを行い、総合ランキングの順位だけを見ないこと。

データソース

データは Arena AI 公式 コード / Web 開発ランキング、GitHub Actions により毎日更新されています。モデルの価格、ライセンス、機能は、モデル提供元の公式情報を基準にしてください。

最終更新

役に立ちましたか?