LMArena コードモデルランキング(2026年9月)

2026年9月時点で、GPT-6 Astraが1,800で1位、claude-fable-5.1-max(1,758)とclaude-opus-5-max(1,687)が続きます。 121件の候補のうち上位20件。

2026年9月時点のデータ

#モデル提供元スコア投票数
1GPT-6 AstraOpenAI1,8002281
2claude-fable-5.1-maxAnthropic1,7583036
3claude-opus-5-maxAnthropic1,6871.2万
4qwen3.8-max-0902Alibaba1,6812262
5Kimi K3Moonshot1,6791757
6kimi-k3-maxMoonshot1,6744547
7Qwen 3.8 MaxAlibaba1,6713221
8claude-opus-5-highAnthropic1,6601.3万
9Muse Spark 1.3Meta1,6522972
10qwen3.8-flash-nextAlibaba1,6352779
11Claude Fable 5Anthropic1,6281万
12hy4-previewTencent1,6242321
13Grok 4.6xAI1,6184282
14gpt-5.6-sol-xhigh (codex-harness)OpenAI1,6171.2万
15deepseek-v4.1-flash-maxDeepSeek1,6141361
16GLM-5.3Zhipu AI1,6143725
17GGLM-5.3-FlashZ.ai (Zhipu AI)1,6072925
18Qwen 3.8 27BAlibaba1,5934913
19GLM-5.2Zhipu AI1,5921.1万
20Gemini 3.7 FlashGoogle1,5873007

このランキングの作り方

公開されている人間のブラインド評価アリーナに基づき、スコアは実際のユーザーによる匿名の一対一比較の投票から算出されます。ランキングには最新の公開結果を掲載しています。

順位はこの表自体の指標で高い順に付け直しており、ソースが公開している順位とは独立しています。数値は現時点の実データで、手動の調整はしていません。取得できない値は「—」と表示し、推計値で補うことはありません。

よくある質問

LMArena コードモデルランキングの1位は?

2026年9月時点で、1位はOpenAIのGPT-6 Astra(スコア 1,800)です。2位はclaude-fable-5.1-max(1,758)、3位はclaude-opus-5-max(1,687)。

LMArena コードモデルランキングの上位10件は?

2026年9月時点のスコアの高い順に、上位10件は次のとおりです:1. GPT-6 Astra、2. claude-fable-5.1-max、3. claude-opus-5-max、4. qwen3.8-max-0902、5. Kimi K3、6. kimi-k3-max、7. Qwen 3.8 Max、8. claude-opus-5-high、9. Muse Spark 1.3、10. qwen3.8-flash-next。上位20件の全体はこのページの表をご覧ください。

LMArena コードモデルランキングのデータの出典と更新頻度は?

公開されている人間のブラインド評価アリーナに基づき、スコアは実際のユーザーによる匿名の一対一比較の投票から算出されます。ランキングには最新の公開結果を掲載しています。ソースの公開に合わせて更新しており、現在のデータは2026年9月15日時点のものです。

関連ランキング