LMArena コードモデルランキング(2026年9月)
2026年9月時点で、GPT-6 Astraが1,800で1位、claude-fable-5.1-max(1,758)とclaude-opus-5-max(1,687)が続きます。 121件の候補のうち上位20件。
2026年9月時点のデータ
| # | モデル | 提供元 | スコア | 投票数 |
|---|---|---|---|---|
| 1 | GPT-6 Astra | OpenAI | 1,800 | 2281 |
| 2 | claude-fable-5.1-max | Anthropic | 1,758 | 3036 |
| 3 | claude-opus-5-max | Anthropic | 1,687 | 1.2万 |
| 4 | qwen3.8-max-0902 | Alibaba | 1,681 | 2262 |
| 5 | Kimi K3 | Moonshot | 1,679 | 1757 |
| 6 | kimi-k3-max | Moonshot | 1,674 | 4547 |
| 7 | Qwen 3.8 Max | Alibaba | 1,671 | 3221 |
| 8 | claude-opus-5-high | Anthropic | 1,660 | 1.3万 |
| 9 | Muse Spark 1.3 | Meta | 1,652 | 2972 |
| 10 | qwen3.8-flash-next | Alibaba | 1,635 | 2779 |
| 11 | Claude Fable 5 | Anthropic | 1,628 | 1万 |
| 12 | hy4-preview | Tencent | 1,624 | 2321 |
| 13 | Grok 4.6 | xAI | 1,618 | 4282 |
| 14 | gpt-5.6-sol-xhigh (codex-harness) | OpenAI | 1,617 | 1.2万 |
| 15 | deepseek-v4.1-flash-max | DeepSeek | 1,614 | 1361 |
| 16 | GLM-5.3 | Zhipu AI | 1,614 | 3725 |
| 17 | GGLM-5.3-Flash | Z.ai (Zhipu AI) | 1,607 | 2925 |
| 18 | Qwen 3.8 27B | Alibaba | 1,593 | 4913 |
| 19 | GLM-5.2 | Zhipu AI | 1,592 | 1.1万 |
| 20 | Gemini 3.7 Flash | 1,587 | 3007 |
このランキングの作り方
公開されている人間のブラインド評価アリーナに基づき、スコアは実際のユーザーによる匿名の一対一比較の投票から算出されます。ランキングには最新の公開結果を掲載しています。
順位はこの表自体の指標で高い順に付け直しており、ソースが公開している順位とは独立しています。数値は現時点の実データで、手動の調整はしていません。取得できない値は「—」と表示し、推計値で補うことはありません。
よくある質問
LMArena コードモデルランキングの1位は?
2026年9月時点で、1位はOpenAIのGPT-6 Astra(スコア 1,800)です。2位はclaude-fable-5.1-max(1,758)、3位はclaude-opus-5-max(1,687)。
LMArena コードモデルランキングの上位10件は?
2026年9月時点のスコアの高い順に、上位10件は次のとおりです:1. GPT-6 Astra、2. claude-fable-5.1-max、3. claude-opus-5-max、4. qwen3.8-max-0902、5. Kimi K3、6. kimi-k3-max、7. Qwen 3.8 Max、8. claude-opus-5-high、9. Muse Spark 1.3、10. qwen3.8-flash-next。上位20件の全体はこのページの表をご覧ください。
LMArena コードモデルランキングのデータの出典と更新頻度は?
公開されている人間のブラインド評価アリーナに基づき、スコアは実際のユーザーによる匿名の一対一比較の投票から算出されます。ランキングには最新の公開結果を掲載しています。ソースの公開に合わせて更新しており、現在のデータは2026年9月15日時点のものです。









