LMArena 程式碼模型榜(2026年9月)
2026年9月,GPT-6 Astra 以 1,800 位居第一,claude-fable-5.1-max(1,758) 與 claude-opus-5-max(1,687) 分列其後。 本榜從 121 個候選中取前 20 名。
資料更新於 2026年9月
| # | 模型 | 廠商 | 評分 | 投票數 |
|---|---|---|---|---|
| 1 | GPT-6 Astra | OpenAI | 1,800 | 2281 |
| 2 | claude-fable-5.1-max | Anthropic | 1,758 | 3036 |
| 3 | claude-opus-5-max | Anthropic | 1,687 | 1.2萬 |
| 4 | qwen3.8-max-0902 | Alibaba | 1,681 | 2262 |
| 5 | Kimi K3 | Moonshot | 1,679 | 1757 |
| 6 | kimi-k3-max | Moonshot | 1,674 | 4547 |
| 7 | Qwen 3.8 Max | Alibaba | 1,671 | 3221 |
| 8 | claude-opus-5-high | Anthropic | 1,660 | 1.3萬 |
| 9 | Muse Spark 1.3 | Meta | 1,652 | 2972 |
| 10 | qwen3.8-flash-next | Alibaba | 1,635 | 2779 |
| 11 | Claude Fable 5 | Anthropic | 1,628 | 1萬 |
| 12 | hy4-preview | Tencent | 1,624 | 2321 |
| 13 | Grok 4.6 | xAI | 1,618 | 4282 |
| 14 | gpt-5.6-sol-xhigh (codex-harness) | OpenAI | 1,617 | 1.2萬 |
| 15 | deepseek-v4.1-flash-max | DeepSeek | 1,614 | 1361 |
| 16 | GLM-5.3 | Zhipu AI | 1,614 | 3725 |
| 17 | GGLM-5.3-Flash | Z.ai (Zhipu AI) | 1,607 | 2925 |
| 18 | Qwen 3.8 27B | Alibaba | 1,593 | 4913 |
| 19 | GLM-5.2 | Zhipu AI | 1,592 | 1.1萬 |
| 20 | Gemini 3.7 Flash | 1,587 | 3007 |
口徑說明
採用公開的人類盲測競技場結果,由真實使用者在匿名對比中投票產生,反映模型在真實使用中的偏好。榜單呈現該榜的最新一期結果。
名次按本表的主指標從高到低重排,與來源榜單自帶的名次無關。數值為當期真實資料,不做人工調整;取不到的值顯示為「—」,不會用估算值填補。
常見問題
LMArena 程式碼模型榜排名第一的是誰?
2026年9月,排名第一的是 OpenAI 的 GPT-6 Astra(評分 1,800);第二名是 claude-fable-5.1-max(1,758),第三名是 claude-opus-5-max(1,687)。
LMArena 程式碼模型榜前 10 名有哪些?
2026年9月按評分從高到低,前 10 名依次為:1. GPT-6 Astra、2. claude-fable-5.1-max、3. claude-opus-5-max、4. qwen3.8-max-0902、5. Kimi K3、6. kimi-k3-max、7. Qwen 3.8 Max、8. claude-opus-5-high、9. Muse Spark 1.3、10. qwen3.8-flash-next。完整前 20 名見本頁表格。
LMArena 程式碼模型榜的資料從哪裡來、多久更新?
採用公開的人類盲測競技場結果,由真實使用者在匿名對比中投票產生,反映模型在真實使用中的偏好。榜單呈現該榜的最新一期結果。隨來源方釋出更新,當前資料日期為 2026年9月15日。









