LMArena 程式碼模型榜(2026年9月)

2026年9月,GPT-6 Astra 以 1,800 位居第一,claude-fable-5.1-max(1,758) 與 claude-opus-5-max(1,687) 分列其後。 本榜從 121 個候選中取前 20 名。

資料更新於 2026年9月

#模型廠商評分投票數
1GPT-6 AstraOpenAI1,8002281
2claude-fable-5.1-maxAnthropic1,7583036
3claude-opus-5-maxAnthropic1,6871.2萬
4qwen3.8-max-0902Alibaba1,6812262
5Kimi K3Moonshot1,6791757
6kimi-k3-maxMoonshot1,6744547
7Qwen 3.8 MaxAlibaba1,6713221
8claude-opus-5-highAnthropic1,6601.3萬
9Muse Spark 1.3Meta1,6522972
10qwen3.8-flash-nextAlibaba1,6352779
11Claude Fable 5Anthropic1,6281萬
12hy4-previewTencent1,6242321
13Grok 4.6xAI1,6184282
14gpt-5.6-sol-xhigh (codex-harness)OpenAI1,6171.2萬
15deepseek-v4.1-flash-maxDeepSeek1,6141361
16GLM-5.3Zhipu AI1,6143725
17GGLM-5.3-FlashZ.ai (Zhipu AI)1,6072925
18Qwen 3.8 27BAlibaba1,5934913
19GLM-5.2Zhipu AI1,5921.1萬
20Gemini 3.7 FlashGoogle1,5873007

口徑說明

採用公開的人類盲測競技場結果,由真實使用者在匿名對比中投票產生,反映模型在真實使用中的偏好。榜單呈現該榜的最新一期結果。

名次按本表的主指標從高到低重排,與來源榜單自帶的名次無關。數值為當期真實資料,不做人工調整;取不到的值顯示為「—」,不會用估算值填補。

常見問題

LMArena 程式碼模型榜排名第一的是誰?

2026年9月,排名第一的是 OpenAI 的 GPT-6 Astra(評分 1,800);第二名是 claude-fable-5.1-max(1,758),第三名是 claude-opus-5-max(1,687)。

LMArena 程式碼模型榜前 10 名有哪些?

2026年9月按評分從高到低,前 10 名依次為:1. GPT-6 Astra、2. claude-fable-5.1-max、3. claude-opus-5-max、4. qwen3.8-max-0902、5. Kimi K3、6. kimi-k3-max、7. Qwen 3.8 Max、8. claude-opus-5-high、9. Muse Spark 1.3、10. qwen3.8-flash-next。完整前 20 名見本頁表格。

LMArena 程式碼模型榜的資料從哪裡來、多久更新?

採用公開的人類盲測競技場結果,由真實使用者在匿名對比中投票產生,反映模型在真實使用中的偏好。榜單呈現該榜的最新一期結果。隨來源方釋出更新,當前資料日期為 2026年9月15日。

同類榜單