AI模型排行
看复杂问题中的回答表现,帮助筛选值得进一步测试的模型。
官方前30数据至2026-09-02
01claude-opus-4-6-highAnthropic15331529–153745,743
02claude-fable-5Anthropic15331527–153917,887
03claude-opus-4-6Anthropic15271523–153149,259
04claude-opus-4-7-highAnthropic15261521–153140,212
05claude-fable-5.1-maxAnthropic15221507–15371,662
06claude-opus-4-7Anthropic15191514–152440,918
07kimi-k3-maxMoonshot15191513–152511,751
08claude-opus-5-highAnthropic15181513–152323,221
09gemini-3.8-flash-highGoogle · 初步结果15181508–15283,458
10claude-opus-4-8-highAnthropic15151510–152032,372
11claude-opus-5-maxAnthropic15141507–152111,171
12muse-spark-1.2 (xHigh)Meta15131500–15262,124
13muse-spark-1.1Meta15111505–151716,123
14gemini-3.7-flash-highGoogle · 初步结果15081498–15183,816
15glm-5.3-maxZ.ai15071498–15165,079
16gemini-3.1-pro-previewGoogle15071503–151166,745
17gpt-5.6-sol-xhighOpenAI15071501–151315,374
18muse-sparkMeta15051498–15128,737
19claude-sonnet-4-6Anthropic15041500–150843,063
20gemini-3-proGoogle15041499–150922,292
21claude-opus-4-8Anthropic15031498–150832,874
22qwen3.8-maxAlibaba15021495–15099,005
23gpt-5.5-highOpenAI15021497–150741,634
24gemini-3.6-flash-highGoogle15001494–150615,046
25claude-opus-4-5-20251101-high-32kAnthropic14991494–150419,573
26gpt-5.5OpenAI14981493–150343,203
27gpt-5.4-highOpenAI14981493–150339,290
28claude-opus-4-5-20251101Anthropic14981494–150241,298
29gemini-3.5-flash-highGoogle14971492–150222,905
30gpt-5.2-chat-latest-20260210OpenAI14971492–150221,618
数据来源
数据来自Arena Text Leaderboard。本地归档官方2026-09-02页面前30名;分数和区间按页面显示精度保存,区间端点由页面的四舍五入分数与误差范围换算,不冒充精确统计值。 两个榜单分别保留其数据日期,Scope.AI不混合分数、不改写官方排名。
阅读Arena排名方法