性能最佳 AI 模型排行(Arena 盲测投票)

人们在不知道模型身份的情况下比较同一问题的两个回答并投票,按得分排序。同一模型只列出得分最高的设置。

排名模型得分输出价格
1Claude Opus 4.6 Anthropic1505 分每百万 Token ¥178
2Claude Fable 5 Anthropic1505 分每百万 Token ¥356
3Claude Opus 5.5 Anthropic1504 分每百万 Token ¥142
4Claude Opus 4.7 Anthropic1502 分每百万 Token ¥178
5Claude Fable 5.1 Anthropic1501 分每百万 Token ¥356
6Muse Spark 1.3 Meta1495 分每百万 Token ¥30.2
7Muse Spark 1.2 Meta1494 分每百万 Token ¥30.2
8Gemini 3.8 Flash Google1494 分每百万 Token ¥26.7
9Muse Spark 1.1 Meta1492 分每百万 Token ¥30.2
10Claude Opus 5 Anthropic1491 分每百万 Token ¥178
11Gemini 3.7 Flash Google1488 分每百万 Token ¥26.7
12Kimi K3 Moonshot1488 分每百万 Token ¥96
13Gemini 3.1 Pro Google1487 分每百万 Token ¥85.3
14GPT-5.6 Sol OpenAI1484 分每百万 Token ¥71.1
15Gemini 3.6 Flash Google1483 分每百万 Token ¥26.7
16GPT-5.5 OpenAI1481 分每百万 Token ¥213
17Claude Opus 4.8 Anthropic1481 分每百万 Token ¥178
18Qwen3.8 Max Alibaba1481 分每百万 Token ¥42.7
19MiMo-V2.6-Pro Xiaomi1480 分每百万 Token ¥6.19
20GLM 5.3 Z.ai1479 分每百万 Token ¥31.3
21Gemini 3.5 Flash Google1477 分每百万 Token ¥64
22GPT-6 Astra OpenAI1476 分每百万 Token ¥356

来源:Arena 文本排行榜 (lmarena-ai/leaderboard-dataset),2026年9月30日 发布 · CC BY 4.0 / 价格:OpenRouter 模型列表 · 排名变化(▲▼)与上次发布相比

      OpenRouter · Vercel · CC BY 4.0

      Arena · CC BY 4.0