OpenRouter · Vercel · CC BY 4.0
Arena · CC BY 4.0
人们在不知道模型身份的情况下比较同一问题的两个回答并投票,按得分排序。同一模型只列出得分最高的设置。
| 排名 | 模型 | 得分 | 输出价格 |
|---|---|---|---|
| 1 | Claude Opus 4.6 Anthropic | 1505 分 | 每百万 Token ¥178 |
| 2 | Claude Fable 5 Anthropic | 1505 分 | 每百万 Token ¥356 |
| 3 | Claude Opus 5.5 Anthropic | 1504 分 | 每百万 Token ¥142 |
| 4 | Claude Opus 4.7 Anthropic | 1502 分 | 每百万 Token ¥178 |
| 5 | Claude Fable 5.1 Anthropic | 1501 分 | 每百万 Token ¥356 |
| 6 | Muse Spark 1.3 Meta | 1495 分 | 每百万 Token ¥30.2 |
| 7 | Muse Spark 1.2 Meta | 1494 分 | 每百万 Token ¥30.2 |
| 8 | Gemini 3.8 Flash Google | 1494 分 | 每百万 Token ¥26.7 |
| 9 | Muse Spark 1.1 Meta | 1492 分 | 每百万 Token ¥30.2 |
| 10 | Claude Opus 5 Anthropic | 1491 分 | 每百万 Token ¥178 |
| 11 | Gemini 3.7 Flash Google | 1488 分 | 每百万 Token ¥26.7 |
| 12 | Kimi K3 Moonshot | 1488 分 | 每百万 Token ¥96 |
| 13 | Gemini 3.1 Pro Google | 1487 分 | 每百万 Token ¥85.3 |
| 14 | GPT-5.6 Sol OpenAI | 1484 分 | 每百万 Token ¥71.1 |
| 15 | Gemini 3.6 Flash Google | 1483 分 | 每百万 Token ¥26.7 |
| 16 | GPT-5.5 OpenAI | 1481 分 | 每百万 Token ¥213 |
| 17 | Claude Opus 4.8 Anthropic | 1481 分 | 每百万 Token ¥178 |
| 18 | Qwen3.8 Max Alibaba | 1481 分 | 每百万 Token ¥42.7 |
| 19 | MiMo-V2.6-Pro Xiaomi | 1480 分 | 每百万 Token ¥6.19 |
| 20 | GLM 5.3 Z.ai | 1479 分 | 每百万 Token ¥31.3 |
| 21 | Gemini 3.5 Flash Google | 1477 分 | 每百万 Token ¥64 |
| 22 | GPT-6 Astra OpenAI | 1476 分 | 每百万 Token ¥356 |
来源:Arena 文本排行榜 (lmarena-ai/leaderboard-dataset),2026年9月30日 发布 · CC BY 4.0 / 价格:OpenRouter 模型列表 · 排名变化(▲▼)与上次发布相比