效能最佳 AI 模型排行(Arena 盲測投票)

大家在不知道模型身分的情況下比較同一個問題的兩個回答並投票,依分數排序。同一個模型只列出分數最高的設定。

排名模型分數輸出價格
1Claude Opus 4.6 Anthropic1505 分每百萬 Token NT$780
2Claude Fable 5 Anthropic1505 分每百萬 Token NT$1,560
3Claude Opus 5.5 Anthropic1504 分每百萬 Token NT$624
4Claude Opus 4.7 Anthropic1502 分每百萬 Token NT$780
5Claude Fable 5.1 Anthropic1501 分每百萬 Token NT$1,560
6Muse Spark 1.3 Meta1495 分每百萬 Token NT$133
7Muse Spark 1.2 Meta1494 分每百萬 Token NT$133
8Gemini 3.8 Flash Google1494 分每百萬 Token NT$117
9Muse Spark 1.1 Meta1492 分每百萬 Token NT$133
10Claude Opus 5 Anthropic1491 分每百萬 Token NT$780
11Gemini 3.7 Flash Google1488 分每百萬 Token NT$117
12Kimi K3 Moonshot1488 分每百萬 Token NT$421
13Gemini 3.1 Pro Google1487 分每百萬 Token NT$374
14GPT-5.6 Sol OpenAI1484 分每百萬 Token NT$312
15Gemini 3.6 Flash Google1483 分每百萬 Token NT$117
16GPT-5.5 OpenAI1481 分每百萬 Token NT$936
17Claude Opus 4.8 Anthropic1481 分每百萬 Token NT$780
18Qwen3.8 Max Alibaba1481 分每百萬 Token NT$187
19MiMo-V2.6-Pro Xiaomi1480 分每百萬 Token NT$27.1
20GLM 5.3 Z.ai1479 分每百萬 Token NT$137
21Gemini 3.5 Flash Google1477 分每百萬 Token NT$281
22GPT-6 Astra OpenAI1476 分每百萬 Token NT$1,560

來源:Arena 文字排行榜 (lmarena-ai/leaderboard-dataset),2026年9月30日 公布 · CC BY 4.0 / 價格:OpenRouter 模型清單 · 排名變化(▲▼)與上次公布相比

      OpenRouter · Vercel · CC BY 4.0

      Arena · CC BY 4.0