SOTA AI 大模型排行榜:最新排名与性价比斩杀线
现在谁是 SOTA 模型?每天汇总各大公开榜单:谁在领跑,谁贵而不强,一张图见分晓。每个分数都标着出处,不同榜单从不混算。
- 第一 · AA
- 57.6
- Claude Opus 5.5 · $8.00
- 斩杀者 · 价格
- $0.17
- MiMo V2.6 Flash
- SOTA
- 21
- 得分高过斩杀者
- 被斩杀
- 61
- 更贵,却不更强
排行 · AA 18–58 · ARENA 1415–1534
- 157.61504
- 256.01471
- 353.41501
- 452.71477
- 5新上榜52.61525
- 651.81483
- 7上一代50.81490
- 8上一代49.61504
- 948.11494
- 10上一代47.61457
- 11上一代47.01484
- 1246.41442
- 1346.31480
- 1445.41482
- 1544.81478
- 16上一代44.31454
- 1743.71454
- 1843.61488
- 1942.11465
- 2041.81473
- 21上一代41.81482
- 22新上榜未识别41.1—
- 2340.91495
- 24上一代估算40.71501
- 2539.8—
- 26上一代估算39.61488
- 27上一代39.61494
- 2839.51474
- 29上一代估算39.01475
- 30上一代38.81466
- 31新上榜未识别38.4—
- 32上一代38.41481
- 33上一代38.21462
- 3438.11443
- 35斩杀者37.91452
斩杀线:得分 × 价格
每个点是一个模型:越往右越贵,越往上越强。两条虚线交汇处是斩杀者,全场性价比最高的那一个。它右下方的模型更贵却不更强,统统被斩杀;横线以上是 SOTA,最强的一档;左下方更便宜也更弱,是省钱之选。 斩杀线是怎么画的 →
斩杀线前沿线:价格和得分都没被别的模型同时超过SOTA低成本被斩杀空心点或浅色叉:该榜的估算值
Claude Opus 5.5
各榜成绩
- Artificial Analysis LLM Leaderboard57.6第 1 名,共 374 个
- Arena — Agent0.138第 2 名,共 49 个
- Artificial Analysis Coding Agents0.660第 2 名,共 22 个
- Arena — Code1815第 1 名,共 109 个
- Arena — Text1504第 4 名,共 306 个
名次是各榜自己的:榜单公布了名次就用它的,没公布就按该榜分数排。进度条表示在这个榜里排在多少模型前面。不同榜的分数不能相互比较。
不同推理强度下的成绩
Artificial Analysis LLM Leaderboardmax 最高
- low42.3
- medium51.2
- high53.6
- xhigh56.0
- max57.6
只测了一档的榜
- Arena — Agent · agenthigh0.138
- Artificial Analysis Coding Agents · Claude Codemax0.660
- Arena — Codemax1815
- Arena — Texthigh1504
同一个模型在不同推理强度下的成绩。条形从 0 画到该榜的最高分,每个榜单独看,不要跨榜比较。