OnlySOTA

家族榜:每条产品线以最强模型出战

每个家族(如 Claude Opus、GPT、Gemini Flash)由其中最强的一款代表,整行原样取用,不做平均。点开家族,看它的每一款。

第一 · AA
57.6
Claude Opus 5.5 · $8.00
斩杀者 · 价格
$0.17
MiMo V2.6 Flash
SOTA
19
得分高过斩杀者
被斩杀
61
更贵,却不更强
排行 · AA 18–58 · ARENA 1415–1534
  1. 1成绩来自 Claude Opus 5.557.61504
  2. 2成绩来自 GPT 6 Astra52.71477
  3. 3成绩来自 Gemini 4 Argon新上榜52.61525
  4. 4成绩来自 Muse Spark 1.348.11494
  5. 5成绩来自 Grok 4.746.41442
  6. 646.31480
  7. 7成绩来自 Qwen 3.8 Max45.41482
  8. 8成绩来自 GLM 5.344.81478
  9. 943.71454
  10. 1043.61488
  11. 1139.51474
  12. 12斩杀者37.91452
查看 AA 的全部 372 个模型 →
斩杀线:得分 × 价格

每个点是一个模型:越往右越贵,越往上越强。两条虚线交汇处是斩杀者,全场性价比最高的那一个。它右下方的模型更贵却不更强,统统被斩杀;横线以上是 SOTA,最强的一档;左下方更便宜也更弱,是省钱之选。 斩杀线是怎么画的 →

Artificial Analysis Intelligence Index · 刻度从 0 开始2040600$0.05$0.25$1.00$5.00$20.0057.6$8.00Claude Opus 5.5斩杀者MiMo V2.6 Flash37.9 · $0.17SOTA低成本被斩杀Blended Price, USD per 1M tokens (3:1 input:output) · log10
斩杀线前沿线:价格和得分都没被别的模型同时超过SOTA低成本被斩杀空心点或浅色叉:该榜的估算值

Claude Opus 5.5

anthropic/claude-opus-5-5 · 闭源 · $8.00 · SOTA

查看完整页面 →
各榜成绩
  • Artificial Analysis LLM Leaderboard57.6第 1 名,共 372 个
  • Arena — Agent0.138第 2 名,共 49 个
  • Artificial Analysis Coding Agents0.660第 2 名,共 22 个
  • Arena — Code1815第 1 名,共 109 个
  • Arena — Text1504第 4 名,共 306 个

名次是各榜自己的:榜单公布了名次就用它的,没公布就按该榜分数排。进度条表示在这个榜里排在多少模型前面。不同榜的分数不能相互比较。

不同推理强度下的成绩

Artificial Analysis LLM Leaderboardmax 最高

  1. low42.3
  2. medium51.2
  3. high53.6
  4. xhigh56.0
  5. max57.6

只测了一档的榜

  • Arena — Agent · agenthigh0.138
  • Artificial Analysis Coding Agents · Claude Codemax0.660
  • Arena — Codemax1815
  • Arena — Texthigh1504

同一个模型在不同推理强度下的成绩。条形从 0 画到该榜的最高分,每个榜单独看,不要跨榜比较。