Claude Haiku 5.5 vs
Kimi K3
两个都是当前的 SOTA 模型。下面每一行是一张榜单对它俩的判断,标亮的是这张榜排得更靠前的一方。各行之间不相加,所以这里没有总冠军:每张榜测的东西不同,它们意见不一的地方,本身就是结论。
| 榜单 | Claude Haiku 5.5 | Kimi K3 |
|---|---|---|
| Artificial Analysis LLM Leaderboard Artificial Analysis Intelligence Index | 43.4 第 19 名,共 375 个 | 43.6 第 18 名,共 375 个 |
| Arena — Agent Overall | — | 0.042 第 14 名,共 51 个 |
| Artificial Analysis Coding Agents Artificial Analysis Coding Agent Index | 0.414 第 21 名,共 23 个 | 0.519 第 15 名,共 23 个 |
| HarnessTax — SWE-bench Lite SWE-bench Lite | — | 76.7% 第 4 名,共 7 个 |
| HarnessTax — Terminal-Bench 2.0 Terminal-Bench 2.0 | — | 73.3% 第 4 名,共 7 个 |
| Arena — Code Overall | — | 1655 第 14 名,共 141 个 |
| Arena — Text Overall (style control) | — | 1488 第 16 名,共 413 个 |
名次以各榜自己的为准:榜单公布了名次就用它的,没有公布就按该榜的分数排序。不同榜的分数不能相互比较。
基本信息
| 厂商 | Anthropic | Kimi |
|---|---|---|
| 权重 | 闭源 | 开源 |
| 发布日期 | — | 2026-07-16 |
| 价格 Blended Price, USD per 1M tokens (3:1 input:output) | $0.20 | $6.00 |
| 性价比:在斩杀线上的位置 | 斩杀者 | SOTA |
Claude Haiku 5.5 →Kimi K3 → 斩杀线是怎么画的 →