GPT 6.1 Sol vs
Grok 4.7
两个都是当前的 SOTA 模型。下面每一行是一张榜单对它俩的判断,标亮的是这张榜排得更靠前的一方。各行之间不相加,所以这里没有总冠军:每张榜测的东西不同,它们意见不一的地方,本身就是结论。
| 榜单 | GPT 6.1 Sol | Grok 4.7 |
|---|---|---|
| Artificial Analysis LLM Leaderboard Artificial Analysis Intelligence Index | 51.8 第 6 名,共 372 个 | 46.4 第 12 名,共 372 个 |
| Arena — Agent Overall | 0.112 第 5 名,共 49 个 | 0.040 第 16 名,共 49 个 |
| Artificial Analysis Coding Agents Artificial Analysis Coding Agent Index | 0.629 第 4 名,共 22 个 | 0.563 第 11 名,共 22 个 |
| Arena — Code Overall | 1758 第 4 名,共 109 个 | 1638 第 15 名,共 109 个 |
| Arena — Text Overall (style control) | 1483 第 21 名,共 306 个 | 1442 第 91 名,共 306 个 |
| Arena — Vision Overall (style control) | 1291 第 10 名,共 128 个 | — |
名次是各榜自己的:榜单公布了名次就用它的,没公布就按该榜分数排。进度条表示在这个榜里排在多少模型前面。不同榜的分数不能相互比较。
基本信息
| 厂商 | OpenAI | SpaceXAI |
|---|---|---|
| 权重 | 闭源 | 闭源 |
| 发布日期 | — | — |
| 价格 Blended Price, USD per 1M tokens (3:1 input:output) | $4.00 | $3.00 |
| 性价比:在斩杀线上的位置 | SOTA | SOTA |
GPT 6.1 Sol →Grok 4.7 → 斩杀线是怎么画的 →
GPT 6.1 Sol 和其他 SOTA 模型对比
- Qwen 3.8 Flash Next
- Qwen 3.8 Max
- Claude Fable 5
- Claude Fable 5.1
- Claude Opus 5.5
- Claude Sonnet 5.5
- DeepSeek V4.1 Flash
- Gemini 3.8 Flash
- Gemini 4 Argon
- Kimi K3
- Muse Spark 1.3
- GPT 5.6 Terra
- GPT 6 Astra
- GPT 6 Luna
- Step 5
- MiMo V2.6 Flash
- MiMo V2.6 Pro
- GLM 5.3
- GLM 5.3 Flash