Step 5 vs
Grok 4.7
兩個都是當前的 SOTA 模型。下面每一行是一張榜單對它倆的判斷,標示出來的是這張榜排得更靠前的一方。各行之間不相加,所以這裡沒有總冠軍:每張榜測的東西不同,它們意見不一的地方,本身就是結論。
| 榜單 | Step 5 | Grok 4.7 |
|---|---|---|
| Artificial Analysis LLM Leaderboard Artificial Analysis Intelligence Index | 43.7 第 17 名,共 374 個 | 46.4 第 12 名,共 374 個 |
| Arena — Agent Overall | 0.005 第 31 名,共 51 個 | 0.040 第 16 名,共 51 個 |
| Artificial Analysis Coding Agents Artificial Analysis Coding Agent Index | — | 0.563 第 11 名,共 22 個 |
| Arena — Code Overall | 1570 第 33 名,共 138 個 | 1638 第 16 名,共 138 個 |
| Arena — Text Overall (style control) | 1454 第 74 名,共 413 個 | 1442 第 91 名,共 413 個 |
| Arena — Vision Overall (style control) | 1260 第 45 名,共 159 個 | — |
名次以各榜自己的為準:榜單公佈了名次就用它的,沒有公佈就按該榜的分數排序。不同榜的分數不能相互比較。
基本資訊
| 廠商 | StepFun | SpaceXAI |
|---|---|---|
| 權重 | 閉源 | 閉源 |
| 發布日期 | — | — |
| 價格 Blended Price, USD per 1M tokens (3:1 input:output) | $1.43 | $3.00 |
| 性價比:在斬殺線上的位置 | SOTA | SOTA |
Step 5 和其他 SOTA 模型對比
- Qwen 3.8 Flash Next
- Qwen 3.8 Max
- Claude Fable 5
- Claude Fable 5.1
- Claude Opus 5.5
- Claude Sonnet 5.5
- DeepSeek V4.1 Flash
- Gemini 3.8 Flash
- Gemini 4 Argon
- Ling 3.1 Flash
- Kimi K3
- Muse Spark 1.3
- Mistral Large 4
- GPT 5.6 Terra
- GPT 6.1 Sol
- GPT 6 Astra
- GPT 6 Luna
- MiMo V2.6 Flash
- MiMo V2.6 Pro
- GLM 5.3
- GLM 5.3 Flash
Grok 4.7 和其他 SOTA 模型對比
- Qwen 3.8 Flash Next
- Qwen 3.8 Max
- Claude Fable 5
- Claude Fable 5.1
- Claude Opus 5.5
- Claude Sonnet 5.5
- DeepSeek V4.1 Flash
- Gemini 3.8 Flash
- Gemini 4 Argon
- Ling 3.1 Flash
- Kimi K3
- Muse Spark 1.3
- Mistral Large 4
- GPT 5.6 Terra
- GPT 6.1 Sol
- GPT 6 Astra
- GPT 6 Luna
- MiMo V2.6 Flash
- MiMo V2.6 Pro
- GLM 5.3
- GLM 5.3 Flash