OnlySOTA

速度

輸出有多快:持續輸出速度和首個 token 的等待時間,兩者之間、以及與價格之間都需要權衡。測的是某個服務供應商提供的 API,而不是模型本身。

按它在多少項基準裡進入前 10 排序,一樣多時看最好名次。每列保持各自的排名,不做平均。

模型 進入前 10 Artificial Analysis LLM Leaderboard Output Speed Artificial Analysis LLM Leaderboard Time To First Token
Celeris 1 Celeris 2/2 #1 1523/s #8 0.58s
Gemini 2.5 Flash Lite Google 2/2 #5 360/s #1 0.30s
Nemotron 3.5 Lightning NVIDIA 2/2 #9 304/s #7 0.56s
Mercury 2.5 Inception 1/2 #2 691/s #135 3.44s
North Mini Code Cohere 1/2 #113 83/s #2 0.45s
Mercury 2 Inception 1/2 #3 609/s #150 7.38s
Gemini 2.5 Flash Google 1/2 #30 210/s #3 0.45s
Trinity Large Thinking Arcee AI 1/2 #4 371/s #62 1.22s
Command A+ Cohere 1/2 #49 152/s #4 0.48s
Granite 4.2 IBM 1/2 #26 215/s #5 0.53s
Gemini 3.5 Flash Lite Google 1/2 #6 347/s #152 9.42s
Grok Build 0.1 SpaceXAI 1/2 #117 80/s #6 0.54s
Ling 3.0 Flash InclusionAI 1/2 #7 332/s #114 2.52s
Ling 3.0 Flash Fin InclusionAI 1/2 #8 324/s #82 1.71s
GPT 5.4 mini OpenAI 1/2 #14 281/s #9 0.61s
Muse Spark 1.2 Meta 1/2 #10 303/s #155 14.57s
Grok 4.20 SpaceXAI 1/2 #73 128/s #10 0.62s

「—」表示該榜沒有收錄這個模型,不是零分。尚未識別出具體模型的條目不在此處出現,但仍顯示在各自的原始榜單上。