综合 排名
看看哪些 AI 模型在 综合 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 响应时间(平均) ↓.
311/311
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 综合 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #49 | Seed 2.1 Turbo medium | Bytedance Seed | 10.0 | 8.4 | $1.951 | 2/2 | 400.3s |
| #189 | Trinity Large Thinking medium | Arcee AI | 2.9 | 6.1 | $0.756 | 0/2 | 382.7s |
| #18 | Seed 2.1 Turbo low | Bytedance Seed | 10.0 | 9.1 | $1.546 | 2/2 | 360.0s |
| #143 | Solar Pro 4 low | Upstage | 6.3 | 6.8 | $0.044 | 1/2 | 358.1s |
| #63 | GLM 5.2 high | Z.ai | 10.0 | 8.0 | $1.188 | 2/2 | 321.5s |
| #137 | Qwen3.7 Flash medium | Qwen | 6.4 | 6.9 | $0.065 | 1/2 | 314.2s |
| #122 | Qwen3.5-122B-A10B medium | Qwen | 6.4 | 7.1 | $1.207 | 1/2 | 313.5s |
| #140 | Qwen3.6 Flash medium | Qwen | 6.5 | 6.8 | $0.741 | 1/2 | 299.2s |
| #253 | Granite 4.2 8B low | IBM Granite | 3.0 | 5.1 | $0.012 | 0/2 | 298.2s |
| #144 | Solar Pro 4 medium | Upstage | 6.4 | 6.8 | $0.047 | 1/2 | 294.8s |
| #249 | Granite 4.2 8B medium | IBM Granite | 3.0 | 5.2 | $0.009 | 0/2 | 291.1s |
| #194 | Trinity Large Thinking low | Arcee AI | 5.2 | 6.0 | $0.625 | 0/2 | 291.0s |
| #19 | Qwen3.7 Max medium | Qwen | 8.7 | 9.1 | $1.157 | 1/2 | 287.8s |
| #234 | Laguna S 2.1 medium | Poolside | 3.2 | 5.4 | $0.053 | 0/2 | 284.7s |
| #133 | Seed-2.0-Mini medium | Bytedance Seed | 7.3 | 7.0 | $0.116 | 1/2 | 282.3s |