综合 排名
看看哪些 AI 模型在 综合 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 响应时间(平均) ↑.
210/210
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 综合 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #80 | Seed-2.0-Mini medium | Bytedance Seed | 7.3 | 7.0 | $0.101 | 1/2 | 282.3s |
| #8 | Qwen3.7 Max medium | Qwen | 8.7 | 9.2 | $1.116 | 1/2 | 287.8s |
| #85 | Qwen3.6 Flash medium | Qwen | 6.5 | 6.9 | $0.738 | 1/2 | 299.2s |
| #72 | Qwen3.5-122B-A10B medium | Qwen | 6.4 | 7.1 | $1.046 | 1/2 | 313.5s |
| #31 | GLM 5.2 high | Z.ai | 10.0 | 8.0 | $0.970 | 2/2 | 321.5s |
| #110 | Gemma 4 31B medium | 2.9 | 6.3 | $0.163 | 0/2 | 433.1s | |
| #68 | Kimi K2.6 medium | Moonshot AI | 6.9 | 7.2 | $1.036 | 1/2 | 458.6s |
| #95 | Gemma 4 26B A4B medium | 6.3 | 6.6 | $0.089 | 1/2 | 492.9s | |
| #119 | Qwen3.5-35B-A3B medium | Qwen | 3.8 | 6.2 | $0.837 | 0/2 | 512.8s |
| #137 | North Mini Code medium | Cohere | 2.9 | 5.9 | $0.000 | 0/2 | 554.9s |
| #99 | Qwen3.6 27B medium | Qwen | 6.7 | 6.5 | $0.779 | 0/2 | 584.1s |
| #58 | Qwen3.5-27B medium | Qwen | 7.3 | 7.4 | $1.627 | 1/2 | 595.2s |
| #194 | GLM 4.7 Flash medium | Z.ai | 2.9 | 4.3 | $0.166 | 0/2 | 802.8s |
| #130 | Step 3.5 Flash medium | Stepfun | 6.5 | 6.0 | $0.108 | 1/2 | 813.7s |
| #90 | Qwen3.6 35B A3B medium | Qwen | 3.0 | 6.7 | $0.746 | 0/2 | 817.6s |