综合 排名
看看哪些 AI 模型在 综合 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 总成本 ↓.
316/316
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 综合 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #150 | DeepSeek V4 Pro none | DeepSeek | 7.9 | 6.8 | $0.220 | 1/2 | 71.6s |
| #126 | Muse Glimmer 30B medium | Meta | 6.5 | 7.2 | $0.211 | 1/2 | 76.5s |
| #264 | MiniMax M2.7 medium | Minimax | 3.8 | 5.0 | $0.208 | 0/2 | 72.1s |
| #19 | Gemini 3.7 Flash low | 10.0 | 9.2 | $0.207 | 2/2 | 13.0s | |
| #132 | GPT-5.6 Sol none | OpenAI | 6.5 | 7.0 | $0.201 | 1/2 | 8.37s |
| #106 | Qwen3.7 Max none | Qwen | 6.5 | 7.4 | $0.197 | 1/2 | 37.2s |
| #193 | Inkling low | Thinkingmachines | 2.9 | 6.1 | $0.187 | 0/2 | 22.7s |
| #112 | Gemini 3 Flash Preview low | 3.0 | 7.4 | $0.185 | 0/2 | 10.2s | |
| #91 | GPT-5.6 Luna high | OpenAI | 10.0 | 7.6 | $0.179 | 2/2 | 19.0s |
| #294 | GLM 4.7 Flash medium | Z.ai | 2.9 | 4.3 | $0.168 | 0/2 | 802.8s |
| #221 | GLM 5.1 none | Z.ai | 2.8 | 5.7 | $0.164 | 0/2 | 46.9s |
| #255 | Nemotron 3.5 Lightning medium | NVIDIA | 6.2 | 5.1 | $0.156 | 1/2 | 136.9s |
| #155 | GLM 5.2 none | Z.ai | 6.9 | 6.7 | $0.153 | 1/2 | 50.2s |
| #248 | Seed-2.0-Code none | Bytedance Seed | 3.0 | 5.3 | $0.151 | 0/2 | 78.4s |
| #253 | Inkling none | Thinkingmachines | 2.9 | 5.2 | $0.147 | 0/2 | 25.7s |