通用智能 排名
看看哪些 AI 模型在 通用智能 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 总成本 ↓.
319/319
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 通用智能 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #112 | LongCat 2.0 medium | Meituan | 4.8 | 7.4 | $0.499 | 0/1 | 16.4s |
| #76 | Step 3.7 Flash medium | Stepfun | 4.0 | 7.9 | $0.495 | 0/1 | 6.85s |
| #163 | LongCat 2.0 high | Meituan | 5.1 | 6.7 | $0.492 | 0/1 | 17.0s |
| #159 | KAT-Coder-Pro V2.5 none | Kwaipilot | 4.8 | 6.7 | $0.487 | 0/1 | 5.16s |
| #142 | Kimi K2.5 medium | Moonshot AI | 6.5 | 7.0 | $0.479 | 0/1 | 69.7s |
| #143 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 4.7 | 6.9 | $0.478 | 0/1 | 2.35s |
| #66 | Muse Glimmer 30B xhigh | Meta | 5.5 | 8.1 | $0.471 | 0/1 | 7.41s |
| #102 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 4.7 | 7.5 | $0.459 | 0/1 | 79.9s |
| #162 | GLM 5V Turbo medium | Z.ai | 10.0 | 6.7 | $0.457 | 1/1 | 11.1s |
| #91 | DeepSeek V4 Pro high | DeepSeek | 10.0 | 7.7 | $0.454 | 1/1 | 8.83s |
| #35 | Gemini 3.5 Flash low | 10.0 | 8.8 | $0.449 | 1/1 | 2.27s | |
| #114 | Grok 4.6 low | X AI | 10.0 | 7.4 | $0.449 | 1/1 | 16.3s |
| #15 | GPT-5.6 Sol high | OpenAI | 10.0 | 9.4 | $0.446 | 1/1 | 4.40s |
| #7 | Gemini 3.6 Flash medium | 10.0 | 9.8 | $0.427 | 1/1 | 3.40s | |
| #99 | GPT-5.6 Terra low | OpenAI | 4.8 | 7.5 | $0.420 | 0/1 | 3.52s |