通用智能 排名
看看哪些 AI 模型在 通用智能 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 测试正确 ↑.
319/319
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 通用智能 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #146 | Seed-2.0-Code high | Bytedance Seed | 4.6 | 6.9 | $1.273 | 0/1 | 36.4s |
| #148 | Qwen3.6 Flash medium | Qwen | 4.8 | 6.8 | $0.741 | 0/1 | 9.88s |
| #149 | Step 3.7 Flash high | Stepfun | 5.5 | 6.8 | $1.229 | 0/1 | 4.17s |
| #150 | Seed-2.0-Code medium | Bytedance Seed | 4.8 | 6.8 | $1.153 | 0/1 | 11.4s |
| #151 | Solar Pro 4 low | Upstage | 5.5 | 6.8 | $0.044 | 0/1 | 61.2s |
| #152 | Solar Pro 4 medium | Upstage | 3.0 | 6.8 | $0.047 | 0/1 | 48.0s |
| #153 | DeepSeek V4 Pro none | DeepSeek | 5.0 | 6.8 | $0.210 | 0/1 | 2.05s |
| #154 | GLM 5.3 low | Z.ai | 4.1 | 6.8 | $0.257 | 0/1 | 4.70s |
| #155 | MiMo-V2.5-Pro medium | Xiaomi | 5.5 | 6.8 | $0.221 | 0/1 | 4.02s |
| #158 | GLM 5.2 none | Z.ai | 6.1 | 6.7 | $0.153 | 0/1 | 4.42s |
| #159 | KAT-Coder-Pro V2.5 none | Kwaipilot | 4.8 | 6.7 | $0.487 | 0/1 | 5.16s |
| #160 | LongCat 2.0 low | Meituan | 3.4 | 6.7 | $0.412 | 0/1 | 22.5s |
| #163 | LongCat 2.0 high | Meituan | 5.1 | 6.7 | $0.492 | 0/1 | 17.0s |
| #166 | Qwen3.5-27B none | Qwen | 5.0 | 6.6 | $0.058 | 0/1 | 2.51s |
| #167 | Gemini 3.1 Flash Lite Preview low | 4.0 | 6.6 | $0.646 | 0/1 | 1.54s |