通用智能 排名
看看哪些 AI 模型在 通用智能 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 响应时间(平均) ↓.
319/319
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 通用智能 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #71 | GLM 5.2 high | Z.ai | 10.0 | 8.0 | $1.188 | 1/1 | 12.9s |
| #51 | Grok 4.5 medium | X AI | 6.5 | 8.5 | $2.042 | 0/1 | 12.8s |
| #202 | Trinity Large Thinking low | Arcee AI | 10.0 | 6.0 | $0.625 | 1/1 | 12.7s |
| #308 | Grok Build 0.1 none | X AI | 4.3 | 4.0 | $0.547 | 0/1 | 12.5s |
| #122 | DeepSeek V4 Flash 0731 medium | DeepSeek | 6.1 | 7.3 | $0.106 | 0/1 | 12.2s |
| #282 | KAT-Coder-Air V2.5 none | Kwaipilot | 5.0 | 4.8 | $0.070 | 0/1 | 12.0s |
| #18 | Gemini 3.1 Pro Preview medium | 10.0 | 9.2 | $1.352 | 1/1 | 11.8s | |
| #25 | Qwen3.7 Max medium | Qwen | 10.0 | 9.1 | $1.157 | 1/1 | 11.7s |
| #150 | Seed-2.0-Code medium | Bytedance Seed | 4.8 | 6.8 | $1.153 | 0/1 | 11.4s |
| #113 | Qwen3.8 2.4T A95B high | Qwen | 6.1 | 7.4 | $2.357 | 0/1 | 11.4s |
| #89 | Seed-2.0-Code low | Bytedance Seed | 6.5 | 7.7 | $0.767 | 0/1 | 11.1s |
| #162 | GLM 5V Turbo medium | Z.ai | 10.0 | 6.7 | $0.457 | 1/1 | 11.1s |
| #315 | gpt-oss-120b none | OpenAI | 4.8 | 3.7 | $0.010 | 0/1 | 10.8s |
| #110 | Kimi K2.7 Code medium | Moonshot AI | 10.0 | 7.4 | $0.687 | 1/1 | 10.8s |
| #87 | Qwen3.7 Flash high | Qwen | 5.1 | 7.8 | $0.052 | 0/1 | 10.7s |