通用智能 排名
看看哪些 AI 模型在 通用智能 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 响应时间(平均) ↑.
319/319
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 通用智能 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #2 | Gemini 3.8 Flash high | 10.0 | 9.9 | $1.595 | 1/1 | 4.06s | |
| #59 | Muse Spark 1.1 low | Meta | 10.0 | 8.3 | $0.673 | 1/1 | 4.12s |
| #14 | GPT-6 Astra medium | OpenAI | 10.0 | 9.4 | $1.774 | 1/1 | 4.13s |
| #98 | GPT-5.4 Nano medium | OpenAI | 4.5 | 7.5 | $0.142 | 0/1 | 4.15s |
| #174 | Laguna XS 2.1 medium | Poolside | 5.0 | 6.5 | $0.068 | 0/1 | 4.15s |
| #28 | GPT-5.5 medium | OpenAI | 10.0 | 9.0 | $4.163 | 1/1 | 4.16s |
| #149 | Step 3.7 Flash high | Stepfun | 5.5 | 6.8 | $1.229 | 0/1 | 4.17s |
| #185 | MiMo-V2-Flash medium | Xiaomi | 4.0 | 6.3 | $0.043 | 0/1 | 4.20s |
| #55 | GPT-5.2 medium | OpenAI | 3.7 | 8.4 | $1.182 | 0/1 | 4.32s |
| #63 | Claude Sonnet 5 medium | Anthropic | 4.8 | 8.2 | $0.922 | 0/1 | 4.32s |
| #111 | GPT-5.6 Luna medium | OpenAI | 5.1 | 7.4 | $0.072 | 0/1 | 4.34s |
| #258 | Nemotron 3.5 Lightning medium | NVIDIA | 5.5 | 5.1 | $0.156 | 0/1 | 4.36s |
| #15 | GPT-5.6 Sol high | OpenAI | 10.0 | 9.4 | $0.446 | 1/1 | 4.40s |
| #46 | Muse Spark 1.1 medium | Meta | 10.0 | 8.6 | $1.420 | 1/1 | 4.41s |
| #158 | GLM 5.2 none | Z.ai | 6.1 | 6.7 | $0.153 | 0/1 | 4.42s |