通用智能 排名
看看哪些 AI 模型在 通用智能 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 响应时间(平均) ↑.
319/319
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 通用智能 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #308 | Grok Build 0.1 none | X AI | 4.3 | 4.0 | $0.547 | 0/1 | 12.5s |
| #202 | Trinity Large Thinking low | Arcee AI | 10.0 | 6.0 | $0.625 | 1/1 | 12.7s |
| #51 | Grok 4.5 medium | X AI | 6.5 | 8.5 | $2.042 | 0/1 | 12.8s |
| #71 | GLM 5.2 high | Z.ai | 10.0 | 8.0 | $1.188 | 1/1 | 12.9s |
| #280 | Trinity Large Thinking high | Arcee AI | 6.5 | 4.8 | $0.592 | 0/1 | 12.9s |
| #201 | Nemotron 3 Ultra none | NVIDIA | 5.0 | 6.1 | $0.093 | 0/1 | 13.5s |
| #65 | GPT-5 Mini medium | OpenAI | 4.5 | 8.1 | $0.241 | 0/1 | 13.5s |
| #3 | GPT-6 Astra max | OpenAI | 10.0 | 9.9 | $3.803 | 1/1 | 13.7s |
| #44 | Muse Spark 1.2 high | Meta | 10.0 | 8.7 | $1.771 | 1/1 | 13.9s |
| #128 | Qwen3.7 Flash low | Qwen | 4.0 | 7.2 | $0.043 | 0/1 | 14.4s |
| #318 | Step 3.5 Flash none | Stepfun | 4.0 | 2.3 | $0.020 | 0/1 | 14.4s |
| #88 | GLM 5 medium | Z.ai | 6.1 | 7.7 | $0.228 | 0/1 | 14.7s |
| #74 | Kimi K3 max | Moonshot AI | 10.0 | 7.9 | $3.467 | 1/1 | 14.9s |
| #277 | Ring-2.6-1T none | Inclusionai | 4.3 | 4.8 | $0.026 | 0/1 | 15.6s |
| #303 | Hy3 preview none | Tencent | 4.1 | 4.0 | $0.007 | 0/1 | 16.1s |