通用智能 排名
看看哪些 AI 模型在 通用智能 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 响应时间(平均) ↓.
319/319
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 通用智能 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #132 | Step 3.7 Flash low | Stepfun | 3.4 | 7.1 | $0.390 | 0/1 | 7.00s |
| #220 | Nemotron 3 Super medium | NVIDIA | 4.1 | 5.7 | $0.050 | 0/1 | 6.91s |
| #263 | MiMo-V2.5 none | Xiaomi | 4.4 | 5.1 | $0.025 | 0/1 | 6.86s |
| #76 | Step 3.7 Flash medium | Stepfun | 4.0 | 7.9 | $0.495 | 0/1 | 6.85s |
| #292 | MiniMax M2.5 medium | Minimax | 3.8 | 4.6 | $0.327 | 0/1 | 6.63s |
| #67 | Inkling high | Thinkingmachines | 10.0 | 8.0 | $1.046 | 1/1 | 6.53s |
| #285 | Hunter Alpha medium | OpenRouter | 7.0 | 4.7 | $0.000 | 0/1 | 6.44s |
| #29 | Qwen3.8 Max medium | Qwen | 10.0 | 9.0 | $0.771 | 1/1 | 6.41s |
| #281 | Grok 4.20 Multi Agent Beta medium | X AI | 5.8 | 4.8 | $5.599 | 0/1 | 6.40s |
| #126 | Muse Glimmer 30B high | Meta | 5.3 | 7.2 | $0.397 | 0/1 | 6.36s |
| #204 | Grok 4.20 Beta medium | X AI | 10.0 | 6.0 | $0.750 | 1/1 | 5.78s |
| #70 | DeepSeek V4 Flash 0731 high | DeepSeek | 10.0 | 8.0 | $0.134 | 1/1 | 5.64s |
| #144 | Claude Fable 5.1 low | Anthropic | 10.0 | 6.9 | $2.565 | 1/1 | 5.62s |
| #26 | Claude Fable 5.1 high | Anthropic | 10.0 | 9.0 | $3.364 | 1/1 | 5.40s |
| #77 | Qwen3.8 27B low | Qwen | 5.0 | 7.9 | ~$0.071 | 0/1 | 5.37s |