领域专项 排名
看看哪些 AI 模型在 领域专项 上表现最好,哪些更稳定,以及差距主要出现在哪里。
210/210
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 领域专项 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #158 | KAT-Coder-Air V2.5 low | Kwaipilot | 2.9 | 5.4 | $0.041 | 0/3 | 4.99s |
| #159 | GPT-5.6 Luna none | OpenAI | 2.9 | 5.4 | $0.142 | 0/3 | 737ms |
| #173 | DeepSeek V3.2 none | DeepSeek | 2.9 | 5.0 | $0.054 | 0/3 | 4.17s |
| #181 | Grok 4.20 Multi Agent Beta medium | X AI | 2.9 | 4.8 | $5.599 | 0/3 | 24.7s |
| #182 | KAT-Coder-Air V2.5 none | Kwaipilot | 2.9 | 4.8 | $0.067 | 0/3 | 6.24s |
| #207 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 2.9 | 3.4 | $0.000 | 0/3 | 56.7s |
| #49 | GLM 5 Turbo medium | Z.ai | 2.9 | 7.6 | $0.323 | 0/3 | 71.1s |
| #69 | KAT-Coder-Pro V2.5 high | Kwaipilot | 2.9 | 7.2 | $0.482 | 0/3 | 35.3s |
| #76 | DeepSeek V3.2 medium | DeepSeek | 2.9 | 7.0 | $0.078 | 0/3 | 24.3s |
| #95 | Gemma 4 26B A4B medium | 2.9 | 6.6 | $0.089 | 0/3 | 23.6s | |
| #121 | gpt-oss-120b medium | OpenAI | 2.9 | 6.1 | $0.019 | 0/3 | 50.9s |
| #140 | Nemotron 3 Super medium | NVIDIA | 2.9 | 5.7 | $0.050 | 0/3 | 16.2s |
| #180 | GPT-5.4 Nano none | OpenAI | 2.9 | 4.8 | $0.041 | 0/3 | 926ms |
| #188 | Cobuddy medium | Baidu | 2.9 | 4.7 | $0.000 | 0/3 | 128.2s |
| #190 | MiniMax M2.5 medium | Minimax | 2.9 | 4.6 | $0.340 | 0/3 | 237.3s |