领域专项 排名
看看哪些 AI 模型在 领域专项 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 指标 ↑.
316/316
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 领域专项 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #39 | GLM 5.3 Flash max | Z.ai | 3.6 | 8.7 | $0.059 | 0/3 | 203.3s |
| #56 | Muse Spark 1.1 low | Meta | 3.6 | 8.3 | $0.673 | 0/3 | 33.0s |
| #75 | Qwen3.7 Plus medium | Qwen | 3.6 | 7.9 | $0.277 | 0/3 | 60.1s |
| #82 | Seed-2.0-Lite medium | Bytedance Seed | 3.6 | 7.8 | $0.236 | 0/3 | 84.4s |
| #88 | DeepSeek V4 Pro high | DeepSeek | 3.6 | 7.7 | $0.476 | 0/3 | 249.5s |
| #89 | DeepSeek V4 Flash 0423 high | DeepSeek | 3.6 | 7.6 | $0.042 | 0/3 | 115.4s |
| #93 | Nemotron 3 Ultra medium | NVIDIA | 3.6 | 7.6 | $0.701 | 0/3 | 35.2s |
| #102 | GPT-5.4 Mini medium | OpenAI | 3.6 | 7.5 | $0.786 | 0/3 | 71.1s |
| #125 | Qwen3.7 Flash low | Qwen | 3.6 | 7.2 | $0.043 | 0/3 | 37.6s |
| #130 | Solar Pro 4 high | Upstage | 3.6 | 7.1 | $0.046 | 0/3 | 280.8s |
| #146 | Step 3.7 Flash high | Stepfun | 3.6 | 6.8 | $1.229 | 0/3 | 189.3s |
| #160 | LongCat 2.0 high | Meituan | 3.6 | 6.7 | $0.492 | 0/3 | 433.7s |
| #175 | Dots 3 Note Preview low | Dots Studio | 3.6 | 6.4 | $0.000 | 0/3 | 49.5s |
| #178 | MiMo-V2.5 medium | Xiaomi | 3.6 | 6.4 | $0.104 | 0/3 | 137.7s |
| #180 | Ring-2.6-1T medium | Inclusionai | 3.6 | 6.4 | $0.102 | 0/3 | 65.3s |