领域专项 排名
看看哪些 AI 模型在 领域专项 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 响应时间(平均) ↑.
316/316
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 领域专项 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #73 | Step 3.7 Flash medium | Stepfun | 5.3 | 7.9 | $0.495 | 1/3 | 27.3s |
| #189 | gpt-oss-120b medium | OpenAI | 2.9 | 6.1 | $0.020 | 0/3 | 27.6s |
| #16 | GPT-5.5 low | OpenAI | 5.3 | 9.3 | $1.257 | 1/3 | 28.2s |
| #49 | Muse Spark 1.2 low | Meta | 5.3 | 8.4 | $0.655 | 1/3 | 28.5s |
| #179 | Ling-3.0-flash high | Inclusionai | 3.0 | 6.4 | $0.021 | 0/3 | 30.3s |
| #14 | GPT-6 Astra medium | OpenAI | 5.9 | 9.4 | $1.774 | 1/3 | 30.6s |
| #8 | GPT-5.6 Sol low | OpenAI | 5.3 | 9.5 | $0.357 | 1/3 | 31.0s |
| #69 | Inkling medium | Thinkingmachines | 5.3 | 8.0 | $0.383 | 1/3 | 31.6s |
| #22 | Gemini 3.8 Flash medium | 8.2 | 9.1 | $0.653 | 2/3 | 31.8s | |
| #56 | Muse Spark 1.1 low | Meta | 3.6 | 8.3 | $0.673 | 0/3 | 33.0s |
| #1 | Gemini 3.6 Flash high | 8.2 | 9.9 | $0.699 | 2/3 | 33.3s | |
| #84 | Qwen3.7 Flash high | Qwen | 2.9 | 7.8 | $0.052 | 0/3 | 34.4s |
| #315 | Step 3.5 Flash none | Stepfun | 3.3 | 2.3 | $0.020 | 1/1 | 34.5s |
| #312 | gpt-oss-120b none | OpenAI | 3.0 | 3.7 | $0.010 | 0/3 | 35.0s |
| #140 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 2.9 | 6.9 | $0.478 | 0/3 | 35.1s |