领域专项 排名
看看哪些 AI 模型在 领域专项 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 响应时间(平均) ↓.
216/216
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 领域专项 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #54 | GPT-5.6 Luna medium | OpenAI | 5.3 | 7.6 | $0.352 | 1/3 | 17.4s |
| #146 | Nemotron 3 Super medium | NVIDIA | 2.9 | 5.7 | $0.055 | 0/3 | 16.2s |
| #3 | Gemini 3 Flash Preview medium | 10.0 | 9.6 | $0.742 | 3/3 | 15.3s | |
| #177 | North Mini Code none | Cohere | 3.0 | 5.1 | $0.000 | 0/3 | 14.7s |
| #89 | Qwen3.6 Flash medium | Qwen | 3.5 | 6.9 | $0.738 | 0/3 | 14.6s |
| #17 | Claude Opus 4.8 medium | Anthropic | 5.3 | 8.8 | $1.931 | 1/3 | 14.6s |
| #4 | Gemini 3.5 Flash high | 7.6 | 9.5 | $1.976 | 2/3 | 14.1s | |
| #58 | GPT-5.3 Chat none | OpenAI | 3.5 | 7.5 | $0.571 | 0/3 | 13.0s |
| #1 | Gemini 3.6 Flash medium | 8.2 | 9.9 | $0.831 | 2/3 | 12.6s | |
| #204 | Laguna Xs.2 medium | Poolside | 4.1 | 4.1 | $0.015 | 0/3 | 11.1s |
| #83 | Gemini 3.5 Flash none | 7.6 | 7.0 | $1.079 | 2/3 | 10.6s | |
| #190 | Hunter Alpha medium | OpenRouter | 3.0 | 4.7 | $0.000 | 0/3 | 10.5s |
| #123 | GPT-5.6 Luna low | OpenAI | 3.6 | 6.2 | $0.249 | 0/3 | 10.0s |
| #115 | Mimo V2 PRO medium | Xiaomi | 5.3 | 6.3 | $0.333 | 1/3 | 8.82s |
| #152 | Owl Alpha medium | Openrouter | 5.3 | 5.6 | $0.000 | 1/3 | 8.58s |