常识问答 排名
看看哪些 AI 模型在 常识问答 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 响应时间(平均) ↑.
364/364
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 常识问答 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #227 | Gemini 3.1 Flash Lite none | 3.0 | 6.1 | $0.046 | 0/1 | 733ms | |
| #226 | Qwen3.7 Flash none | Qwen | 3.0 | 6.1 | $0.019 | 0/1 | 766ms |
| #317 | GPT-5.4 Nano none | OpenAI | 3.0 | 4.8 | $0.041 | 0/1 | 773ms |
| #322 | Trinity Large Preview none | Arcee AI | 3.0 | 4.8 | $0.008 | 0/1 | 777ms |
| #266 | Gemma 4 26B A4B none | 3.0 | 5.6 | $0.017 | 0/1 | 778ms | |
| #300 | Mercury 2.5 low | Inception | 3.0 | 5.1 | $0.011 | 0/1 | 782ms |
| #238 | GPT-5.6 Terra none | OpenAI | 3.0 | 6.0 | $0.280 | 0/1 | 787ms |
| #309 | GPT-4o-mini none | OpenAI | 3.0 | 5.0 | $0.010 | 0/1 | 794ms |
| #205 | Gemini 3.1 Flash Lite Preview none | 3.0 | 6.4 | $0.052 | 0/1 | 814ms | |
| #129 | Qwen3.7 Max none | Qwen | 3.0 | 7.4 | $0.197 | 0/1 | 856ms |
| #292 | Dots 3 Note Preview none | Dots Studio | 3.0 | 5.2 | $0.000 | 0/1 | 961ms |
| #343 | Ling 3.0 Tiny none | Inclusionai | 3.0 | 4.0 | $0.000 | 0/1 | 988ms |
| #251 | GPT-5.4 none | OpenAI | 3.0 | 5.8 | $0.397 | 0/1 | 990ms |
| #312 | Ling-2.6-flash none | Inclusionai | 3.0 | 4.9 | $0.002 | 0/1 | 1.06s |
| #184 | Gemini 3 Flash Preview none | 3.0 | 6.8 | $0.085 | 0/1 | 1.07s |