常识问答 排名
看看哪些 AI 模型在 常识问答 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 测试正确 ↓.
364/364
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 常识问答 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #1 | Gemini 3.6 Flash high | 10.0 | 9.9 | $0.699 | 1/1 | 6.35s | |
| #2 | Gemini 3.8 Flash high | 10.0 | 9.9 | $1.595 | 1/1 | 10.3s | |
| #3 | GPT-6 Sol high | OpenAI | 10.0 | 9.9 | $0.684 | 1/1 | 8.02s |
| #4 | GPT-6 Astra max | OpenAI | 10.0 | 9.9 | $3.803 | 1/1 | 8.91s |
| #5 | GPT-6 Astra high | OpenAI | 10.0 | 9.9 | $3.474 | 1/1 | 5.83s |
| #6 | GPT-6 Astra xhigh | OpenAI | 10.0 | 9.9 | $5.156 | 1/1 | 14.1s |
| #7 | Gemini 3.7 Flash high | 10.0 | 9.8 | $0.646 | 1/1 | 5.60s | |
| #8 | Gemini 3.6 Flash medium | 10.0 | 9.8 | $0.427 | 1/1 | 5.48s | |
| #9 | GPT-5.6 Sol low | OpenAI | 10.0 | 9.5 | $0.357 | 1/1 | 3.67s |
| #11 | Gemini 3 Flash Preview medium | 10.0 | 9.5 | $0.763 | 1/1 | 5.50s | |
| #12 | Gemini 3.5 Flash high | 10.0 | 9.4 | $2.011 | 1/1 | 3.94s | |
| #13 | Gemini 3.7 Flash medium | 10.0 | 9.4 | $0.309 | 1/1 | 4.04s | |
| #14 | GPT-6 Sol medium | OpenAI | 10.0 | 9.4 | $0.448 | 1/1 | 4.61s |
| #22 | Gemini 3.1 Pro Preview medium | 10.0 | 9.2 | $1.352 | 1/1 | 6.27s | |
| #23 | Gemini 3.7 Flash low | 10.0 | 9.2 | $0.207 | 1/1 | 2.92s |