AI BENCHY
Advertise here

AI BENCHY 分类

常识问答 排名

看看哪些 AI 模型在 常识问答 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 测试正确 ↑.

显示的模型数

11

常识问答 得分 平均值

2.9

排名 模型 公司 常识问答 得分 分数 测试正确 响应时间(平均)
#134 Nemotron 3 Nano Omni 30b A3b Reasoning none NVIDIA 0.0 4.6 0/0 0ms
#135 GPT-5.4 Nano none OpenAI 3.0 4.5 0/1 773ms
#136 GLM 4.7 Flash medium Z.ai 3.0 4.5 0/1 11.1s
#137 MiMo-V2-Flash none Xiaomi 3.0 4.5 0/1 1.82s
#138 Ling-2.6-1T none Inclusionai 0.0 4.5 0/0 0ms
#139 Grok 4.1 Fast none X AI 3.0 4.4 0/1 731ms
#140 Qwen3.5-9B medium Qwen 3.0 4.3 0/1 177.0s
#142 Granite 4.1 8B none IBM Granite 3.0 4.1 0/1 306ms
#1 Gemini 3 Flash Preview medium Google 10.0 10.0 1/1 5.50s
#2 Gemini 3.1 Pro Preview medium Google 10.0 9.6 1/1 6.27s
#7 Gemini 3 Flash Preview low Google 10.0 8.8 1/1 2.75s

按 常识问答 得分 排名的顶级模型

常识问答 得分 vs 总成本

按 响应时间(平均) 排名的顶级模型