सामान्य ज्ञान मॉडल रैंकिंग

AI BENCHY श्रेणी

देखें कि सामान्य ज्ञान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।

दिखाए गए मॉडल

औसत सामान्य ज्ञान स्कोर

3.1

सर्वश्रेष्ठ मॉडल

Gemini 3.5 Flash 10.0

विफलता के कारण

विफलता कारण गलत उत्तर के साथ133 विफलता कारण API त्रुटि के साथ13 विफलता कारण कोई उत्तर नहीं के साथ8

169/169

रैंक	मॉडल	कंपनी	सामान्य ज्ञान स्कोर	स्कोर	कुल लागत	सही परीक्षण	प्रतिक्रिया समय (औसत)
#17	GPT-5.4 medium	OpenAI	3.0	8.5	$1.210	0/1	14.0s
कुल टेस्ट 1 गलत टेस्ट 1 कुल लागत $1.210 प्रतिक्रिया समय (औसत) 14.0s
#18	Seed-2.0-Lite medium	Bytedance Seed	3.0	8.5	$0.175	0/1	48.3s
कुल टेस्ट 1 गलत टेस्ट 1 कुल लागत $0.175 प्रतिक्रिया समय (औसत) 48.3s
#19	GPT-5.2 Chat none	OpenAI	3.0	8.5	$0.393	0/1	6.89s
कुल टेस्ट 1 गलत टेस्ट 1 कुल लागत $0.393 प्रतिक्रिया समय (औसत) 6.89s
#20	Step 3.7 Flash medium	Stepfun	3.0	8.5	$0.376	0/1	114.0s
कुल टेस्ट 1 गलत टेस्ट 1 कुल लागत $0.376 प्रतिक्रिया समय (औसत) 114.0s
#21	GLM 5 Turbo medium	Z.ai	3.0	8.4	$0.323	0/1	40.2s
कुल टेस्ट 1 गलत टेस्ट 1 कुल लागत $0.323 प्रतिक्रिया समय (औसत) 40.2s
#22	GPT-5.2 medium	OpenAI	3.0	8.4	$0.548	0/1	28.2s
कुल टेस्ट 1 गलत टेस्ट 1 कुल लागत $0.548 प्रतिक्रिया समय (औसत) 28.2s
#23	DeepSeek V4 Flash high	DeepSeek	3.0	8.3	$0.027	0/1	54.5s
कुल टेस्ट 1 गलत टेस्ट 1 कुल लागत $0.027 प्रतिक्रिया समय (औसत) 54.5s
#24	Gemini 2.5 Flash medium	Google	3.0	8.2	$0.379	0/1	2.76s
कुल टेस्ट 1 गलत टेस्ट 1 कुल लागत $0.379 प्रतिक्रिया समय (औसत) 2.76s
#25	Qwen3.7 Plus medium	Qwen	3.0	8.2	$0.177	0/1	91.1s
कुल टेस्ट 1 गलत टेस्ट 1 कुल लागत $0.177 प्रतिक्रिया समय (औसत) 91.1s
#26	Nemotron 3 Ultra 550b A55b medium	NVIDIA	3.0	8.1	$0.158	0/1	38.5s
कुल टेस्ट 1 गलत टेस्ट 1 कुल लागत $0.158 प्रतिक्रिया समय (औसत) 38.5s
#27	GPT-5.4 Mini medium	OpenAI	3.0	8.0	$0.526	0/1	30.1s
कुल टेस्ट 1 गलत टेस्ट 1 कुल लागत $0.526 प्रतिक्रिया समय (औसत) 30.1s
#28	Qwen3.5 Plus 2026-02-15 medium	Qwen	3.0	8.0	$0.310	0/1	103.8s
कुल टेस्ट 1 गलत टेस्ट 1 कुल लागत $0.310 प्रतिक्रिया समय (औसत) 103.8s
#29	Qwen3.5-27B medium	Qwen	3.0	7.9	$0.536	0/1	85.1s
कुल टेस्ट 1 गलत टेस्ट 1 कुल लागत $0.536 प्रतिक्रिया समय (औसत) 85.1s
#30	Qwen3.6 Plus medium	Qwen	3.0	7.8	$0.294	0/1	47.5s
कुल टेस्ट 1 गलत टेस्ट 1 कुल लागत $0.294 प्रतिक्रिया समय (औसत) 47.5s
#31	Claude Sonnet 4.6 medium	Anthropic	3.0	7.8	$1.418	0/1	30.1s
कुल टेस्ट 1 गलत टेस्ट 1 कुल लागत $1.418 प्रतिक्रिया समय (औसत) 30.1s

सामान्य ज्ञान रैंकिंग

मॉडल फ़िल्टर करें

सामान्य ज्ञान स्कोर के अनुसार शीर्ष मॉडल

सामान्य ज्ञान स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत) के अनुसार शीर्ष मॉडल