AI BENCHY Compare

OpenAI: GPT-5 Nano vs Grok 4.20 Multi Agent Beta

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-04-04

मेट्रिक	GPT-5 Nano GPT-5 Nano medium प्रकाशन: 2025-08-07	Grok 4.20 Multi Agent Beta Grok 4.20 Multi Agent Beta medium प्रकाशन: 2026-03-12

मेट्रिक	GPT-5 Nano GPT-5 Nano medium प्रकाशन: 2025-08-07	Grok 4.20 Multi Agent Beta Grok 4.20 Multi Agent Beta medium प्रकाशन: 2026-03-12
स्कोअर	6.2	6.2
क्रमांक	#54	#55
सुसंगतता	6.7	7.2
बरोबर चाचण्या
प्रति प्रयत्न पास दर	58.8%	54.9%
अस्थिर चाचण्या	7	6
एकूण रन	51	51
प्रति निकाल खर्च	0.864	82.962
एकूण खर्च	$0.061	$4.978
???? ???	$0.050 / 1M	$0.000 / 1M
????? ???	$0.400 / 1M	$0.000 / 1M
आउटपुट टोकन्स	4,500	298,948
रिझनिंग टोकन्स	143,296	296,529
प्रतिसाद वेळ (सरासरी)	44.47s	8.64s
प्रतिसाद वेळ (कमाल)	204.02s	35.28s
प्रतिसाद वेळ (एकूण)	444.74s	129.64s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	आउटपुट टोकन्स	रिझनिंग टोकन्स
GPT-5 Nano	6.5	7.9	58.3%	1		25.50s	1,221	21,184
Grok 4.20 Multi Agent Beta	6.9	5.8	75.0%	2		3.46s	33,706	33,077

संयुक्त	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	आउटपुट टोकन्स	रिझनिंग टोकन्स
GPT-5 Nano	10.0	10.0	100.0%	0		65.96s	578	17,984
Grok 4.20 Multi Agent Beta	3.0	10.0	0.0%	0		0ms	0	0

डेटा पार्सिंग आणि निष्कर्षण	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	आउटपुट टोकन्स	रिझनिंग टोकन्स
GPT-5 Nano	3.7	1.7	50.0%	2		21.42s	453	10,560
Grok 4.20 Multi Agent Beta	10.0	10.0	100.0%	0		5.54s	25,306	25,051

डोमेन-विशिष्ट	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	आउटपुट टोकन्स	रिझनिंग टोकन्स
GPT-5 Nano	5.2	4.4	55.6%	2		204.02s	237	64,448
Grok 4.20 Multi Agent Beta	2.9	7.2	11.1%	1		24.67s	164,609	163,647

Samanya Buddhimatta	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	आउटपुट टोकन्स	रिझनिंग टोकन्स
GPT-5 Nano	4.1	10.0	0.0%	0		17.51s	202	4,608
Grok 4.20 Multi Agent Beta	5.8	2.8	66.7%	1		6.40s	15,848	15,746

सूचनांचे पालन	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	आउटपुट टोकन्स	रिझनिंग टोकन्स
GPT-5 Nano	8.5	6.8	83.3%	1		11.90s	382	4,096
Grok 4.20 Multi Agent Beta	8.3	10.0	50.0%	0		4.63s	25,457	25,322

Puzzle Solving	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	आउटपुट टोकन्स	रिझनिंग टोकन्स
GPT-5 Nano	5.3	7.2	44.4%	1		19.81s	869	13,440
Grok 4.20 Multi Agent Beta	7.2	5.1	77.8%	2		5.01s	34,022	33,686

टूल कॉलिंग	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	आउटपुट टोकन्स	रिझनिंग टोकन्स
GPT-5 Nano	10.0	10.0	100.0%	0		33.30s	558	6,976
Grok 4.20 Multi Agent Beta	3.0	10.0	0.0%	0		0ms	0	0

झटपट तुलना

तुलना जोडी बदला

Gemma 4 26B A4BnonevsGPT-5 Nanomedium Gemma 4 26B A4BnonevsGrok 4.20 Multi Agent Betamedium DeepSeek V3.2nonevsGPT-5 Nanomedium DeepSeek V3.2nonevsGrok 4.20 Multi Agent Betamedium GPT-5 NanomediumvsMiMo-V2-Omninone Qwen3.5-FlashnonevsGrok 4.20 Multi Agent Betamedium Grok 4.20 Multi Agent BetamediumvsMiMo-V2-Omninone GPT-5 NanomediumvsQwen3.5-Flashnone Grok 4.20 Multi Agent BetamediumvsGLM 5V Turbonone Seed-2.0-LitenonevsGrok 4.20 Multi Agent Betamedium GPT-5 NanomediumvsGLM 5V Turbonone Seed-2.0-LitenonevsGPT-5 Nanomedium