AI BENCHY तुलना

Google: Gemini 3.1 Flash Lite vs OpenAI: GPT-5.3 Chat

सारांश

Gemini 3.1 Flash Lite vs GPT-5.3 Chat benchmark तुलना: Gemini 3.1 Flash Lite average score में आगे है: 7.8 vs 7.5. Gemini 3.1 Flash Lite की benchmark लागत कम है: $0.071 vs $0.433. Gemini 3.1 Flash Lite तेज है: 3.23s vs 6.34s, pass rates 65.1% vs 66.7%.

अनुशंसित मॉडल: Gemini 3.1 Flash Lite - It has the best score here (7.8), while costing about 6.2x less than GPT-5.3 Chat.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-18

मेट्रिक	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite medium रिलीज़: 2026-05-08	GPT-5.3 Chat GPT-5.3 Chat none रिलीज़: 2026-03-03

मेट्रिक	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite medium रिलीज़: 2026-05-08	GPT-5.3 Chat GPT-5.3 Chat none रिलीज़: 2026-03-03
स्कोर	7.8	7.5
रैंक	#34	#45
विश्वसनीयता	10.0	10.0
संगति	9.2	8.1
सही परीक्षण
प्रति प्रयास पास दर	65.1%	66.7%
अस्थिर टेस्ट	2	5
कुल रन	63	63
प्रति परिणाम लागत	0.539	3.605
कुल लागत	$0.071	$0.433
इनपुट कीमत	$0.250 / 1M	$1.750 / 1M
आउटपुट कीमत	$1.500 / 1M	$14.000 / 1M
कुल इनपुट टोकन	36,808	34,209
आउटपुट टोकन	2,254	26,617
रीजनिंग टोकन	38,300	0
प्रतिक्रिया समय (औसत)	3.23s	6.34s
प्रतिक्रिया समय (अधिकतम)	10.87s	18.33s
प्रतिक्रिया समय (कुल)	67.80s	133.13s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#34 Gemini 3.1 Flash Lite

medium

लागत: $0.003
समय: 5.3s
टोकन: 1,754 tok

#45 GPT-5.3 Chat

none

लागत: $0.008
समय: 8.1s
टोकन: 634 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Gemini 3.1 Flash Lite	9.1	10.0	75.0%	0		2.39s	502	604	4,201
GPT-5.3 Chat	6.7	8.1	58.3%	1		3.86s	606	3,167	0

कोडिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Gemini 3.1 Flash Lite	5.5	10.0	33.3%	0		3.81s	8,134	459	8,978
GPT-5.3 Chat	5.6	4.7	55.6%	2		10.52s	7,302	6,632	0

संयुक्त	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		10.87s	12,873	327	7,401
GPT-5.3 Chat	10.0	10.0	100.0%	0		11.96s	11,019	2,614	0

डेटा पार्सिंग और निष्कर्षण	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		2.60s	7,362	279	2,845
GPT-5.3 Chat	10.0	10.0	100.0%	0		2.21s	7,140	942	0

डोमेन-विशिष्ट	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Gemini 3.1 Flash Lite	2.9	7.2	11.1%	1		3.16s	643	15	5,165
GPT-5.3 Chat	3.5	4.4	33.3%	2		13.01s	723	8,264	0

Samanya Buddhimatta	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		2.60s	488	84	1,142
GPT-5.3 Chat	4.6	10.0	0.0%	0		1.99s	477	319	0

निर्देश पालन	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Gemini 3.1 Flash Lite	9.9	10.0	100.0%	0		2.59s	623	75	3,320
GPT-5.3 Chat	9.8	10.0	100.0%	0		3.51s	660	1,491	0

पहेली समाधान	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Gemini 3.1 Flash Lite	7.6	7.2	77.8%	1		1.95s	568	165	2,450
GPT-5.3 Chat	10.0	10.0	100.0%	0		2.99s	642	1,758	0

टूल कॉलिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		4.55s	5,457	234	921
GPT-5.3 Chat	10.0	10.0	100.0%	0		8.36s	5,445	861	0

सामान्य ज्ञान	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Gemini 3.1 Flash Lite	3.0	10.0	0.0%	0		3.08s	158	12	1,877
GPT-5.3 Chat	3.0	10.0	0.0%	0		4.38s	195	569	0

त्वरित तुलना

तुलना जोड़ी बदलें

Mercury 2mediumvsGPT-5.3 Chatnone Kimi K2.5mediumvsGPT-5.3 Chatnone GPT-5.3 ChatnonevsQwen3.6 Flashmedium DeepSeek V3.2mediumvsGPT-5.3 Chatnone Gemini 3.1 Flash LitemediumvsStep 3.7 Flashlow GPT-5.3 ChatnonevsGrok Build 0.1medium DeepSeek V4 ProhighvsGPT-5.3 Chatnone Seed-2.0-MinimediumvsGPT-5.3 Chatnone GPT-5.3 ChatnonevsMiMo-V2.5-Promedium MiniMax M3mediumvsGPT-5.3 Chatnone Gemini 3 Flash PreviewlowvsGPT-5.3 Chatnone DeepSeek V4 ProhighvsGemini 3.1 Flash Litemedium