OpenAI: GPT-5.4 Mini vs Qwen: Qwen3.7 Max

average score लगभग बराबर है: 7.5 vs 7.4. Qwen3.7 Max की benchmark लागत कम है: $0.197 vs $0.756. Qwen3.7 Max तेज है: 4.52s vs 25.94s, pass rates 71.2% vs 68.2%.

अनुशंसित मॉडलQwen3.7 MaxIt has the best score here (7.4), while costing about 3.8x less than GPT-5.4 Mini (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक	GPT-5.4 Mini GPT-5.4 Mini medium रिलीज़: 2026-03-17	Qwen3.7 Max Qwen3.7 Max none रिलीज़: 2026-05-22

मेट्रिक	GPT-5.4 Mini GPT-5.4 Mini medium रिलीज़: 2026-03-17	Qwen3.7 Max Qwen3.7 Max none रिलीज़: 2026-05-22
स्कोर	7.5	7.4
रैंक	#64	#67
विश्वसनीयता	10.0	9.9
संगति	7.7	10.0
सही परीक्षण
प्रति प्रयास पास दर	71.2%	68.2%
अस्थिर टेस्ट	6	0
कुल रन	66	66
प्रति परिणाम लागत	6.299	1.582
कुल लागत	$0.756	$0.197
इनपुट कीमत	$0.750 / 1M	$1.475 / 1M
आउटपुट कीमत	$4.500 / 1M	$4.425 / 1M
कुल इनपुट टोकन	97,155	95,983
आउटपुट टोकन	6,211	12,446
रीजनिंग टोकन	145,544	0
प्रतिक्रिया समय (औसत)	25.94s	4.52s
प्रतिक्रिया समय (अधिकतम)	138.75s	72.30s
प्रतिक्रिया समय (कुल)	570.66s	99.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#64 GPT-5.4 Mini

medium

लागत: $0.056
समय: 95.5s
टोकन: 12,464 tok

#67 Qwen3.7 Max

none

लागत: $0.046
समय: 195.0s
टोकन: 12,171 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

श्रेणी:

एंटी-एआई ट्रिक्स	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.4 Mini	8.6	7.9	91.7%	1		4.05s	606	296	2,876
Qwen3.7 Max	6.5	10.0	50.0%	0		1.08s	696	242	0

कोडिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.4 Mini	8.4	7.4	88.9%	1		57.87s	7,305	467	40,902
Qwen3.7 Max	5.5	10.0	33.3%	0		1.35s	7,911	582	0

संयुक्त	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.4 Mini	6.9	5.9	66.7%	1		59.64s	74,058	4,347	40,924
Qwen3.7 Max	6.5	10.0	50.0%	0		37.23s	68,425	10,623	0

डेटा पार्सिंग और निष्कर्षण	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.4 Mini	10.0	10.0	100.0%	0		2.43s	7,140	234	650
Qwen3.7 Max	10.0	10.0	100.0%	0		1.35s	7,794	243	0

डोमेन-विशिष्ट	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.4 Mini	4.1	4.4	44.5%	2		65.31s	619	60	43,286
Qwen3.7 Max	7.7	10.0	66.7%	0		975ms	789	15	0

Samanya Buddhimatta	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.4 Mini	4.5	10.0	0.0%	0		3.72s	477	150	510
Qwen3.7 Max	10.0	10.0	100.0%	0		1.04s	522	120	0

निर्देश पालन	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.4 Mini	9.8	10.0	100.0%	0		2.13s	660	96	1,185
Qwen3.7 Max	10.0	10.0	100.0%	0		943ms	711	72	0

पहेली समाधान	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.4 Mini	7.8	10.0	66.7%	0		4.37s	642	278	2,443
Qwen3.7 Max	10.0	10.0	100.0%	0		1.13s	714	314	0

टूल कॉलिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.4 Mini	4.7	1.6	66.7%	1		9.62s	5,453	251	2,594
Qwen3.7 Max	10.0	10.0	100.0%	0		3.92s	8,211	222	0

सामान्य ज्ञान	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.4 Mini	3.0	10.0	0.0%	0		30.10s	195	32	10,174
Qwen3.7 Max	3.0	10.0	0.0%	0		856ms	210	13	0

त्वरित तुलना

तुलना जोड़ी बदलें

LongCat 2.0mediumvsQwen3.7 Maxnone GPT-5.6 TerralowvsQwen3.7 Maxnone Claude Opus 5nonevsGPT-5.4 Minimedium Gemini 3 Flash PreviewlowvsQwen3.7 Maxnone KAT-Coder-Pro V2.5lowvsQwen3.7 Maxnone GPT-5.4 NanomediumvsQwen3.7 Maxnone Kimi K2.7 CodemediumvsQwen3.7 Maxnone Nemotron 3 Ultramediumनिःशुल्क उपलब्धvsQwen3.7 Maxnone Gemini 3 Flash PreviewlowvsGPT-5.4 Minimedium KAT-Coder-Pro V2.5lowvsGPT-5.4 Minimedium Gemini 3.1 Flash Lite PreviewmediumvsQwen3.7 Maxnone GPT-5.6 LunamediumvsQwen3.7 Maxnone