AI BENCHY तुलना

OpenAI: gpt-oss-120b vs Qwen: Qwen3.5-9B

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-03-12

मेट्रिक	gpt-oss-120b gpt-oss-120b medium रिलीज़: 2025-08-05 निःशुल्क उपलब्ध	Qwen3.5-9B Qwen3.5-9B none रिलीज़: 2026-03-02

मेट्रिक	gpt-oss-120b gpt-oss-120b medium रिलीज़: 2025-08-05 निःशुल्क उपलब्ध	Qwen3.5-9B Qwen3.5-9B none रिलीज़: 2026-03-02
रैंक	#43	#60
औसत स्कोर	5.1	3.4
संगति	7.4	10.0
प्रति परिणाम लागत	0.135	0.111
कुल लागत	$0.010	$0.005
सही परीक्षण
प्रति प्रयास पास दर	54.2%	25.0%
अस्थिर टेस्ट	5	0
कुल रन	48	48
आउटपुट टोकन	13,210	2,939
रीजनिंग टोकन	34,230	0
प्रतिक्रिया समय (औसत)	16.65s	1.06s
प्रतिक्रिया समय (अधिकतम)	50.92s	5.91s
प्रतिक्रिया समय (कुल)	149.88s	16.95s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

औसत स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

औसत स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
gpt-oss-120b	7.0	9.8	66.7%	0		19.76s	3,463	2,077
Qwen3.5-9B	10.0	9.9	0.0%	0		1.02s	576	0

संयुक्त	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
gpt-oss-120b	10.0	10.0	100.0%	0		31.18s	694	5,072
Qwen3.5-9B	10.0	10.0	0.0%	0		5.91s	1,255	0

डेटा पार्सिंग और निष्कर्षण	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
gpt-oss-120b	5.5	5.9	66.7%	1		1.98s	241	1,114
Qwen3.5-9B	9.9	10.0	100.0%	0		847ms	249	0

डोमेन-विशिष्ट	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
gpt-oss-120b	10.0	4.4	22.2%	2		50.92s	6,784	20,606
Qwen3.5-9B	10.0	10.0	0.0%	0		464ms	24	0

Samanya Buddhimatta	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
gpt-oss-120b	3.0	10.0	0.0%	0		7.90s	107	387
Qwen3.5-9B	3.0	9.9	0.0%	0		552ms	99	0

निर्देश पालन	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
gpt-oss-120b	9.5	10.0	100.0%	0		7.63s	126	1,799
Qwen3.5-9B	5.5	10.0	50.0%	0		514ms	75	0

Puzzle Solving	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
gpt-oss-120b	1.7	4.7	22.2%	2		11.80s	1,508	2,092
Qwen3.5-9B	10.0	9.9	0.0%	0		683ms	388	0

टूल कॉलिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
gpt-oss-120b	9.0	10.0	100.0%	0		6.91s	287	1,083
Qwen3.5-9B	10.0	10.0	100.0%	0		1.27s	273	0

त्वरित तुलना

तुलना जोड़ी बदलें

gpt-oss-120bmediumनिःशुल्क उपलब्धvsQwen3.5-122B-A10Bnone Gemini 2.5 Flashnonevsgpt-oss-120bmediumनिःशुल्क उपलब्ध gpt-oss-120bmediumनिःशुल्क उपलब्धvsQwen3.5-Flashnone Seed-2.0-Litenonevsgpt-oss-120bmediumनिःशुल्क उपलब्ध gpt-oss-120bmediumनिःशुल्क उपलब्धvsQwen3.5-27Bnone Qwen3.5-9BnonevsGLM 4.7 Flashmedium gpt-oss-120bmediumनिःशुल्क उपलब्धvsQwen3.5-35B-A3Bnone DeepSeek V3.2nonevsgpt-oss-120bmediumनिःशुल्क उपलब्ध gpt-oss-120bmediumनिःशुल्क उपलब्धvsHunter Alphanone gpt-oss-120bmediumनिःशुल्क उपलब्धvsGrok 4.20 Betanone Trinity Large Previewnoneनिःशुल्क उपलब्धvsgpt-oss-120bmediumनिःशुल्क उपलब्ध gpt-oss-120bmediumनिःशुल्क उपलब्धvsGLM 5none