AI BENCHY Compare

OpenAI: GPT-5.5 vs Qwen: Qwen3.5-9B

सारांश

GPT-5.5 vs Qwen3.5-9B benchmark तुलना: GPT-5.5 average score मध्ये पुढे आहे: 9.3 vs 3.8. Qwen3.5-9B चा benchmark खर्च कमी आहे: $0.036 vs $0.907. GPT-5.5 वेगवान आहे: 9.76s vs 82.24s, pass rates 85.7% vs 27.0%.

शिफारस केलेले मॉडेल: GPT-5.5 - It has the best score here (9.3), while responding about 8.4x faster than Qwen3.5-9B.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-18

मेट्रिक	GPT-5.5 GPT-5.5 low प्रकाशन: 2026-04-24	Qwen3.5-9B Qwen3.5-9B medium प्रकाशन: 2026-03-02

मेट्रिक	GPT-5.5 GPT-5.5 low प्रकाशन: 2026-04-24	Qwen3.5-9B Qwen3.5-9B medium प्रकाशन: 2026-03-02
स्कोअर	9.3	3.8
क्रमांक	#4	#165
विश्वसनीयता	10.0	6.7
सुसंगतता	10.0	8.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर	85.7%	27.0%
अस्थिर चाचण्या	0	5
एकूण रन	63	63
प्रति निकाल खर्च	5.035	1.187
एकूण खर्च	$0.907	$0.036
इनपुट किंमत	$5.000 / 1M	$0.100 / 1M
आउटपुट किंमत	$30.000 / 1M	$0.150 / 1M
एकूण इनपुट टोकन्स	34,209	17,070
आउटपुट टोकन्स	2,046	29,045
रिझनिंग टोकन्स	22,460	209,516
प्रतिसाद वेळ (सरासरी)	9.76s	82.24s
प्रतिसाद वेळ (कमाल)	56.19s	226.38s
प्रतिसाद वेळ (एकूण)	204.92s	1315.88s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#4 GPT-5.5

low

खर्च: $0.068
वेळ: 37.0s
टोकन्स: 2,339 tok

#165 Qwen3.5-9B

medium

खर्च: $0.001
वेळ: 35.9s
टोकन्स: 3,030 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	इनपुट टोकन्स	आउटपुट टोकन्स	रिझनिंग टोकन्स
GPT-5.5	10.0	10.0	100.0%	0		4.41s	606	238	1,020
Qwen3.5-9B	5.1	5.8	50.0%	2		34.44s	369	2,621	12,411

कोडिंग	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	इनपुट टोकन्स	आउटपुट टोकन्स	रिझनिंग टोकन्स
GPT-5.5	10.0	10.0	100.0%	0		15.04s	7,302	423	6,402
Qwen3.5-9B	2.9	10.0	0.0%	0		100.88s	2,396	7,890	41,129

संयुक्त	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	इनपुट टोकन्स	आउटपुट टोकन्स	रिझनिंग टोकन्स
GPT-5.5	10.0	10.0	100.0%	0		9.56s	11,019	303	717
Qwen3.5-9B	3.0	10.0	0.0%	0		0ms	0	0	0

डेटा पार्सिंग आणि निष्कर्षण	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	इनपुट टोकन्स	आउटपुट टोकन्स	रिझनिंग टोकन्स
GPT-5.5	10.0	10.0	100.0%	0		3.28s	7,140	228	157
Qwen3.5-9B	3.6	5.6	33.3%	1		87.31s	4,722	1,383	32,113

डोमेन-विशिष्ट	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	इनपुट टोकन्स	आउटपुट टोकन्स	रिझनिंग टोकन्स
GPT-5.5	5.3	10.0	33.3%	0		28.05s	723	69	11,609
Qwen3.5-9B	3.6	7.2	22.2%	1		137.75s	295	11,549	48,475

Samanya Buddhimatta	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	इनपुट टोकन्स	आउटपुट टोकन्स	रिझनिंग टोकन्स
GPT-5.5	10.0	10.0	100.0%	0		5.17s	477	133	245
Qwen3.5-9B	2.8	1.6	33.3%	1		226.38s	180	0	30,695

सूचनांचे पालन	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	इनपुट टोकन्स	आउटपुट टोकन्स	रिझनिंग टोकन्स
GPT-5.5	9.9	10.0	100.0%	0		3.74s	660	93	415
Qwen3.5-9B	6.5	10.0	50.0%	0		5.75s	381	491	1,824

कोडी सोडवणे	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	इनपुट टोकन्स	आउटपुट टोकन्स	रिझनिंग टोकन्स
GPT-5.5	10.0	10.0	100.0%	0		4.74s	642	279	954
Qwen3.5-9B	3.0	10.0	0.0%	0		32.27s	376	1,593	12,026

टूल कॉलिंग	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	इनपुट टोकन्स	आउटपुट टोकन्स	रिझनिंग टोकन्स
GPT-5.5	10.0	10.0	100.0%	0		4.96s	5,445	250	101
Qwen3.5-9B	10.0	10.0	100.0%	0		4.31s	8,283	444	1,149

सामान्य ज्ञान	स्कोअर	सुसंगतता	प्रति प्रयत्न पास दर	अस्थिर चाचण्या	बरोबर चाचण्या	प्रतिसाद वेळ (सरासरी)	इनपुट टोकन्स	आउटपुट टोकन्स	रिझनिंग टोकन्स
GPT-5.5	3.0	10.0	0.0%	0		10.06s	195	30	840
Qwen3.5-9B	3.0	10.0	0.0%	0		177.02s	68	3,074	29,694

झटपट तुलना

तुलना जोडी बदला

GPT-5.5lowvsQwen3.7 Maxmedium Claude Fable 5mediumvsGPT-5.5low Gemini 3.1 Pro PreviewmediumvsGPT-5.5low Gemini 3.5 FlashmediumvsGPT-5.5low gpt-oss-120bnoneमोफत उपलब्धvsQwen3.5-9Bmedium Granite 4.1 8BnonevsQwen3.5-9Bmedium Gemini 3 Flash PreviewmediumvsGPT-5.5low GPT-5.5lowvsQwen3.6 Max Previewmedium Claude Opus 4.8mediumvsGPT-5.5low Gemini 3.5 FlashhighvsGPT-5.5low Qwen3.5-9BmediumvsGrok 4.20none Claude Opus 4.7mediumvsGPT-5.5low