नेव्हिगेशन
AI BENCHY
Advertise here

OpenAI: GPT-4o-mini vs Qwen: Qwen3.5-9B

Qwen3.5-9B average score मध्ये पुढे आहे: 5.1 vs 5.0. GPT-4o-mini चा benchmark खर्च कमी आहे: $0.010 vs $0.021. GPT-4o-mini वेगवान आहे: 1.99s vs 19.17s, pass rates 22.7% vs 19.7%.

शिफारस केलेले मॉडेलGPT-4o-miniIts score stays close to the best score here (5.0 vs 5.1), while costing about 2.1x less than Qwen3.5-9B.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक GPT-4o-mini GPT-4o-mini none प्रकाशन: 2024-07-18 Qwen3.5-9B Qwen3.5-9B none प्रकाशन: 2026-03-02
स्कोअर 5.0 5.1
क्रमांक #189 #183
विश्वसनीयता 10.0 10.0
सुसंगतता 9.9 9.7
बरोबर चाचण्या
प्रति प्रयत्न पास दर 22.7% 19.7%
अस्थिर चाचण्या 0 1
एकूण रन 66 66
प्रति निकाल खर्च 0.195 0.490
एकूण खर्च $0.010 $0.021
इनपुट किंमत $0.150 / 1M $0.100 / 1M
आउटपुट किंमत $0.600 / 1M $0.150 / 1M
एकूण इनपुट टोकन्स 53,136 144,407
आउटपुट टोकन्स 2,911 37,484
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 1.99s 19.17s
प्रतिसाद वेळ (कमाल) 7.58s 382.06s
प्रतिसाद वेळ (एकूण) 29.86s 421.74s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#189 GPT-4o-mini

none
खर्च
$0.001
वेळ
6.6s
टोकन्स
742 tok

#183 Qwen3.5-9B

none
अवैध SVG
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0

झटपट तुलना

तुलना जोडी बदला