नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.4 Nano (medium) vs Qwen3.5-27B (medium)

GPT-5.4 Nano (medium) average score मध्ये पुढे आहे: 7.5 vs 7.4. GPT-5.4 Nano (medium) चा benchmark खर्च कमी आहे: $0.138 vs $0.981. GPT-5.4 Nano (medium) वेगवान आहे: 13.24s vs 111.94s, pass rates 65.2% vs 72.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

क्रमांक
#61
एकूण आउटपुट टोकन्स
97,122
प्रतिसाद वेळ (सरासरी)
13.24s
एकूण खर्च
$0.138
क्रमांक
#66
एकूण आउटपुट टोकन्स
614,429
प्रतिसाद वेळ (सरासरी)
111.94s
एकूण खर्च
$0.981
शिफारस केलेले मॉडेल GPT-5.4 Nano (medium)

It has the best score here (7.5), while costing about 7.1x less than Qwen3.5-27B (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.4 Nano GPT-5.4 Nano medium प्रकाशन: 2026-03-17 Qwen3.5-27B Qwen3.5-27B medium प्रकाशन: 2026-02-24
स्कोअर 7.5 7.4
क्रमांक #61 #66
विश्वसनीयता 10.0 10.0
सुसंगतता 8.5 8.2
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 72.7%
अस्थिर चाचण्या 4 5
एकूण रन 66 66
प्रति निकाल खर्च 1.150 8.324
एकूण खर्च $0.138 $0.981
इनपुट किंमत $0.200 / 1M $0.195 / 1M
आउटपुट किंमत $1.250 / 1M $1.560 / 1M
एकूण इनपुट टोकन्स 82,819 111,635
आउटपुट टोकन्स 7,100 15,999
रिझनिंग टोकन्स 90,022 598,430
प्रतिसाद वेळ (सरासरी) 13.24s 111.94s
प्रतिसाद वेळ (कमाल) 94.06s 1026.43s
प्रतिसाद वेळ (एकूण) 291.33s 2462.67s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#61 GPT-5.4 Nano

medium
खर्च
$0.007
वेळ
24.6s
टोकन्स
4,943 tok

#66 Qwen3.5-27B

medium
खर्च
$0.008
वेळ
62.0s
टोकन्स
3,099 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388

झटपट तुलना

तुलना जोडी बदला