नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.4 Mini (medium) vs Qwen3.5-27B (medium)

average score जवळपास समान आहे: 7.5 vs 7.4. GPT-5.4 Mini (medium) चा benchmark खर्च कमी आहे: $0.756 vs $0.981. GPT-5.4 Mini (medium) वेगवान आहे: 25.94s vs 111.94s, pass rates 71.2% vs 72.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-01

क्रमांक
#69
एकूण आउटपुट टोकन्स
151,755
प्रतिसाद वेळ (सरासरी)
25.94s
एकूण खर्च
$0.756
क्रमांक
#71
एकूण आउटपुट टोकन्स
614,429
प्रतिसाद वेळ (सरासरी)
111.94s
एकूण खर्च
$0.981
शिफारस केलेले मॉडेल GPT-5.4 Mini (medium)

It has the best score here (7.5), while responding about 4.3x faster than Qwen3.5-27B (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.4 Mini GPT-5.4 Mini medium प्रकाशन: 2026-03-17 Qwen3.5-27B Qwen3.5-27B medium प्रकाशन: 2026-02-24
स्कोअर 7.5 7.4
क्रमांक #69 #71
विश्वसनीयता 10.0 10.0
सुसंगतता 7.7 8.2
बरोबर चाचण्या
प्रति प्रयत्न पास दर 71.2% 72.7%
अस्थिर चाचण्या 6 5
एकूण रन 66 66
प्रति निकाल खर्च 6.299 8.324
एकूण खर्च $0.756 $0.981
इनपुट किंमत $0.750 / 1M $0.195 / 1M
आउटपुट किंमत $4.500 / 1M $1.560 / 1M
एकूण इनपुट टोकन्स 97,155 111,635
आउटपुट टोकन्स 6,211 15,999
रिझनिंग टोकन्स 145,544 598,430
प्रतिसाद वेळ (सरासरी) 25.94s 111.94s
प्रतिसाद वेळ (कमाल) 138.75s 1026.43s
प्रतिसाद वेळ (एकूण) 570.66s 2462.67s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#69 GPT-5.4 Mini

medium
खर्च
$0.056
वेळ
95.5s
टोकन्स
12,464 tok

#71 Qwen3.5-27B

medium
खर्च
$0.008
वेळ
62.0s
टोकन्स
3,099 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388

झटपट तुलना

तुलना जोडी बदला