नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.4 Mini (medium) vs Qwen3.5 Plus 2026-02-15 (medium)

average score जवळपास समान आहे: 7.5 vs 7.5. Qwen3.5 Plus 2026-02-15 (medium) चा benchmark खर्च कमी आहे: $0.437 vs $0.756. GPT-5.4 Mini (medium) वेगवान आहे: 25.94s vs 89.19s, pass rates 71.2% vs 71.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-01

क्रमांक
#69
एकूण आउटपुट टोकन्स
151,755
प्रतिसाद वेळ (सरासरी)
25.94s
एकूण खर्च
$0.756
क्रमांक
#70
एकूण आउटपुट टोकन्स
260,704
प्रतिसाद वेळ (सरासरी)
89.19s
एकूण खर्च
$0.437
शिफारस केलेले मॉडेल GPT-5.4 Mini (medium)

It has the best score here (7.5), while responding about 3.4x faster than Qwen3.5 Plus 2026-02-15 (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.4 Mini GPT-5.4 Mini medium प्रकाशन: 2026-03-17 Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium प्रकाशन: 2026-02-15
स्कोअर 7.5 7.5
क्रमांक #69 #70
विश्वसनीयता 10.0 10.0
सुसंगतता 7.7 8.5
बरोबर चाचण्या
प्रति प्रयत्न पास दर 71.2% 71.2%
अस्थिर चाचण्या 6 4
एकूण रन 66 66
प्रति निकाल खर्च 6.299 3.348
एकूण खर्च $0.756 $0.437
इनपुट किंमत $0.750 / 1M $0.260 / 1M
आउटपुट किंमत $4.500 / 1M $1.560 / 1M
एकूण इनपुट टोकन्स 97,155 113,560
आउटपुट टोकन्स 6,211 9,823
रिझनिंग टोकन्स 145,544 250,881
प्रतिसाद वेळ (सरासरी) 25.94s 89.19s
प्रतिसाद वेळ (कमाल) 138.75s 304.85s
प्रतिसाद वेळ (एकूण) 570.66s 1337.92s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#69 GPT-5.4 Mini

medium
खर्च
$0.056
वेळ
95.5s
टोकन्स
12,464 tok

#70 Qwen3.5 Plus 2026-02-15

medium
खर्च
$0.011
वेळ
125.5s
टोकन्स
7,040 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902
Qwen3.5 Plus 2026-02-15 6.6 7.1 44.4% 1 180.70s 6,950 420 80,595

झटपट तुलना

तुलना जोडी बदला