नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.4 Mini (medium) vs Qwen3.5-27B (medium)

average score लगभग बराबर है: 7.5 vs 7.4. GPT-5.4 Mini (medium) की benchmark लागत कम है: $0.756 vs $0.981. GPT-5.4 Mini (medium) तेज है: 25.94s vs 111.94s, pass rates 71.2% vs 72.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-01

रैंक
#69
कुल आउटपुट टोकन
151,755
प्रतिक्रिया समय (औसत)
25.94s
कुल लागत
$0.756
रैंक
#71
कुल आउटपुट टोकन
614,429
प्रतिक्रिया समय (औसत)
111.94s
कुल लागत
$0.981
अनुशंसित मॉडल GPT-5.4 Mini (medium)

It has the best score here (7.5), while responding about 4.3x faster than Qwen3.5-27B (medium).

विस्तृत तुलना

मेट्रिक GPT-5.4 Mini GPT-5.4 Mini medium रिलीज़: 2026-03-17 Qwen3.5-27B Qwen3.5-27B medium रिलीज़: 2026-02-24
स्कोर 7.5 7.4
रैंक #69 #71
विश्वसनीयता 10.0 10.0
संगति 7.7 8.2
सही परीक्षण
प्रति प्रयास पास दर 71.2% 72.7%
अस्थिर टेस्ट 6 5
कुल रन 66 66
प्रति परिणाम लागत 6.299 8.324
कुल लागत $0.756 $0.981
इनपुट कीमत $0.750 / 1M $0.195 / 1M
आउटपुट कीमत $4.500 / 1M $1.560 / 1M
कुल इनपुट टोकन 97,155 111,635
आउटपुट टोकन 6,211 15,999
रीजनिंग टोकन 145,544 598,430
प्रतिक्रिया समय (औसत) 25.94s 111.94s
प्रतिक्रिया समय (अधिकतम) 138.75s 1026.43s
प्रतिक्रिया समय (कुल) 570.66s 2462.67s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#69 GPT-5.4 Mini

medium
लागत
$0.056
समय
95.5s
टोकन
12,464 tok

#71 Qwen3.5-27B

medium
लागत
$0.008
समय
62.0s
टोकन
3,099 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388

त्वरित तुलना

तुलना जोड़ी बदलें