नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.4 Nano (medium) vs Qwen3.5-27B (medium)

GPT-5.4 Nano (medium) average score में आगे है: 7.5 vs 7.4. GPT-5.4 Nano (medium) की benchmark लागत कम है: $0.138 vs $0.981. GPT-5.4 Nano (medium) तेज है: 13.24s vs 111.94s, pass rates 65.2% vs 72.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#61
कुल आउटपुट टोकन
97,122
प्रतिक्रिया समय (औसत)
13.24s
कुल लागत
$0.138
रैंक
#66
कुल आउटपुट टोकन
614,429
प्रतिक्रिया समय (औसत)
111.94s
कुल लागत
$0.981
अनुशंसित मॉडल GPT-5.4 Nano (medium)

It has the best score here (7.5), while costing about 7.1x less than Qwen3.5-27B (medium).

विस्तृत तुलना

मेट्रिक GPT-5.4 Nano GPT-5.4 Nano medium रिलीज़: 2026-03-17 Qwen3.5-27B Qwen3.5-27B medium रिलीज़: 2026-02-24
स्कोर 7.5 7.4
रैंक #61 #66
विश्वसनीयता 10.0 10.0
संगति 8.5 8.2
सही परीक्षण
प्रति प्रयास पास दर 65.2% 72.7%
अस्थिर टेस्ट 4 5
कुल रन 66 66
प्रति परिणाम लागत 1.150 8.324
कुल लागत $0.138 $0.981
इनपुट कीमत $0.200 / 1M $0.195 / 1M
आउटपुट कीमत $1.250 / 1M $1.560 / 1M
कुल इनपुट टोकन 82,819 111,635
आउटपुट टोकन 7,100 15,999
रीजनिंग टोकन 90,022 598,430
प्रतिक्रिया समय (औसत) 13.24s 111.94s
प्रतिक्रिया समय (अधिकतम) 94.06s 1026.43s
प्रतिक्रिया समय (कुल) 291.33s 2462.67s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#61 GPT-5.4 Nano

medium
लागत
$0.007
समय
24.6s
टोकन
4,943 tok

#66 Qwen3.5-27B

medium
लागत
$0.008
समय
62.0s
टोकन
3,099 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388

त्वरित तुलना

तुलना जोड़ी बदलें