नेविगेशन
Advertise here

GPT-5.4 Mini (medium) vs Qwen3.5-27B (medium)

average score लगभग बराबर है: 7.5 vs 7.5. GPT-5.4 Mini (medium) की benchmark लागत कम है: $0.786 vs $0.982. GPT-5.4 Mini (medium) तेज है: 26.72s vs 113.28s, pass rates 68.2% vs 75.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-10

तुलना किए गए मॉडल

रैंक
#109
कुल आउटपुट टोकन
158,344
प्रतिक्रिया समय (औसत)
26.72s
कुल लागत
$0.786
रैंक
#107
कुल आउटपुट टोकन
614,909
प्रतिक्रिया समय (औसत)
113.28s
कुल लागत
$0.982
अनुशंसित मॉडल GPT-5.4 Mini (medium)

It has the best score here (7.5), while responding about 4.2x faster than Qwen3.5-27B (medium).

विस्तृत तुलना

मेट्रिक GPT-5.4 Mini GPT-5.4 Mini medium रिलीज़: 2026-03-17 Qwen3.5-27B Qwen3.5-27B medium रिलीज़: 2026-02-24
स्कोर 7.5 7.5
रैंक #109 #107
विश्वसनीयता 10.0 10.0
संगति 8.1 7.8
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 68.2% 75.8%
अस्थिर टेस्ट 5 6
कुल रन 66 66
प्रति परिणाम लागत 6.546 8.217
कुल लागत $0.786 $0.982
इनपुट कीमत $0.750 / 1M $0.195 / 1M
आउटपुट कीमत $4.500 / 1M $1.560 / 1M
कुल इनपुट टोकन 97,164 111,644
आउटपुट टोकन 6,211 16,113
रीजनिंग टोकन 152,133 598,796
प्रतिक्रिया समय (औसत) 26.72s 113.28s
प्रतिक्रिया समय (अधिकतम) 138.75s 1026.43s
प्रतिक्रिया समय (कुल) 587.90s 2492.26s
पैरामीटर ~400B कुल (~17B सक्रिय) 27B
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#109 GPT-5.4 Mini

medium
लागत
$0.056
समय
95.5s
टोकन
12,464 tok

#107 Qwen3.5-27B

medium
लागत
$0.008
समय
62.0s
टोकन
3,099 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388

त्वरित तुलना

तुलना जोड़ी बदलें