नेविगेशन
Advertise here

GPT-5.4 Nano (medium) vs Qwen3.5-27B (medium)

average score लगभग बराबर है: 7.5 vs 7.5. GPT-5.4 Nano (medium) की benchmark लागत कम है: $0.142 vs $0.982. GPT-5.4 Nano (medium) तेज है: 13.32s vs 113.28s, pass rates 65.2% vs 75.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-10

तुलना किए गए मॉडल

रैंक
#102
कुल आउटपुट टोकन
99,881
प्रतिक्रिया समय (औसत)
13.32s
कुल लागत
$0.142
रैंक
#107
कुल आउटपुट टोकन
614,909
प्रतिक्रिया समय (औसत)
113.28s
कुल लागत
$0.982
अनुशंसित मॉडल GPT-5.4 Nano (medium)

It has the best score here (7.5), while costing about 6.9x less than Qwen3.5-27B (medium).

विस्तृत तुलना

मेट्रिक GPT-5.4 Nano GPT-5.4 Nano medium रिलीज़: 2026-03-17 Qwen3.5-27B Qwen3.5-27B medium रिलीज़: 2026-02-24
स्कोर 7.5 7.5
रैंक #102 #107
विश्वसनीयता 10.0 10.0
संगति 8.5 7.8
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 65.2% 75.8%
अस्थिर टेस्ट 4 6
कुल रन 66 66
प्रति परिणाम लागत 1.179 8.217
कुल लागत $0.142 $0.982
इनपुट कीमत $0.200 / 1M $0.195 / 1M
आउटपुट कीमत $1.250 / 1M $1.560 / 1M
कुल इनपुट टोकन 82,828 111,644
आउटपुट टोकन 7,100 16,113
रीजनिंग टोकन 92,781 598,796
प्रतिक्रिया समय (औसत) 13.32s 113.28s
प्रतिक्रिया समय (अधिकतम) 94.06s 1026.43s
प्रतिक्रिया समय (कुल) 292.97s 2492.26s
पैरामीटर ~120B कुल (~5B सक्रिय) 27B
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#102 GPT-5.4 Nano

medium
लागत
$0.007
समय
24.6s
टोकन
4,943 tok

#107 Qwen3.5-27B

medium
लागत
$0.008
समय
62.0s
टोकन
3,099 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388

त्वरित तुलना

तुलना जोड़ी बदलें