नेविगेशन
AI BENCHY
Advertise here

GPT-5.4 Nano (medium) vs Qwen3.5 Plus 2026-02-15 (medium)

average score लगभग बराबर है: 7.5 vs 7.5. GPT-5.4 Nano (medium) की benchmark लागत कम है: $0.138 vs $0.437. GPT-5.4 Nano (medium) तेज है: 13.24s vs 89.19s, pass rates 65.2% vs 71.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#62
कुल आउटपुट टोकन
97,122
प्रतिक्रिया समय (औसत)
13.24s
कुल लागत
$0.138
रैंक
#66
कुल आउटपुट टोकन
260,704
प्रतिक्रिया समय (औसत)
89.19s
कुल लागत
$0.437
अनुशंसित मॉडल GPT-5.4 Nano (medium)

It has the best score here (7.5), while costing about 3.2x less than Qwen3.5 Plus 2026-02-15 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.4 Nano GPT-5.4 Nano medium रिलीज़: 2026-03-17 Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium रिलीज़: 2026-02-15
स्कोर 7.5 7.5
रैंक #62 #66
विश्वसनीयता 10.0 10.0
संगति 8.5 8.5
सही परीक्षण
प्रति प्रयास पास दर 65.2% 71.2%
अस्थिर टेस्ट 4 4
कुल रन 66 66
प्रति परिणाम लागत 1.150 3.348
कुल लागत $0.138 $0.437
इनपुट कीमत $0.200 / 1M $0.260 / 1M
आउटपुट कीमत $1.250 / 1M $1.560 / 1M
कुल इनपुट टोकन 82,819 113,560
आउटपुट टोकन 7,100 9,823
रीजनिंग टोकन 90,022 250,881
प्रतिक्रिया समय (औसत) 13.24s 89.19s
प्रतिक्रिया समय (अधिकतम) 94.06s 304.85s
प्रतिक्रिया समय (कुल) 291.33s 1337.92s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 GPT-5.4 Nano

medium
लागत
$0.007
समय
24.6s
टोकन
4,943 tok

#66 Qwen3.5 Plus 2026-02-15

medium
लागत
$0.011
समय
125.5s
टोकन
7,040 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
Qwen3.5 Plus 2026-02-15 6.6 7.1 44.4% 1 180.70s 6,950 420 80,595

त्वरित तुलना

तुलना जोड़ी बदलें