नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.4 Mini (medium) vs Qwen3.7 Max

average score लगभग बराबर है: 7.5 vs 7.4. Qwen3.7 Max की benchmark लागत कम है: $0.197 vs $0.786. Qwen3.7 Max तेज है: 4.56s vs 26.72s, pass rates 68.2% vs 68.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-10

तुलना किए गए मॉडल

रैंक
#109
कुल आउटपुट टोकन
158,344
प्रतिक्रिया समय (औसत)
26.72s
कुल लागत
$0.786
रैंक
#113
कुल आउटपुट टोकन
12,446
प्रतिक्रिया समय (औसत)
4.56s
कुल लागत
$0.197
अनुशंसित मॉडल Qwen3.7 Max

It has the best score here (7.4), while costing about 4.0x less than GPT-5.4 Mini (medium).

विस्तृत तुलना

मेट्रिक GPT-5.4 Mini GPT-5.4 Mini medium रिलीज़: 2026-03-17 Qwen3.7 Max Qwen3.7 Max none रिलीज़: 2026-05-22
स्कोर 7.5 7.4
रैंक #109 #113
विश्वसनीयता 10.0 9.9
संगति 8.1 10.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 68.2% 68.2%
अस्थिर टेस्ट 5 0
कुल रन 66 66
प्रति परिणाम लागत 6.546 1.581
कुल लागत $0.786 $0.197
इनपुट कीमत $0.750 / 1M $1.475 / 1M
आउटपुट कीमत $4.500 / 1M $4.425 / 1M
कुल इनपुट टोकन 97,164 95,992
आउटपुट टोकन 6,211 12,446
रीजनिंग टोकन 152,133 0
प्रतिक्रिया समय (औसत) 26.72s 4.56s
प्रतिक्रिया समय (अधिकतम) 138.75s 72.30s
प्रतिक्रिया समय (कुल) 587.90s 100.30s
पैरामीटर ~400B कुल (~17B सक्रिय) ~1T कुल (~40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#109 GPT-5.4 Mini

medium
लागत
$0.056
समय
95.5s
टोकन
12,464 tok

#113 Qwen3.7 Max

none
लागत
$0.046
समय
195.0s
टोकन
12,171 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

त्वरित तुलना

तुलना जोड़ी बदलें