नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.2 Chat vs Qwen3.5-27B (medium)

GPT-5.2 Chat average score में आगे है: 8.0 vs 7.4. GPT-5.2 Chat की benchmark लागत कम है: $0.604 vs $0.981. GPT-5.2 Chat तेज है: 7.65s vs 111.94s, pass rates 74.2% vs 72.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#37
कुल आउटपुट टोकन
30,424
प्रतिक्रिया समय (औसत)
7.65s
कुल लागत
$0.604
रैंक
#67
कुल आउटपुट टोकन
614,429
प्रतिक्रिया समय (औसत)
111.94s
कुल लागत
$0.981
अनुशंसित मॉडल GPT-5.2 Chat

It has the best score here (8.0), while costing about 1.6x less than Qwen3.5-27B (medium).

विस्तृत तुलना

मेट्रिक GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11 Qwen3.5-27B Qwen3.5-27B medium रिलीज़: 2026-02-24
स्कोर 8.0 7.4
रैंक #37 #67
विश्वसनीयता 10.0 10.0
संगति 8.6 8.2
सही परीक्षण
प्रति प्रयास पास दर 74.2% 72.7%
अस्थिर टेस्ट 4 5
कुल रन 66 66
प्रति परिणाम लागत 4.308 8.324
कुल लागत $0.604 $0.981
इनपुट कीमत $1.750 / 1M $0.195 / 1M
आउटपुट कीमत $14.000 / 1M $1.560 / 1M
कुल इनपुट टोकन 101,248 111,635
आउटपुट टोकन 30,424 15,999
रीजनिंग टोकन 0 598,430
प्रतिक्रिया समय (औसत) 7.65s 111.94s
प्रतिक्रिया समय (अधिकतम) 38.52s 1026.43s
प्रतिक्रिया समय (कुल) 168.39s 2462.67s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#37 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

#67 Qwen3.5-27B

medium
लागत
$0.008
समय
62.0s
टोकन
3,099 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388

त्वरित तुलना

तुलना जोड़ी बदलें