नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.2 Chat vs Qwen3.6 Max Preview (medium)

Qwen3.6 Max Preview (medium) average score में आगे है: 8.4 vs 8.0. GPT-5.2 Chat की benchmark लागत कम है: $0.604 vs $1.143. GPT-5.2 Chat तेज है: 7.65s vs 67.53s, pass rates 74.2% vs 80.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#37
कुल आउटपुट टोकन
30,424
प्रतिक्रिया समय (औसत)
7.65s
कुल लागत
$0.604
रैंक
#25
कुल आउटपुट टोकन
169,940
प्रतिक्रिया समय (औसत)
67.53s
कुल लागत
$1.143
अनुशंसित मॉडल GPT-5.2 Chat

Its score stays close to the best score here (8.0 vs 8.4), while costing about 1.9x less than Qwen3.6 Max Preview (medium).

विस्तृत तुलना

मेट्रिक GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11 Qwen3.6 Max Preview Qwen3.6 Max Preview medium रिलीज़: 2026-04-20
स्कोर 8.0 8.4
रैंक #37 #25
विश्वसनीयता 10.0 9.9
संगति 8.6 8.9
सही परीक्षण
प्रति प्रयास पास दर 74.2% 80.3%
अस्थिर टेस्ट 4 3
कुल रन 66 66
प्रति परिणाम लागत 4.308 8.173
कुल लागत $0.604 $1.143
इनपुट कीमत $1.750 / 1M $1.040 / 1M
आउटपुट कीमत $14.000 / 1M $6.240 / 1M
कुल इनपुट टोकन 101,248 79,240
आउटपुट टोकन 30,424 5,098
रीजनिंग टोकन 0 164,842
प्रतिक्रिया समय (औसत) 7.65s 67.53s
प्रतिक्रिया समय (अधिकतम) 38.52s 238.07s
प्रतिक्रिया समय (कुल) 168.39s 1485.64s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#37 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

#25 Qwen3.6 Max Preview

medium
लागत
$0.024
समय
76.5s
टोकन
3,861 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957

त्वरित तुलना

तुलना जोड़ी बदलें