नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.2 Chat vs Grok 4.5 (medium)

Grok 4.5 (medium) average score में आगे है: 8.3 vs 8.0. GPT-5.2 Chat की benchmark लागत कम है: $0.604 vs $1.928. GPT-5.2 Chat तेज है: 7.65s vs 61.71s, pass rates 74.2% vs 78.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-07

रैंक
#44
कुल आउटपुट टोकन
30,424
प्रतिक्रिया समय (औसत)
7.65s
कुल लागत
$0.604
रैंक
#35
कुल आउटपुट टोकन
280,567
प्रतिक्रिया समय (औसत)
61.71s
कुल लागत
$1.928
अनुशंसित मॉडल GPT-5.2 Chat

Its score stays close to the best score here (8.0 vs 8.3), while costing about 3.2x less than Grok 4.5 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11 Grok 4.5 Grok 4.5 medium रिलीज़: 2026-07-08
स्कोर 8.0 8.3
रैंक #44 #35
विश्वसनीयता 10.0 10.0
संगति 8.6 8.9
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 74.2% 78.8%
अस्थिर टेस्ट 4 3
कुल रन 66 66
प्रति परिणाम लागत 4.308 12.049
कुल लागत $0.604 $1.928
इनपुट कीमत $1.750 / 1M $2.000 / 1M
आउटपुट कीमत $14.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 101,248 122,146
आउटपुट टोकन 30,424 5,514
रीजनिंग टोकन 0 275,053
प्रतिक्रिया समय (औसत) 7.65s 61.71s
प्रतिक्रिया समय (अधिकतम) 38.52s 436.38s
प्रतिक्रिया समय (कुल) 168.39s 1357.56s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#44 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

#35 xAI: Grok 4.5

medium
लागत
$0.044
समय
59.4s
टोकन
7,512 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

त्वरित तुलना

तुलना जोड़ी बदलें