नेविगेशन
AI BENCHY
Advertise here

GPT-5.2 (medium) vs Grok 4.6 (medium)

GPT-5.2 (medium) average score में आगे है: 8.4 vs 8.3. GPT-5.2 (medium) की benchmark लागत कम है: $0.951 vs $1.656. GPT-5.2 (medium) तेज है: 22.62s vs 71.86s, pass rates 72.7% vs 80.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#36
कुल आउटपुट टोकन
54,782
प्रतिक्रिया समय (औसत)
22.62s
कुल लागत
$0.951
रैंक
#40
कुल आउटपुट टोकन
240,338
प्रतिक्रिया समय (औसत)
71.86s
कुल लागत
$1.656
अनुशंसित मॉडल GPT-5.2 (medium)

It has the best score here (8.4), while costing about 1.7x less than Grok 4.6 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.2 GPT-5.2 medium रिलीज़: 2025-12-11 Grok 4.6 Grok 4.6 medium रिलीज़: 2026-08-12
स्कोर 8.4 8.3
रैंक #36 #40
विश्वसनीयता 10.0 10.0
संगति 8.5 8.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 72.7% 80.3%
अस्थिर टेस्ट 4 5
कुल रन 66 66
प्रति परिणाम लागत 6.791 11.038
कुल लागत $0.951 $1.656
इनपुट कीमत $1.750 / 1M $2.000 / 1M
आउटपुट कीमत $14.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 105,004 106,778
आउटपुट टोकन 9,914 4,811
रीजनिंग टोकन 44,868 235,527
प्रतिक्रिया समय (औसत) 22.62s 71.86s
प्रतिक्रिया समय (अधिकतम) 102.93s 514.35s
प्रतिक्रिया समय (कुल) 339.28s 1580.96s
पैरामीटर ~1.2T कुल (~80B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#36 GPT-5.2

medium
लागत
$0.047
समय
49.2s
टोकन
3,396 tok

#40 SpaceXAI: Grok 4.6

medium
लागत
$0.028
समय
72.1s
टोकन
4,771 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912
Grok 4.6 8.2 7.2 88.9% 1 120.05s 9,579 351 64,226

त्वरित तुलना

तुलना जोड़ी बदलें