नेविगेशन
Advertise here

GPT-5.2 Chat vs Grok 4.7 (low)

average score लगभग बराबर है: 7.9 vs 7.9. GPT-5.2 Chat की benchmark लागत कम है: $0.594 vs $1.320. GPT-5.2 Chat तेज है: 7.73s vs 59.02s, pass rates 69.7% vs 77.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-21

तुलना किए गए मॉडल

रैंक
#83
कुल आउटपुट टोकन
29,742
प्रतिक्रिया समय (औसत)
7.73s
कुल लागत
$0.594
रैंक
#81
कुल आउटपुट टोकन
231,848
प्रतिक्रिया समय (औसत)
59.02s
कुल लागत
$1.320
अनुशंसित मॉडल GPT-5.2 Chat

It has the best score here (7.9), while costing about 2.2x less than Grok 4.7 (low).

विस्तृत तुलना

मेट्रिक GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11 Grok 4.7 Grok 4.7 low रिलीज़: 2026-09-21
स्कोर 7.9 7.9
रैंक #83 #81
विश्वसनीयता 10.0 10.0
संगति 8.6 8.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 69.7% 77.3%
अस्थिर टेस्ट 4 5
कुल रन 66 66
प्रति परिणाम लागत 4.564 9.422
कुल लागत $0.594 $1.320
इनपुट कीमत $1.750 / 1M $1.600 / 1M
आउटपुट कीमत $14.000 / 1M $4.800 / 1M
कुल इनपुट टोकन 101,104 128,832
आउटपुट टोकन 29,742 6,840
रीजनिंग टोकन 0 225,008
प्रतिक्रिया समय (औसत) 7.73s 59.02s
प्रतिक्रिया समय (अधिकतम) 38.52s 389.63s
प्रतिक्रिया समय (कुल) 162.40s 1298.42s
पैरामीटर ~400B कुल (~17B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#83 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

#81 SpaceXAI: Grok 4.7

low
लागत
$0.007
समय
15.2s
टोकन
1,537 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Grok 4.7 8.4 7.4 88.9% 1 189.08s 9,579 346 99,053

त्वरित तुलना

तुलना जोड़ी बदलें