नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.2 Chat vs Grok 4.5 (medium)

Grok 4.5 (medium) average score मध्ये पुढे आहे: 8.5 vs 7.9. GPT-5.2 Chat चा benchmark खर्च कमी आहे: $0.594 vs $2.042. GPT-5.2 Chat वेगवान आहे: 7.73s vs 68.59s, pass rates 69.7% vs 83.3%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-20

क्रमांक
#59
एकूण आउटपुट टोकन्स
29,742
प्रतिसाद वेळ (सरासरी)
7.73s
एकूण खर्च
$0.594
क्रमांक
#37
एकूण आउटपुट टोकन्स
299,460
प्रतिसाद वेळ (सरासरी)
68.59s
एकूण खर्च
$2.042
शिफारस केलेले मॉडेल GPT-5.2 Chat

Its score stays close to the best score here (7.9 vs 8.5), while costing about 3.4x less than Grok 4.5 (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.2 Chat GPT-5.2 Chat none प्रकाशन: 2025-12-11 Grok 4.5 Grok 4.5 medium प्रकाशन: 2026-07-08
स्कोअर 7.9 8.5
क्रमांक #59 #37
विश्वसनीयता 10.0 10.0
सुसंगतता 8.6 8.9
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 69.7% 83.3%
अस्थिर चाचण्या 4 3
एकूण रन 66 66
प्रति निकाल खर्च 4.564 12.007
एकूण खर्च $0.594 $2.042
इनपुट किंमत $1.750 / 1M $2.000 / 1M
आउटपुट किंमत $14.000 / 1M $6.000 / 1M
एकूण इनपुट टोकन्स 101,104 122,155
आउटपुट टोकन्स 29,742 5,514
रिझनिंग टोकन्स 0 293,946
प्रतिसाद वेळ (सरासरी) 7.73s 68.59s
प्रतिसाद वेळ (कमाल) 38.52s 436.38s
प्रतिसाद वेळ (एकूण) 162.40s 1508.91s
पॅरामीटर्स ~400B एकूण (~17B सक्रिय) ~1.7T एकूण (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 GPT-5.2 Chat

none
खर्च
$0.010
वेळ
15.3s
टोकन्स
797 tok

#37 SpaceXAI: Grok 4.5

medium
खर्च
$0.044
वेळ
59.4s
टोकन्स
7,512 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

झटपट तुलना

तुलना जोडी बदला