- क्रमांक
- #64
- एकूण आउटपुट टोकन्स
- 71,252
- प्रतिसाद वेळ (सरासरी)
- 28.51s
- एकूण खर्च
- $1.182
GPT-5.2 (medium) vs Grok 4.5 (medium)
Grok 4.5 (medium) average score मध्ये पुढे आहे: 8.5 vs 8.4. GPT-5.2 (medium) चा benchmark खर्च कमी आहे: $1.182 vs $2.042. GPT-5.2 (medium) वेगवान आहे: 28.51s vs 68.59s, pass rates 72.7% vs 83.3%.
तुलना केलेली मॉडेल्स
- क्रमांक
- #60
- एकूण आउटपुट टोकन्स
- 299,460
- प्रतिसाद वेळ (सरासरी)
- 68.59s
- एकूण खर्च
- $2.042
शिफारस केलेले मॉडेल
GPT-5.2 (medium)
Its score stays close to the best score here (8.4 vs 8.5), while costing about 1.7x less than Grok 4.5 (medium).
तपशीलवार तुलना
| मेट्रिक | GPT-5.2 GPT-5.2 medium | Grok 4.5 Grok 4.5 medium |
|---|---|---|
| स्कोअर | 8.4 | 8.5 |
| क्रमांक | #64 | #60 |
| विश्वसनीयता | 10.0 | 10.0 |
| सुसंगतता | 8.5 | 8.9 |
| प्रयत्न | 66/66 | 66/66 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 72.7% | 83.3% |
| अस्थिर चाचण्या | 4 | 3 |
| एकूण रन | 66 | 66 |
| प्रति निकाल खर्च | 8.438 | 12.007 |
| एकूण खर्च | $1.182 | $2.042 |
| इनपुट किंमत | $1.750 / 1M | $2.000 / 1M |
| आउटपुट किंमत | $14.000 / 1M | $6.000 / 1M |
| एकूण इनपुट टोकन्स | 105,013 | 122,155 |
| आउटपुट टोकन्स | 9,914 | 5,514 |
| रिझनिंग टोकन्स | 61,338 | 293,946 |
| प्रतिसाद वेळ (सरासरी) | 28.51s | 68.59s |
| प्रतिसाद वेळ (कमाल) | 116.86s | 436.38s |
| प्रतिसाद वेळ (एकूण) | 456.13s | 1508.91s |
| पॅरामीटर्स | ~1.2T एकूण (~80B सक्रिय) | ~1.7T एकूण (~170B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#64 GPT-5.2
medium- खर्च
- $0.047
- वेळ
- 49.2s
- टोकन्स
- 3,396 tok
#60 SpaceXAI: Grok 4.5
medium- खर्च
- $0.044
- वेळ
- 59.4s
- टोकन्स
- 7,512 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
GPT-5.2mediumvsQwen3.8 27BhighGPT-5.2mediumvsGrok 4.5lowDeepSeek V4.1 FlashhighvsGrok 4.5mediumDeepSeek V4.1 FlashlowvsGrok 4.5mediumMuse Spark 1.2lowvsGrok 4.5mediumGPT-5.2mediumvsInkling SmallhighGPT-5.2mediumvsGLM 5.3 FlashXmaxDeepSeek V4.1 FlashmaxvsGPT-5.2mediumMuse Spark 1.2lowvsGPT-5.2mediumQwen3.8 27BhighvsGrok 4.5mediumDeepSeek V4.1 FlashhighvsGPT-5.2mediumDeepSeek V4.1 FlashlowvsGPT-5.2medium