- क्रमांक
- #64
- एकूण आउटपुट टोकन्स
- 71,252
- प्रतिसाद वेळ (सरासरी)
- 28.51s
- एकूण खर्च
- $1.182
GPT-5.2 (medium) vs Grok 4.6 (medium)
average score जवळपास समान आहे: 8.4 vs 8.4. GPT-5.2 (medium) चा benchmark खर्च कमी आहे: $1.182 vs $1.713. GPT-5.2 (medium) वेगवान आहे: 28.51s vs 73.46s, pass rates 72.7% vs 81.8%.
तुलना केलेली मॉडेल्स
- क्रमांक
- #62
- एकूण आउटपुट टोकन्स
- 249,808
- प्रतिसाद वेळ (सरासरी)
- 73.46s
- एकूण खर्च
- $1.713
शिफारस केलेले मॉडेल
GPT-5.2 (medium)
It has the best score here (8.4), while responding about 2.6x faster than Grok 4.6 (medium).
तपशीलवार तुलना
| मेट्रिक | GPT-5.2 GPT-5.2 medium | Grok 4.6 Grok 4.6 medium |
|---|---|---|
| स्कोअर | 8.4 | 8.4 |
| क्रमांक | #64 | #62 |
| विश्वसनीयता | 10.0 | 10.0 |
| सुसंगतता | 8.5 | 8.6 |
| प्रयत्न | 66/66 | 66/66 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 72.7% | 81.8% |
| अस्थिर चाचण्या | 4 | 4 |
| एकूण रन | 66 | 66 |
| प्रति निकाल खर्च | 8.438 | 10.703 |
| एकूण खर्च | $1.182 | $1.713 |
| इनपुट किंमत | $1.750 / 1M | $2.000 / 1M |
| आउटपुट किंमत | $14.000 / 1M | $6.000 / 1M |
| एकूण इनपुट टोकन्स | 105,013 | 106,787 |
| आउटपुट टोकन्स | 9,914 | 4,811 |
| रिझनिंग टोकन्स | 61,338 | 244,997 |
| प्रतिसाद वेळ (सरासरी) | 28.51s | 73.46s |
| प्रतिसाद वेळ (कमाल) | 116.86s | 514.35s |
| प्रतिसाद वेळ (एकूण) | 456.13s | 1616.12s |
| पॅरामीटर्स | ~1.2T एकूण (~80B सक्रिय) | ~1.7T एकूण (~170B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#64 GPT-5.2
medium- खर्च
- $0.047
- वेळ
- 49.2s
- टोकन्स
- 3,396 tok
#62 SpaceXAI: Grok 4.6
medium- खर्च
- $0.028
- वेळ
- 72.1s
- टोकन्स
- 4,771 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
GPT-5.2mediumvsQwen3.8 27BhighGPT-5.2mediumvsGrok 4.5lowMuse Spark 1.2lowvsGrok 4.6mediumGPT-5.2mediumvsInkling SmallhighDeepSeek V4.1 FlashhighvsGrok 4.6mediumDeepSeek V4.1 FlashlowvsGrok 4.6mediumQwen3.8 27BhighvsGrok 4.6mediumGPT-5.2mediumvsGLM 5.3 FlashXmaxDeepSeek V4.1 FlashmaxvsGPT-5.2mediumMuse Spark 1.2lowvsGPT-5.2mediumGPT-6 SollowvsGrok 4.6mediumInkling SmallhighvsGrok 4.6medium