- क्रमांक
- #36
- एकूण आउटपुट टोकन्स
- 54,782
- प्रतिसाद वेळ (सरासरी)
- 22.62s
- एकूण खर्च
- $0.951
GPT-5.2 (medium) vs Grok 4.6 (medium)
GPT-5.2 (medium) average score मध्ये पुढे आहे: 8.4 vs 8.3. GPT-5.2 (medium) चा benchmark खर्च कमी आहे: $0.951 vs $1.656. GPT-5.2 (medium) वेगवान आहे: 22.62s vs 71.86s, pass rates 72.7% vs 80.3%.
- क्रमांक
- #40
- एकूण आउटपुट टोकन्स
- 240,338
- प्रतिसाद वेळ (सरासरी)
- 71.86s
- एकूण खर्च
- $1.656
शिफारस केलेले मॉडेल
GPT-5.2 (medium)
It has the best score here (8.4), while costing about 1.7x less than Grok 4.6 (medium).
तपशीलवार तुलना
| मेट्रिक | GPT-5.2 GPT-5.2 medium | Grok 4.6 Grok 4.6 medium |
|---|---|---|
| स्कोअर | 8.4 | 8.3 |
| क्रमांक | #36 | #40 |
| विश्वसनीयता | 10.0 | 10.0 |
| सुसंगतता | 8.5 | 8.2 |
| प्रयत्न | 66/66 | 66/66 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 72.7% | 80.3% |
| अस्थिर चाचण्या | 4 | 5 |
| एकूण रन | 66 | 66 |
| प्रति निकाल खर्च | 6.791 | 11.038 |
| एकूण खर्च | $0.951 | $1.656 |
| इनपुट किंमत | $1.750 / 1M | $2.000 / 1M |
| आउटपुट किंमत | $14.000 / 1M | $6.000 / 1M |
| एकूण इनपुट टोकन्स | 105,004 | 106,778 |
| आउटपुट टोकन्स | 9,914 | 4,811 |
| रिझनिंग टोकन्स | 44,868 | 235,527 |
| प्रतिसाद वेळ (सरासरी) | 22.62s | 71.86s |
| प्रतिसाद वेळ (कमाल) | 102.93s | 514.35s |
| प्रतिसाद वेळ (एकूण) | 339.28s | 1580.96s |
| पॅरामीटर्स | ~1.2T एकूण (~80B सक्रिय) | ~1.7T एकूण (~170B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#36 GPT-5.2
medium- खर्च
- $0.047
- वेळ
- 49.2s
- टोकन्स
- 3,396 tok
#40 SpaceXAI: Grok 4.6
medium- खर्च
- $0.028
- वेळ
- 72.1s
- टोकन्स
- 4,771 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
GPT-5.2mediumvsGrok 4.5lowGPT-5.2mediumvsInkling SmallhighInkling SmallhighvsGrok 4.6mediumMuse Spark 1.2lowvsGPT-5.2mediumMuse Spark 1.1lowvsGrok 4.6mediumMuse Spark 1.2lowvsGrok 4.6mediumMuse Spark 1.1lowvsGPT-5.2mediumMuse Glimmer 30BxhighvsGrok 4.6mediumDeepSeek V4 Flash 0731lowvsGrok 4.6mediumQwen3.8 2.4T A95BlowvsGrok 4.6mediumMuse Glimmer 30BxhighvsGPT-5.2mediumClaude Opus 5lowvsGPT-5.2medium