- क्रमांक
- #54
- एकूण आउटपुट टोकन्स
- 80,538
- प्रतिसाद वेळ (सरासरी)
- 31.29s
- एकूण खर्च
- $1.558
GPT-5.2 (medium) vs Grok 4.6 (high)
GPT-5.2 (medium) average score मध्ये पुढे आहे: 8.7 vs 8.5. GPT-5.2 (medium) चा benchmark खर्च कमी आहे: $1.558 vs $2.629. GPT-5.2 (medium) वेगवान आहे: 31.29s vs 87.48s, pass rates 73.9% vs 82.6%.
तुलना केलेली मॉडेल्स
- क्रमांक
- #64
- एकूण आउटपुट टोकन्स
- 312,614
- प्रतिसाद वेळ (सरासरी)
- 87.48s
- एकूण खर्च
- $2.629
शिफारस केलेले मॉडेल
GPT-5.2 (medium)
It has the best score here (8.7), while costing about 1.7x less than Grok 4.6 (high).
तपशीलवार तुलना
| मेट्रिक | GPT-5.2 GPT-5.2 medium | Grok 4.6 Grok 4.6 high |
|---|---|---|
| स्कोअर | 8.7 | 8.5 |
| क्रमांक | #54 | #64 |
| विश्वसनीयता | 10.0 | 10.0 |
| सुसंगतता | 8.5 | 10.0 |
| प्रयत्न | 69/69 | 69/69 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 73.9% | 82.6% |
| अस्थिर चाचण्या | 4 | 0 |
| एकूण रन | 69 | 69 |
| प्रति निकाल खर्च | 10.261 | 13.833 |
| एकूण खर्च | $1.558 | $2.629 |
| इनपुट किंमत | $1.750 / 1M | $2.000 / 1M |
| आउटपुट किंमत | $14.000 / 1M | $6.000 / 1M |
| कॅश वाचण्याची किंमत | $0.175 / 1M | $0.500 / 1M |
| कॅश लिहिण्याची किंमत | लागू नाही | लागू नाही |
| एकूण इनपुट टोकन्स | 235,207 | 376,233 |
| आउटपुट टोकन्स | 11,065 | 6,687 |
| रिझनिंग टोकन्स | 69,473 | 305,927 |
| प्रतिसाद वेळ (सरासरी) | 31.29s | 87.48s |
| प्रतिसाद वेळ (कमाल) | 116.86s | 618.49s |
| प्रतिसाद वेळ (एकूण) | 531.98s | 2012.15s |
| पॅरामीटर्स | ~1.2T एकूण (~80B सक्रिय) | ~1.7T एकूण (~170B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#54 GPT-5.2
medium- खर्च
- $0.047
- वेळ
- 49.2s
- टोकन्स
- 3,396 tok
#64 SpaceXAI: Grok 4.6
high- खर्च
- $0.107
- वेळ
- 265.1s
- टोकन्स
- 18,001 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
GPT-5.2mediumvsQwen3.8 27Bhighमोफत उपलब्धMuse Spark 1.3lowvsGrok 4.6highClaude Sonnet 5mediumvsGrok 4.6highQwen3.7 MaxmediumvsGrok 4.6highQwen3.8 Max (0902)lowvsGrok 4.6highDeepSeek V4.1 FlashmaxvsGPT-5.2mediumMuse Spark 1.2lowvsGPT-5.2mediumClaude Sonnet 5.5xhighvsGrok 4.6highMuse Spark 1.1lowvsGrok 4.6highDeepSeek V4.1 FlashhighvsGPT-5.2mediumMuse Spark 1.1lowvsGPT-5.2mediumClaude Sonnet 5.5xhighvsGPT-5.2medium