- रैंक
- #54
- कुल आउटपुट टोकन
- 80,538
- प्रतिक्रिया समय (औसत)
- 31.29s
- कुल लागत
- $1.558
GPT-5.2 (medium) vs Grok 4.6 (high)
GPT-5.2 (medium) average score में आगे है: 8.7 vs 8.5. GPT-5.2 (medium) की benchmark लागत कम है: $1.558 vs $2.629. GPT-5.2 (medium) तेज है: 31.29s vs 87.48s, pass rates 73.9% vs 82.6%.
तुलना किए गए मॉडल
- रैंक
- #64
- कुल आउटपुट टोकन
- 312,614
- प्रतिक्रिया समय (औसत)
- 87.48s
- कुल लागत
- $2.629
अनुशंसित मॉडल
GPT-5.2 (medium)
It has the best score here (8.7), while costing about 1.7x less than Grok 4.6 (high).
विस्तृत तुलना
| मेट्रिक | GPT-5.2 GPT-5.2 medium | Grok 4.6 Grok 4.6 high |
|---|---|---|
| स्कोर | 8.7 | 8.5 |
| रैंक | #54 | #64 |
| विश्वसनीयता | 10.0 | 10.0 |
| संगति | 8.5 | 10.0 |
| प्रयास | 69/69 | 69/69 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 73.9% | 82.6% |
| अस्थिर टेस्ट | 4 | 0 |
| कुल रन | 69 | 69 |
| प्रति परिणाम लागत | 10.261 | 13.833 |
| कुल लागत | $1.558 | $2.629 |
| इनपुट कीमत | $1.750 / 1M | $2.000 / 1M |
| आउटपुट कीमत | $14.000 / 1M | $6.000 / 1M |
| कैश पढ़ने की कीमत | $0.175 / 1M | $0.500 / 1M |
| कैश लिखने की कीमत | लागू नहीं | लागू नहीं |
| कुल इनपुट टोकन | 235,207 | 376,233 |
| आउटपुट टोकन | 11,065 | 6,687 |
| रीजनिंग टोकन | 69,473 | 305,927 |
| प्रतिक्रिया समय (औसत) | 31.29s | 87.48s |
| प्रतिक्रिया समय (अधिकतम) | 116.86s | 618.49s |
| प्रतिक्रिया समय (कुल) | 531.98s | 2012.15s |
| पैरामीटर | ~1.2T कुल (~80B सक्रिय) | ~1.7T कुल (~170B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।
मॉडल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#54 GPT-5.2
medium- लागत
- $0.047
- समय
- 49.2s
- टोकन
- 3,396 tok
#64 SpaceXAI: Grok 4.6
high- लागत
- $0.107
- समय
- 265.1s
- टोकन
- 18,001 tok
स्कोर के अनुसार शीर्ष मॉडल
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
त्वरित तुलना
तुलना जोड़ी बदलें
GPT-5.2mediumvsQwen3.8 27Bhighनिःशुल्क उपलब्धMuse Spark 1.3lowvsGrok 4.6highClaude Sonnet 5mediumvsGrok 4.6highQwen3.7 MaxmediumvsGrok 4.6highQwen3.8 Max (0902)lowvsGrok 4.6highDeepSeek V4.1 FlashmaxvsGPT-5.2mediumMuse Spark 1.2lowvsGPT-5.2mediumClaude Sonnet 5.5xhighvsGrok 4.6highMuse Spark 1.1lowvsGrok 4.6highDeepSeek V4.1 FlashhighvsGPT-5.2mediumMuse Spark 1.1lowvsGPT-5.2mediumClaude Sonnet 5.5xhighvsGPT-5.2medium