- क्रमांक
- #56
- एकूण आउटपुट टोकन्स
- 90,466
- प्रतिसाद वेळ (सरासरी)
- 22.85s
- एकूण खर्च
- $1.560
GPT-5.4 (medium) vs Grok 4.5 (medium)
GPT-5.4 (medium) average score मध्ये पुढे आहे: 8.5 vs 8.5. GPT-5.4 (medium) चा benchmark खर्च कमी आहे: $1.560 vs $2.042. GPT-5.4 (medium) वेगवान आहे: 22.85s vs 68.59s, pass rates 77.3% vs 83.3%.
तुलना केलेली मॉडेल्स
- क्रमांक
- #60
- एकूण आउटपुट टोकन्स
- 299,460
- प्रतिसाद वेळ (सरासरी)
- 68.59s
- एकूण खर्च
- $2.042
शिफारस केलेले मॉडेल
GPT-5.4 (medium)
It has the best score here (8.5), while responding about 3.0x faster than Grok 4.5 (medium).
तपशीलवार तुलना
| मेट्रिक | GPT-5.4 GPT-5.4 medium | Grok 4.5 Grok 4.5 medium |
|---|---|---|
| स्कोअर | 8.5 | 8.5 |
| क्रमांक | #56 | #60 |
| विश्वसनीयता | 10.0 | 10.0 |
| सुसंगतता | 8.6 | 8.9 |
| प्रयत्न | 66/66 | 66/66 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 77.3% | 83.3% |
| अस्थिर चाचण्या | 4 | 3 |
| एकूण रन | 66 | 66 |
| प्रति निकाल खर्च | 10.399 | 12.007 |
| एकूण खर्च | $1.560 | $2.042 |
| इनपुट किंमत | $2.500 / 1M | $2.000 / 1M |
| आउटपुट किंमत | $15.000 / 1M | $6.000 / 1M |
| एकूण इनपुट टोकन्स | 81,136 | 122,155 |
| आउटपुट टोकन्स | 6,155 | 5,514 |
| रिझनिंग टोकन्स | 84,311 | 293,946 |
| प्रतिसाद वेळ (सरासरी) | 22.85s | 68.59s |
| प्रतिसाद वेळ (कमाल) | 100.41s | 436.38s |
| प्रतिसाद वेळ (एकूण) | 502.78s | 1508.91s |
| पॅरामीटर्स | ~1.5T एकूण (~100B सक्रिय) | ~1.7T एकूण (~170B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#56 GPT-5.4
medium- खर्च
- $0.214
- वेळ
- 199.6s
- टोकन्स
- 14,349 tok
#60 SpaceXAI: Grok 4.5
medium- खर्च
- $0.044
- वेळ
- 59.4s
- टोकन्स
- 7,512 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
DeepSeek V4.1 FlashhighvsGrok 4.5mediumDeepSeek V4.1 FlashlowvsGrok 4.5mediumMuse Spark 1.2lowvsGrok 4.5mediumGPT-5.4mediumvsQwen3.8 MaxlowDeepSeek V4.1 FlashlowvsGPT-5.4mediumDeepSeek V4.1 FlashhighvsGPT-5.4mediumMuse Spark 1.2lowvsGPT-5.4mediumQwen3.8 27BhighvsGrok 4.5mediumGPT-6 SollowvsGrok 4.5mediumQwen3.8 MaxlowvsGrok 4.5mediumInkling SmallhighvsGrok 4.5mediumGrok 4.5mediumvsGLM 5.3 FlashXmax