- क्रमांक
- #38
- एकूण आउटपुट टोकन्स
- 90,466
- प्रतिसाद वेळ (सरासरी)
- 22.85s
- एकूण खर्च
- $1.560
GPT-5.4 (medium) vs Grok 4.6 (medium)
GPT-5.4 (medium) average score मध्ये पुढे आहे: 8.5 vs 8.4. GPT-5.4 (medium) चा benchmark खर्च कमी आहे: $1.560 vs $1.713. GPT-5.4 (medium) वेगवान आहे: 22.85s vs 73.46s, pass rates 77.3% vs 81.8%.
- क्रमांक
- #41
- एकूण आउटपुट टोकन्स
- 249,808
- प्रतिसाद वेळ (सरासरी)
- 73.46s
- एकूण खर्च
- $1.713
शिफारस केलेले मॉडेल
GPT-5.4 (medium)
It has the best score here (8.5), while responding about 3.2x faster than Grok 4.6 (medium).
तपशीलवार तुलना
| मेट्रिक | GPT-5.4 GPT-5.4 medium | Grok 4.6 Grok 4.6 medium |
|---|---|---|
| स्कोअर | 8.5 | 8.4 |
| क्रमांक | #38 | #41 |
| विश्वसनीयता | 10.0 | 10.0 |
| सुसंगतता | 8.6 | 8.6 |
| प्रयत्न | 66/66 | 66/66 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 77.3% | 81.8% |
| अस्थिर चाचण्या | 4 | 4 |
| एकूण रन | 66 | 66 |
| प्रति निकाल खर्च | 10.399 | 10.703 |
| एकूण खर्च | $1.560 | $1.713 |
| इनपुट किंमत | $2.500 / 1M | $2.000 / 1M |
| आउटपुट किंमत | $15.000 / 1M | $6.000 / 1M |
| एकूण इनपुट टोकन्स | 81,136 | 106,787 |
| आउटपुट टोकन्स | 6,155 | 4,811 |
| रिझनिंग टोकन्स | 84,311 | 244,997 |
| प्रतिसाद वेळ (सरासरी) | 22.85s | 73.46s |
| प्रतिसाद वेळ (कमाल) | 100.41s | 514.35s |
| प्रतिसाद वेळ (एकूण) | 502.78s | 1616.12s |
| पॅरामीटर्स | ~1.5T एकूण (~100B सक्रिय) | ~1.7T एकूण (~170B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#38 GPT-5.4
medium- खर्च
- $0.214
- वेळ
- 199.6s
- टोकन्स
- 14,349 tok
#41 SpaceXAI: Grok 4.6
medium- खर्च
- $0.028
- वेळ
- 72.1s
- टोकन्स
- 4,771 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
Muse Spark 1.2lowvsGrok 4.6mediumGPT-5.4mediumvsQwen3.8 MaxlowQwen3.8 27BhighvsGrok 4.6mediumInkling SmallhighvsGrok 4.6mediumMuse Spark 1.2lowvsGPT-5.4mediumQwen3.8 MaxlowvsGrok 4.6mediumGPT-5.4mediumvsGrok 4.5lowMuse Spark 1.1lowvsGrok 4.6mediumGPT-5.4mediumvsQwen3.8 27BhighMuse Spark 1.2highvsGPT-5.4mediumGPT-5.4mediumvsInkling SmallhighGPT-5.4mediumvsGLM 5.3 Flashmax