- क्रमांक
- #37
- एकूण आउटपुट टोकन्स
- 90,466
- प्रतिसाद वेळ (सरासरी)
- 22.85s
- एकूण खर्च
- $1.560
GPT-5.4 (medium) vs Grok 4.5 (low)
GPT-5.4 (medium) average score मध्ये पुढे आहे: 8.5 vs 8.4. Grok 4.5 (low) चा benchmark खर्च कमी आहे: $0.945 vs $1.560. Grok 4.5 (low) वेगवान आहे: 16.17s vs 22.85s, pass rates 77.3% vs 77.3%.
- क्रमांक
- #41
- एकूण आउटपुट टोकन्स
- 115,489
- प्रतिसाद वेळ (सरासरी)
- 16.17s
- एकूण खर्च
- $0.945
शिफारस केलेले मॉडेल
Grok 4.5 (low)
Its score stays close to the best score here (8.4 vs 8.5), while costing about 1.7x less than GPT-5.4 (medium).
तपशीलवार तुलना
| मेट्रिक | GPT-5.4 GPT-5.4 medium | Grok 4.5 Grok 4.5 low |
|---|---|---|
| स्कोअर | 8.5 | 8.4 |
| क्रमांक | #37 | #41 |
| विश्वसनीयता | 10.0 | 10.0 |
| सुसंगतता | 8.6 | 9.3 |
| प्रयत्न | 66/66 | 66/66 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 77.3% | 77.3% |
| अस्थिर चाचण्या | 4 | 2 |
| एकूण रन | 66 | 66 |
| प्रति निकाल खर्च | 10.399 | 5.901 |
| एकूण खर्च | $1.560 | $0.945 |
| इनपुट किंमत | $2.500 / 1M | $2.000 / 1M |
| आउटपुट किंमत | $15.000 / 1M | $6.000 / 1M |
| एकूण इनपुट टोकन्स | 81,136 | 125,605 |
| आउटपुट टोकन्स | 6,155 | 7,505 |
| रिझनिंग टोकन्स | 84,311 | 107,984 |
| प्रतिसाद वेळ (सरासरी) | 22.85s | 16.17s |
| प्रतिसाद वेळ (कमाल) | 100.41s | 205.28s |
| प्रतिसाद वेळ (एकूण) | 502.78s | 355.67s |
| पॅरामीटर्स | ~1.5T एकूण (~100B सक्रिय) | ~1.7T एकूण (~170B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#37 GPT-5.4
medium- खर्च
- $0.214
- वेळ
- 199.6s
- टोकन्स
- 14,349 tok
#41 SpaceXAI: Grok 4.5
low- खर्च
- $0.011
- वेळ
- 12.4s
- टोकन्स
- 2,018 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
GPT-5.2mediumvsGrok 4.5lowQwen3.8 27BhighvsGrok 4.5lowSeed 2.1 TurbomediumvsGrok 4.5lowInkling SmallhighvsGrok 4.5lowGPT-5.4mediumvsQwen3.8 MaxlowMuse Spark 1.2lowvsGPT-5.4mediumGPT-5.4mediumvsQwen3.8 27BhighMuse Spark 1.2highvsGPT-5.4mediumGPT-5.4mediumvsInkling SmallhighGemini 2.5 FlashmediumvsGrok 4.5lowQwen3.6 Max PreviewmediumvsGrok 4.5lowGPT-5.4mediumvsGLM 5.3 Flashmax