- रैंक
- #56
- कुल आउटपुट टोकन
- 90,466
- प्रतिक्रिया समय (औसत)
- 22.85s
- कुल लागत
- $1.560
GPT-5.4 (medium) vs Grok 4.5 (medium)
GPT-5.4 (medium) average score में आगे है: 8.5 vs 8.5. GPT-5.4 (medium) की benchmark लागत कम है: $1.560 vs $2.042. GPT-5.4 (medium) तेज है: 22.85s vs 68.59s, pass rates 77.3% vs 83.3%.
तुलना किए गए मॉडल
- रैंक
- #60
- कुल आउटपुट टोकन
- 299,460
- प्रतिक्रिया समय (औसत)
- 68.59s
- कुल लागत
- $2.042
अनुशंसित मॉडल
GPT-5.4 (medium)
It has the best score here (8.5), while responding about 3.0x faster than Grok 4.5 (medium).
विस्तृत तुलना
| मेट्रिक | GPT-5.4 GPT-5.4 medium | Grok 4.5 Grok 4.5 medium |
|---|---|---|
| स्कोर | 8.5 | 8.5 |
| रैंक | #56 | #60 |
| विश्वसनीयता | 10.0 | 10.0 |
| संगति | 8.6 | 8.9 |
| प्रयास | 66/66 | 66/66 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 77.3% | 83.3% |
| अस्थिर टेस्ट | 4 | 3 |
| कुल रन | 66 | 66 |
| प्रति परिणाम लागत | 10.399 | 12.007 |
| कुल लागत | $1.560 | $2.042 |
| इनपुट कीमत | $2.500 / 1M | $2.000 / 1M |
| आउटपुट कीमत | $15.000 / 1M | $6.000 / 1M |
| कुल इनपुट टोकन | 81,136 | 122,155 |
| आउटपुट टोकन | 6,155 | 5,514 |
| रीजनिंग टोकन | 84,311 | 293,946 |
| प्रतिक्रिया समय (औसत) | 22.85s | 68.59s |
| प्रतिक्रिया समय (अधिकतम) | 100.41s | 436.38s |
| प्रतिक्रिया समय (कुल) | 502.78s | 1508.91s |
| पैरामीटर | ~1.5T कुल (~100B सक्रिय) | ~1.7T कुल (~170B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#56 GPT-5.4
medium- लागत
- $0.214
- समय
- 199.6s
- टोकन
- 14,349 tok
#60 SpaceXAI: Grok 4.5
medium- लागत
- $0.044
- समय
- 59.4s
- टोकन
- 7,512 tok
स्कोर के अनुसार शीर्ष मॉडल
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
त्वरित तुलना
तुलना जोड़ी बदलें
DeepSeek V4.1 FlashhighvsGrok 4.5mediumDeepSeek V4.1 FlashlowvsGrok 4.5mediumMuse Spark 1.2lowvsGrok 4.5mediumGPT-5.4mediumvsQwen3.8 MaxlowDeepSeek V4.1 FlashlowvsGPT-5.4mediumDeepSeek V4.1 FlashhighvsGPT-5.4mediumMuse Spark 1.2lowvsGPT-5.4mediumQwen3.8 27BhighvsGrok 4.5mediumGPT-6 SollowvsGrok 4.5mediumQwen3.8 MaxlowvsGrok 4.5mediumInkling SmallhighvsGrok 4.5mediumGrok 4.5mediumvsGLM 5.3 FlashXmax