- रैंक
- #50
- कुल आउटपुट टोकन
- 90,466
- प्रतिक्रिया समय (औसत)
- 22.85s
- कुल लागत
- $1.560
GPT-5.4 (medium) vs Grok 4.5 (low)
GPT-5.4 (medium) average score में आगे है: 8.5 vs 8.4. Grok 4.5 (low) की benchmark लागत कम है: $0.945 vs $1.560. Grok 4.5 (low) तेज है: 16.17s vs 22.85s, pass rates 77.3% vs 77.3%.
तुलना किए गए मॉडल
- रैंक
- #57
- कुल आउटपुट टोकन
- 115,489
- प्रतिक्रिया समय (औसत)
- 16.17s
- कुल लागत
- $0.945
अनुशंसित मॉडल
Grok 4.5 (low)
Its score stays close to the best score here (8.4 vs 8.5), while costing about 1.7x less than GPT-5.4 (medium).
विस्तृत तुलना
| मेट्रिक | GPT-5.4 GPT-5.4 medium | Grok 4.5 Grok 4.5 low |
|---|---|---|
| स्कोर | 8.5 | 8.4 |
| रैंक | #50 | #57 |
| विश्वसनीयता | 10.0 | 10.0 |
| संगति | 8.6 | 9.3 |
| प्रयास | 66/66 | 66/66 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 77.3% | 77.3% |
| अस्थिर टेस्ट | 4 | 2 |
| कुल रन | 66 | 66 |
| प्रति परिणाम लागत | 10.399 | 5.901 |
| कुल लागत | $1.560 | $0.945 |
| इनपुट कीमत | $2.500 / 1M | $2.000 / 1M |
| आउटपुट कीमत | $15.000 / 1M | $6.000 / 1M |
| कुल इनपुट टोकन | 81,136 | 125,605 |
| आउटपुट टोकन | 6,155 | 7,505 |
| रीजनिंग टोकन | 84,311 | 107,984 |
| प्रतिक्रिया समय (औसत) | 22.85s | 16.17s |
| प्रतिक्रिया समय (अधिकतम) | 100.41s | 205.28s |
| प्रतिक्रिया समय (कुल) | 502.78s | 355.67s |
| पैरामीटर | ~1.5T कुल (~100B सक्रिय) | ~1.7T कुल (~170B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#50 GPT-5.4
medium- लागत
- $0.214
- समय
- 199.6s
- टोकन
- 14,349 tok
#57 SpaceXAI: Grok 4.5
low- लागत
- $0.011
- समय
- 12.4s
- टोकन
- 2,018 tok
स्कोर के अनुसार शीर्ष मॉडल
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
त्वरित तुलना
तुलना जोड़ी बदलें
GPT-5.2mediumvsGrok 4.5lowQwen3.8 27BhighvsGrok 4.5lowSeed 2.1 TurbomediumvsGrok 4.5lowInkling SmallhighvsGrok 4.5lowGPT-5.4mediumvsQwen3.8 MaxlowDeepSeek V4.1 FlashlowvsGPT-5.4mediumDeepSeek V4.1 FlashhighvsGPT-5.4mediumDeepSeek V4.1 FlashmaxvsGrok 4.5lowDeepSeek V4.1 FlashmediumvsGrok 4.5lowMuse Spark 1.2lowvsGPT-5.4mediumDeepSeek V4.1 FlashhighvsGrok 4.5lowClaude Fable 5.1mediumvsGrok 4.5low