- रैंक
- #38
- कुल आउटपुट टोकन
- 90,466
- प्रतिक्रिया समय (औसत)
- 22.85s
- कुल लागत
- $1.560
GPT-5.4 (medium) vs Grok 4.6 (medium)
GPT-5.4 (medium) average score में आगे है: 8.5 vs 8.4. GPT-5.4 (medium) की benchmark लागत कम है: $1.560 vs $1.713. GPT-5.4 (medium) तेज है: 22.85s vs 73.46s, pass rates 77.3% vs 81.8%.
- रैंक
- #41
- कुल आउटपुट टोकन
- 249,808
- प्रतिक्रिया समय (औसत)
- 73.46s
- कुल लागत
- $1.713
अनुशंसित मॉडल
GPT-5.4 (medium)
It has the best score here (8.5), while responding about 3.2x faster than Grok 4.6 (medium).
विस्तृत तुलना
| मेट्रिक | GPT-5.4 GPT-5.4 medium | Grok 4.6 Grok 4.6 medium |
|---|---|---|
| स्कोर | 8.5 | 8.4 |
| रैंक | #38 | #41 |
| विश्वसनीयता | 10.0 | 10.0 |
| संगति | 8.6 | 8.6 |
| प्रयास | 66/66 | 66/66 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 77.3% | 81.8% |
| अस्थिर टेस्ट | 4 | 4 |
| कुल रन | 66 | 66 |
| प्रति परिणाम लागत | 10.399 | 10.703 |
| कुल लागत | $1.560 | $1.713 |
| इनपुट कीमत | $2.500 / 1M | $2.000 / 1M |
| आउटपुट कीमत | $15.000 / 1M | $6.000 / 1M |
| कुल इनपुट टोकन | 81,136 | 106,787 |
| आउटपुट टोकन | 6,155 | 4,811 |
| रीजनिंग टोकन | 84,311 | 244,997 |
| प्रतिक्रिया समय (औसत) | 22.85s | 73.46s |
| प्रतिक्रिया समय (अधिकतम) | 100.41s | 514.35s |
| प्रतिक्रिया समय (कुल) | 502.78s | 1616.12s |
| पैरामीटर | ~1.5T कुल (~100B सक्रिय) | ~1.7T कुल (~170B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#38 GPT-5.4
medium- लागत
- $0.214
- समय
- 199.6s
- टोकन
- 14,349 tok
#41 SpaceXAI: Grok 4.6
medium- लागत
- $0.028
- समय
- 72.1s
- टोकन
- 4,771 tok
स्कोर के अनुसार शीर्ष मॉडल
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
त्वरित तुलना
तुलना जोड़ी बदलें
Muse Spark 1.2lowvsGrok 4.6mediumGPT-5.4mediumvsQwen3.8 MaxlowQwen3.8 27BhighvsGrok 4.6mediumInkling SmallhighvsGrok 4.6mediumMuse Spark 1.2lowvsGPT-5.4mediumQwen3.8 MaxlowvsGrok 4.6mediumGPT-5.4mediumvsGrok 4.5lowMuse Spark 1.1lowvsGrok 4.6mediumGPT-5.4mediumvsQwen3.8 27BhighMuse Spark 1.2highvsGPT-5.4mediumGPT-5.4mediumvsInkling SmallhighGPT-5.4mediumvsGLM 5.3 Flashmax