- रैंक
- #26
- कुल आउटपुट टोकन
- 88,670
- प्रतिक्रिया समय (औसत)
- 23.10s
- कुल लागत
- $1.533
GPT-5.4 (medium) vs GPT-5.5 (medium)
GPT-5.5 (medium) average score में आगे है: 9.0 vs 8.5. GPT-5.4 (medium) की benchmark लागत कम है: $1.533 vs $4.137. GPT-5.4 (medium) तेज है: 23.10s vs 38.42s, pass rates 77.3% vs 87.9%.
- रैंक
- #16
- कुल आउटपुट टोकन
- 124,436
- प्रतिक्रिया समय (औसत)
- 38.42s
- कुल लागत
- $4.137
अनुशंसित मॉडल
GPT-5.4 (medium)
Its score stays close to the best score here (8.5 vs 9.0), while costing about 2.7x less than GPT-5.5 (medium).
विस्तृत तुलना
| मेट्रिक | GPT-5.4 GPT-5.4 medium | GPT-5.5 GPT-5.5 medium |
|---|---|---|
| स्कोर | 8.5 | 9.0 |
| रैंक | #26 | #16 |
| विश्वसनीयता | 10.0 | 10.0 |
| संगति | 8.6 | 8.9 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 77.3% | 87.9% |
| अस्थिर टेस्ट | 4 | 3 |
| कुल रन | 66 | 66 |
| प्रति परिणाम लागत | 10.220 | 22.980 |
| कुल लागत | $1.533 | $4.137 |
| इनपुट कीमत | $2.500 / 1M | $5.000 / 1M |
| आउटपुट कीमत | $15.000 / 1M | $30.000 / 1M |
| कुल इनपुट टोकन | 81,127 | 80,659 |
| आउटपुट टोकन | 6,155 | 5,617 |
| रीजनिंग टोकन | 82,515 | 118,819 |
| प्रतिक्रिया समय (औसत) | 23.10s | 38.42s |
| प्रतिक्रिया समय (अधिकतम) | 100.41s | 332.10s |
| प्रतिक्रिया समय (कुल) | 508.26s | 845.35s |
मॉडल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#26 GPT-5.4
medium- लागत
- $0.214
- समय
- 199.6s
- टोकन
- 14,349 tok
#16 GPT-5.5
medium- लागत
- $0.112
- समय
- 71.9s
- टोकन
- 3,807 tok
स्कोर के अनुसार शीर्ष मॉडल
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
त्वरित तुलना
तुलना जोड़ी बदलें
Gemini 3.5 FlashlowvsGPT-5.5mediumGPT-5.5mediumvsGrok 4.5highClaude Opus 5lowvsGPT-5.4mediumGPT-5.4mediumvsGrok 4.5lowGPT-5.4mediumvsInkling SmallhighGemini 3.6 FlashlowvsGPT-5.5mediumGemini 3.5 Flash LitehighvsGPT-5.5mediumClaude Opus 5highvsGPT-5.5mediumMuse Spark 1.1lowvsGPT-5.4mediumGemini 3.5 Flash LitehighvsGPT-5.4mediumDeepSeek V4 Flash 0731lowvsGPT-5.4mediumClaude Opus 5lowvsGPT-5.5medium