- रैंक
- #50
- कुल आउटपुट टोकन
- 96,502
- प्रतिक्रिया समय (औसत)
- 24.81s
- कुल लागत
- $2.006
GPT-5.4 (medium) vs GPT-5.5 (medium)
GPT-5.5 (medium) average score में आगे है: 9.2 vs 8.8. GPT-5.4 (medium) की benchmark लागत कम है: $2.006 vs $4.809. GPT-5.4 (medium) तेज है: 24.81s vs 39.86s, pass rates 78.3% vs 88.4%.
तुलना किए गए मॉडल
- रैंक
- #30
- कुल आउटपुट टोकन
- 130,107
- प्रतिक्रिया समय (औसत)
- 39.86s
- कुल लागत
- $4.809
अनुशंसित मॉडल
GPT-5.4 (medium)
Its score stays close to the best score here (8.8 vs 9.2), while costing about 2.4x less than GPT-5.5 (medium).
विस्तृत तुलना
| मेट्रिक | GPT-5.4 GPT-5.4 medium | GPT-5.5 GPT-5.5 medium |
|---|---|---|
| स्कोर | 8.8 | 9.2 |
| रैंक | #50 | #30 |
| विश्वसनीयता | 10.0 | 10.0 |
| संगति | 8.7 | 9.0 |
| प्रयास | 69/69 | 69/69 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 78.3% | 88.4% |
| अस्थिर टेस्ट | 4 | 3 |
| कुल रन | 69 | 69 |
| प्रति परिणाम लागत | 12.535 | 25.306 |
| कुल लागत | $2.006 | $4.809 |
| इनपुट कीमत | $2.500 / 1M | $5.000 / 1M |
| आउटपुट कीमत | $15.000 / 1M | $30.000 / 1M |
| कुल इनपुट टोकन | 223,210 | 180,959 |
| आउटपुट टोकन | 7,312 | 6,472 |
| रीजनिंग टोकन | 89,190 | 123,635 |
| प्रतिक्रिया समय (औसत) | 24.81s | 39.86s |
| प्रतिक्रिया समय (अधिकतम) | 100.41s | 332.10s |
| प्रतिक्रिया समय (कुल) | 570.60s | 916.82s |
| पैरामीटर | ~1.5T कुल (~100B सक्रिय) | ~1.5T कुल (~100B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#50 GPT-5.4
medium- लागत
- $0.214
- समय
- 199.6s
- टोकन
- 14,349 tok
#30 GPT-5.5
medium- लागत
- $0.112
- समय
- 71.9s
- टोकन
- 3,807 tok
स्कोर के अनुसार शीर्ष मॉडल
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
त्वरित तुलना
तुलना जोड़ी बदलें
Claude Sonnet 5.5maxvsGPT-5.5mediumGPT-5.4mediumvsQwen3.8 MAXlowDeepSeek V4.1 FlashhighvsGPT-5.4mediumGPT-5.5mediumvsQwen3.8 Max (0902)highMuse Spark 1.2lowvsGPT-5.4mediumMuse Spark 1.3highvsGPT-5.5mediumSeed 2.1 TurbolowvsGPT-5.5mediumGPT-5.5mediumvsParetononeSeed 2.1 TurbohighvsGPT-5.5mediumMuse Spark 1.2highvsGPT-5.4mediumGPT-5.4mediumvsQwen3.8 27Bhighनिःशुल्क उपलब्धGemini 3.5 FlashlowvsGPT-5.5medium