- क्रमांक
- #26
- एकूण आउटपुट टोकन्स
- 88,670
- प्रतिसाद वेळ (सरासरी)
- 23.10s
- एकूण खर्च
- $1.533
GPT-5.4 (medium) vs GPT-5.5 (medium)
GPT-5.5 (medium) average score मध्ये पुढे आहे: 9.0 vs 8.5. GPT-5.4 (medium) चा benchmark खर्च कमी आहे: $1.533 vs $4.137. GPT-5.4 (medium) वेगवान आहे: 23.10s vs 38.42s, pass rates 77.3% vs 87.9%.
- क्रमांक
- #16
- एकूण आउटपुट टोकन्स
- 124,436
- प्रतिसाद वेळ (सरासरी)
- 38.42s
- एकूण खर्च
- $4.137
शिफारस केलेले मॉडेल
GPT-5.4 (medium)
Its score stays close to the best score here (8.5 vs 9.0), while costing about 2.7x less than GPT-5.5 (medium).
तपशीलवार तुलना
| मेट्रिक | GPT-5.4 GPT-5.4 medium | GPT-5.5 GPT-5.5 medium |
|---|---|---|
| स्कोअर | 8.5 | 9.0 |
| क्रमांक | #26 | #16 |
| विश्वसनीयता | 10.0 | 10.0 |
| सुसंगतता | 8.6 | 8.9 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 77.3% | 87.9% |
| अस्थिर चाचण्या | 4 | 3 |
| एकूण रन | 66 | 66 |
| प्रति निकाल खर्च | 10.220 | 22.980 |
| एकूण खर्च | $1.533 | $4.137 |
| इनपुट किंमत | $2.500 / 1M | $5.000 / 1M |
| आउटपुट किंमत | $15.000 / 1M | $30.000 / 1M |
| एकूण इनपुट टोकन्स | 81,127 | 80,659 |
| आउटपुट टोकन्स | 6,155 | 5,617 |
| रिझनिंग टोकन्स | 82,515 | 118,819 |
| प्रतिसाद वेळ (सरासरी) | 23.10s | 38.42s |
| प्रतिसाद वेळ (कमाल) | 100.41s | 332.10s |
| प्रतिसाद वेळ (एकूण) | 508.26s | 845.35s |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#26 GPT-5.4
medium- खर्च
- $0.214
- वेळ
- 199.6s
- टोकन्स
- 14,349 tok
#16 GPT-5.5
medium- खर्च
- $0.112
- वेळ
- 71.9s
- टोकन्स
- 3,807 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
Gemini 3.5 FlashlowvsGPT-5.5mediumGPT-5.5mediumvsGrok 4.5highClaude Opus 5lowvsGPT-5.4mediumGPT-5.4mediumvsGrok 4.5lowGPT-5.4mediumvsInkling SmallhighGemini 3.6 FlashlowvsGPT-5.5mediumGemini 3.5 Flash LitehighvsGPT-5.5mediumClaude Opus 5highvsGPT-5.5mediumMuse Spark 1.1lowvsGPT-5.4mediumGemini 3.5 Flash LitehighvsGPT-5.4mediumDeepSeek V4 Flash 0731lowvsGPT-5.4mediumClaude Opus 5lowvsGPT-5.5medium