- क्रमांक
- #50
- एकूण आउटपुट टोकन्स
- 96,502
- प्रतिसाद वेळ (सरासरी)
- 24.81s
- एकूण खर्च
- $2.006
GPT-5.4 (medium) vs GPT-5.5 (medium)
GPT-5.5 (medium) average score मध्ये पुढे आहे: 9.2 vs 8.8. GPT-5.4 (medium) चा benchmark खर्च कमी आहे: $2.006 vs $4.809. GPT-5.4 (medium) वेगवान आहे: 24.81s vs 39.86s, pass rates 78.3% vs 88.4%.
तुलना केलेली मॉडेल्स
- क्रमांक
- #30
- एकूण आउटपुट टोकन्स
- 130,107
- प्रतिसाद वेळ (सरासरी)
- 39.86s
- एकूण खर्च
- $4.809
शिफारस केलेले मॉडेल
GPT-5.4 (medium)
Its score stays close to the best score here (8.8 vs 9.2), while costing about 2.4x less than GPT-5.5 (medium).
तपशीलवार तुलना
| मेट्रिक | GPT-5.4 GPT-5.4 medium | GPT-5.5 GPT-5.5 medium |
|---|---|---|
| स्कोअर | 8.8 | 9.2 |
| क्रमांक | #50 | #30 |
| विश्वसनीयता | 10.0 | 10.0 |
| सुसंगतता | 8.7 | 9.0 |
| प्रयत्न | 69/69 | 69/69 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 78.3% | 88.4% |
| अस्थिर चाचण्या | 4 | 3 |
| एकूण रन | 69 | 69 |
| प्रति निकाल खर्च | 12.535 | 25.306 |
| एकूण खर्च | $2.006 | $4.809 |
| इनपुट किंमत | $2.500 / 1M | $5.000 / 1M |
| आउटपुट किंमत | $15.000 / 1M | $30.000 / 1M |
| एकूण इनपुट टोकन्स | 223,210 | 180,959 |
| आउटपुट टोकन्स | 7,312 | 6,472 |
| रिझनिंग टोकन्स | 89,190 | 123,635 |
| प्रतिसाद वेळ (सरासरी) | 24.81s | 39.86s |
| प्रतिसाद वेळ (कमाल) | 100.41s | 332.10s |
| प्रतिसाद वेळ (एकूण) | 570.60s | 916.82s |
| पॅरामीटर्स | ~1.5T एकूण (~100B सक्रिय) | ~1.5T एकूण (~100B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#50 GPT-5.4
medium- खर्च
- $0.214
- वेळ
- 199.6s
- टोकन्स
- 14,349 tok
#30 GPT-5.5
medium- खर्च
- $0.112
- वेळ
- 71.9s
- टोकन्स
- 3,807 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
Claude Sonnet 5.5maxvsGPT-5.5mediumGPT-5.4mediumvsQwen3.8 MAXlowDeepSeek V4.1 FlashhighvsGPT-5.4mediumGPT-5.5mediumvsQwen3.8 Max (0902)highMuse Spark 1.2lowvsGPT-5.4mediumMuse Spark 1.3highvsGPT-5.5mediumSeed 2.1 TurbolowvsGPT-5.5mediumGPT-5.5mediumvsParetononeSeed 2.1 TurbohighvsGPT-5.5mediumMuse Spark 1.2highvsGPT-5.4mediumGPT-5.4mediumvsQwen3.8 27Bhighमोफत उपलब्धGemini 3.5 FlashlowvsGPT-5.5medium