- क्रमांक
- #47
- एकूण आउटपुट टोकन्स
- 71,252
- प्रतिसाद वेळ (सरासरी)
- 28.51s
- एकूण खर्च
- $1.182
GPT-5.2 (medium) vs GPT-5.4 (medium)
GPT-5.4 (medium) average score मध्ये पुढे आहे: 8.5 vs 8.4. GPT-5.2 (medium) चा benchmark खर्च कमी आहे: $1.182 vs $1.560. GPT-5.4 (medium) वेगवान आहे: 22.85s vs 28.51s, pass rates 72.7% vs 77.3%.
- क्रमांक
- #42
- एकूण आउटपुट टोकन्स
- 90,466
- प्रतिसाद वेळ (सरासरी)
- 22.85s
- एकूण खर्च
- $1.560
शिफारस केलेले मॉडेल
GPT-5.4 (medium)
It has the strongest score in this comparison (8.5) and the best overall balance of cost and response time across all 2 models.
तपशीलवार तुलना
| मेट्रिक | GPT-5.2 GPT-5.2 medium | GPT-5.4 GPT-5.4 medium |
|---|---|---|
| स्कोअर | 8.4 | 8.5 |
| क्रमांक | #47 | #42 |
| विश्वसनीयता | 10.0 | 10.0 |
| सुसंगतता | 8.5 | 8.6 |
| प्रयत्न | 66/66 | 66/66 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 72.7% | 77.3% |
| अस्थिर चाचण्या | 4 | 4 |
| एकूण रन | 66 | 66 |
| प्रति निकाल खर्च | 8.438 | 10.399 |
| एकूण खर्च | $1.182 | $1.560 |
| इनपुट किंमत | $1.750 / 1M | $2.500 / 1M |
| आउटपुट किंमत | $14.000 / 1M | $15.000 / 1M |
| एकूण इनपुट टोकन्स | 105,013 | 81,136 |
| आउटपुट टोकन्स | 9,914 | 6,155 |
| रिझनिंग टोकन्स | 61,338 | 84,311 |
| प्रतिसाद वेळ (सरासरी) | 28.51s | 22.85s |
| प्रतिसाद वेळ (कमाल) | 116.86s | 100.41s |
| प्रतिसाद वेळ (एकूण) | 456.13s | 502.78s |
| पॅरामीटर्स | ~1.2T एकूण (~80B सक्रिय) | ~1.5T एकूण (~100B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#47 GPT-5.2
medium- खर्च
- $0.047
- वेळ
- 49.2s
- टोकन्स
- 3,396 tok
#42 GPT-5.4
medium- खर्च
- $0.214
- वेळ
- 199.6s
- टोकन्स
- 14,349 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
GPT-5.2mediumvsQwen3.8 27BhighGPT-5.2mediumvsGrok 4.5lowGPT-5.2mediumvsInkling SmallhighGPT-5.4mediumvsQwen3.8 MaxlowMuse Spark 1.2lowvsGPT-5.2mediumMuse Spark 1.2lowvsGPT-5.4mediumMuse Spark 1.1lowvsGPT-5.2mediumGPT-5.4mediumvsGrok 4.5lowGPT-5.4mediumvsQwen3.8 27BhighMuse Spark 1.2highvsGPT-5.4mediumGPT-5.4mediumvsInkling SmallhighGPT-5.2mediumvsQwen3.8 Maxlow