- درجہ
- #48
- کل آؤٹ پٹ ٹوکنز
- 71,252
- ردِعمل کا وقت (اوسط)
- 28.51s
- کل لاگت
- $1.182
GPT-5.2 (medium) vs GPT-5.4 (medium)
GPT-5.4 (medium) average score میں آگے ہے: 8.5 vs 8.4. GPT-5.2 (medium) کی benchmark لاگت کم ہے: $1.182 vs $1.560. GPT-5.4 (medium) تیز ہے: 22.85s vs 28.51s، pass rates 72.7% vs 77.3%.
- درجہ
- #43
- کل آؤٹ پٹ ٹوکنز
- 90,466
- ردِعمل کا وقت (اوسط)
- 22.85s
- کل لاگت
- $1.560
تجویز کردہ ماڈل
GPT-5.4 (medium)
It has the strongest score in this comparison (8.5) and the best overall balance of cost and response time across all 2 models.
تفصیلی موازنہ
| میٹرک | GPT-5.2 GPT-5.2 medium | GPT-5.4 GPT-5.4 medium |
|---|---|---|
| اسکور | 8.4 | 8.5 |
| درجہ | #48 | #43 |
| اعتماد پذیری | 10.0 | 10.0 |
| تسلسل | 8.5 | 8.6 |
| کوششیں | 66/66 | 66/66 |
| درست ٹیسٹس | ||
| فی کوشش کامیابی کی شرح | 72.7% | 77.3% |
| غیر مستحکم ٹیسٹ | 4 | 4 |
| کل رنز | 66 | 66 |
| فی نتیجہ لاگت | 8.438 | 10.399 |
| کل لاگت | $1.182 | $1.560 |
| ان پٹ قیمت | $1.750 / 1M | $2.500 / 1M |
| آؤٹ پٹ قیمت | $14.000 / 1M | $15.000 / 1M |
| کل ان پٹ ٹوکنز | 105,013 | 81,136 |
| آؤٹ پٹ ٹوکنز | 9,914 | 6,155 |
| ریزننگ ٹوکنز | 61,338 | 84,311 |
| ردِعمل کا وقت (اوسط) | 28.51s | 22.85s |
| ردِعمل کا وقت (زیادہ سے زیادہ) | 116.86s | 100.41s |
| ردِعمل کا وقت (کل) | 456.13s | 502.78s |
| پیرامیٹرز | ~1.2T کل (~80B فعال) | ~1.5T کل (~100B فعال) |
| دستیابی | بند ماخذ | بند ماخذ |
ماڈل جنریشن شوکیس
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#48 GPT-5.2
medium- لاگت
- $0.047
- وقت
- 49.2s
- ٹوکنز
- 3,396 tok
#43 GPT-5.4
medium- لاگت
- $0.214
- وقت
- 199.6s
- ٹوکنز
- 14,349 tok
اسکور کے لحاظ سے سرفہرست ماڈلز
اسکور بمقابلہ کل لاگت
ردِعمل کا وقت (اوسط)
اسکور vs ردِعمل کا وقت (اوسط)
کل آؤٹ پٹ ٹوکنز
اسکور vs کل آؤٹ پٹ ٹوکنز
زمرہ وار تفصیل
فوری موازنہ
موازنہ کی جوڑی تبدیل کریں
GPT-5.2mediumvsQwen3.8 27BhighGPT-5.2mediumvsGrok 4.5lowGPT-5.2mediumvsInkling SmallhighGPT-5.4mediumvsQwen3.8 MaxlowMuse Spark 1.2lowvsGPT-5.2mediumMuse Spark 1.2lowvsGPT-5.4mediumMuse Spark 1.1lowvsGPT-5.2mediumGPT-5.4mediumvsGrok 4.5lowGPT-5.4mediumvsQwen3.8 27BhighMuse Spark 1.2highvsGPT-5.4mediumGPT-5.4mediumvsInkling SmallhighGPT-5.2mediumvsQwen3.8 Maxlow