- র্যাঙ্ক
- #26
- মোট আউটপুট টোকেন
- 88,670
- প্রতিক্রিয়া সময় (গড়)
- 23.10s
- মোট খরচ
- $1.533
GPT-5.4 (medium) vs GPT-5.5 (medium)
GPT-5.5 (medium) average score-এ এগিয়ে: 9.0 vs 8.5. GPT-5.4 (medium)-এর benchmark খরচ কম: $1.533 vs $4.137. GPT-5.4 (medium) দ্রুত: 23.10s vs 38.42s, pass rates 77.3% vs 87.9%.
- র্যাঙ্ক
- #16
- মোট আউটপুট টোকেন
- 124,436
- প্রতিক্রিয়া সময় (গড়)
- 38.42s
- মোট খরচ
- $4.137
প্রস্তাবিত মডেল
GPT-5.4 (medium)
Its score stays close to the best score here (8.5 vs 9.0), while costing about 2.7x less than GPT-5.5 (medium).
বিস্তারিত তুলনা
| মেট্রিক | GPT-5.4 GPT-5.4 medium | GPT-5.5 GPT-5.5 medium |
|---|---|---|
| স্কোর | 8.5 | 9.0 |
| র্যাঙ্ক | #26 | #16 |
| নির্ভরযোগ্যতা | 10.0 | 10.0 |
| ধারাবাহিকতা | 8.6 | 8.9 |
| সঠিক টেস্ট | ||
| প্রতি চেষ্টায় পাস রেট | 77.3% | 87.9% |
| অস্থির টেস্ট | 4 | 3 |
| মোট রান | 66 | 66 |
| প্রতি ফলাফলে খরচ | 10.220 | 22.980 |
| মোট খরচ | $1.533 | $4.137 |
| ইনপুট মূল্য | $2.500 / 1M | $5.000 / 1M |
| আউটপুট মূল্য | $15.000 / 1M | $30.000 / 1M |
| মোট ইনপুট টোকেন | 81,127 | 80,659 |
| আউটপুট টোকেন | 6,155 | 5,617 |
| রিজনিং টোকেন | 82,515 | 118,819 |
| প্রতিক্রিয়া সময় (গড়) | 23.10s | 38.42s |
| প্রতিক্রিয়া সময় (সর্বোচ্চ) | 100.41s | 332.10s |
| প্রতিক্রিয়া সময় (মোট) | 508.26s | 845.35s |
মডেল জেনারেশন শোকেস
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#26 GPT-5.4
medium- খরচ
- $0.214
- সময়
- 199.6s
- টোকেন
- 14,349 tok
#16 GPT-5.5
medium- খরচ
- $0.112
- সময়
- 71.9s
- টোকেন
- 3,807 tok
স্কোর অনুযায়ী শীর্ষ মডেল
স্কোর বনাম মোট খরচ
প্রতিক্রিয়া সময় (গড়)
স্কোর vs প্রতিক্রিয়া সময় (গড়)
মোট আউটপুট টোকেন
স্কোর vs মোট আউটপুট টোকেন
বিভাগভিত্তিক বিশ্লেষণ
দ্রুত তুলনা
তুলনার জুটি বদলান
Gemini 3.5 FlashlowvsGPT-5.5mediumGPT-5.5mediumvsGrok 4.5highClaude Opus 5lowvsGPT-5.4mediumGPT-5.4mediumvsGrok 4.5lowGPT-5.4mediumvsInkling SmallhighGemini 3.6 FlashlowvsGPT-5.5mediumGemini 3.5 Flash LitehighvsGPT-5.5mediumClaude Opus 5highvsGPT-5.5mediumMuse Spark 1.1lowvsGPT-5.4mediumGemini 3.5 Flash LitehighvsGPT-5.4mediumDeepSeek V4 Flash 0731lowvsGPT-5.4mediumClaude Opus 5lowvsGPT-5.5medium