- র্যাঙ্ক
- #37
- মোট আউটপুট টোকেন
- 90,466
- প্রতিক্রিয়া সময় (গড়)
- 22.85s
- মোট খরচ
- $1.560
GPT-5.4 (medium) vs Grok 4.5 (low)
GPT-5.4 (medium) average score-এ এগিয়ে: 8.5 vs 8.4. Grok 4.5 (low)-এর benchmark খরচ কম: $0.945 vs $1.560. Grok 4.5 (low) দ্রুত: 16.17s vs 22.85s, pass rates 77.3% vs 77.3%.
- র্যাঙ্ক
- #41
- মোট আউটপুট টোকেন
- 115,489
- প্রতিক্রিয়া সময় (গড়)
- 16.17s
- মোট খরচ
- $0.945
প্রস্তাবিত মডেল
Grok 4.5 (low)
Its score stays close to the best score here (8.4 vs 8.5), while costing about 1.7x less than GPT-5.4 (medium).
বিস্তারিত তুলনা
| মেট্রিক | GPT-5.4 GPT-5.4 medium | Grok 4.5 Grok 4.5 low |
|---|---|---|
| স্কোর | 8.5 | 8.4 |
| র্যাঙ্ক | #37 | #41 |
| নির্ভরযোগ্যতা | 10.0 | 10.0 |
| ধারাবাহিকতা | 8.6 | 9.3 |
| প্রচেষ্টা | 66/66 | 66/66 |
| সঠিক টেস্ট | ||
| প্রতি চেষ্টায় পাস রেট | 77.3% | 77.3% |
| অস্থির টেস্ট | 4 | 2 |
| মোট রান | 66 | 66 |
| প্রতি ফলাফলে খরচ | 10.399 | 5.901 |
| মোট খরচ | $1.560 | $0.945 |
| ইনপুট মূল্য | $2.500 / 1M | $2.000 / 1M |
| আউটপুট মূল্য | $15.000 / 1M | $6.000 / 1M |
| মোট ইনপুট টোকেন | 81,136 | 125,605 |
| আউটপুট টোকেন | 6,155 | 7,505 |
| রিজনিং টোকেন | 84,311 | 107,984 |
| প্রতিক্রিয়া সময় (গড়) | 22.85s | 16.17s |
| প্রতিক্রিয়া সময় (সর্বোচ্চ) | 100.41s | 205.28s |
| প্রতিক্রিয়া সময় (মোট) | 502.78s | 355.67s |
| প্যারামিটার | ~1.5T মোট (~100B সক্রিয়) | ~1.7T মোট (~170B সক্রিয়) |
| উপলভ্যতা | বন্ধ উৎস | বন্ধ উৎস |
মডেল জেনারেশন শোকেস
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#37 GPT-5.4
medium- খরচ
- $0.214
- সময়
- 199.6s
- টোকেন
- 14,349 tok
#41 SpaceXAI: Grok 4.5
low- খরচ
- $0.011
- সময়
- 12.4s
- টোকেন
- 2,018 tok
স্কোর অনুযায়ী শীর্ষ মডেল
স্কোর বনাম মোট খরচ
প্রতিক্রিয়া সময় (গড়)
স্কোর vs প্রতিক্রিয়া সময় (গড়)
মোট আউটপুট টোকেন
স্কোর vs মোট আউটপুট টোকেন
বিভাগভিত্তিক বিশ্লেষণ
দ্রুত তুলনা
তুলনার জুটি বদলান
GPT-5.2mediumvsGrok 4.5lowQwen3.8 27BhighvsGrok 4.5lowSeed 2.1 TurbomediumvsGrok 4.5lowInkling SmallhighvsGrok 4.5lowGPT-5.4mediumvsQwen3.8 MaxlowMuse Spark 1.2lowvsGPT-5.4mediumGPT-5.4mediumvsQwen3.8 27BhighMuse Spark 1.2highvsGPT-5.4mediumGPT-5.4mediumvsInkling SmallhighGemini 2.5 FlashmediumvsGrok 4.5lowQwen3.6 Max PreviewmediumvsGrok 4.5lowGPT-5.4mediumvsGLM 5.3 Flashmax