- র্যাঙ্ক
- #64
- মোট আউটপুট টোকেন
- 71,252
- প্রতিক্রিয়া সময় (গড়)
- 28.51s
- মোট খরচ
- $1.182
GPT-5.2 (medium) vs Grok 4.5 (medium)
Grok 4.5 (medium) average score-এ এগিয়ে: 8.5 vs 8.4. GPT-5.2 (medium)-এর benchmark খরচ কম: $1.182 vs $2.042. GPT-5.2 (medium) দ্রুত: 28.51s vs 68.59s, pass rates 72.7% vs 83.3%.
তুলনা করা মডেল
- র্যাঙ্ক
- #60
- মোট আউটপুট টোকেন
- 299,460
- প্রতিক্রিয়া সময় (গড়)
- 68.59s
- মোট খরচ
- $2.042
প্রস্তাবিত মডেল
GPT-5.2 (medium)
Its score stays close to the best score here (8.4 vs 8.5), while costing about 1.7x less than Grok 4.5 (medium).
বিস্তারিত তুলনা
| মেট্রিক | GPT-5.2 GPT-5.2 medium | Grok 4.5 Grok 4.5 medium |
|---|---|---|
| স্কোর | 8.4 | 8.5 |
| র্যাঙ্ক | #64 | #60 |
| নির্ভরযোগ্যতা | 10.0 | 10.0 |
| ধারাবাহিকতা | 8.5 | 8.9 |
| প্রচেষ্টা | 66/66 | 66/66 |
| সঠিক টেস্ট | ||
| প্রতি চেষ্টায় পাস রেট | 72.7% | 83.3% |
| অস্থির টেস্ট | 4 | 3 |
| মোট রান | 66 | 66 |
| প্রতি ফলাফলে খরচ | 8.438 | 12.007 |
| মোট খরচ | $1.182 | $2.042 |
| ইনপুট মূল্য | $1.750 / 1M | $2.000 / 1M |
| আউটপুট মূল্য | $14.000 / 1M | $6.000 / 1M |
| মোট ইনপুট টোকেন | 105,013 | 122,155 |
| আউটপুট টোকেন | 9,914 | 5,514 |
| রিজনিং টোকেন | 61,338 | 293,946 |
| প্রতিক্রিয়া সময় (গড়) | 28.51s | 68.59s |
| প্রতিক্রিয়া সময় (সর্বোচ্চ) | 116.86s | 436.38s |
| প্রতিক্রিয়া সময় (মোট) | 456.13s | 1508.91s |
| প্যারামিটার | ~1.2T মোট (~80B সক্রিয়) | ~1.7T মোট (~170B সক্রিয়) |
| উপলভ্যতা | বন্ধ উৎস | বন্ধ উৎস |
মডেল জেনারেশন শোকেস
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#64 GPT-5.2
medium- খরচ
- $0.047
- সময়
- 49.2s
- টোকেন
- 3,396 tok
#60 SpaceXAI: Grok 4.5
medium- খরচ
- $0.044
- সময়
- 59.4s
- টোকেন
- 7,512 tok
স্কোর অনুযায়ী শীর্ষ মডেল
স্কোর বনাম মোট খরচ
প্রতিক্রিয়া সময় (গড়)
স্কোর vs প্রতিক্রিয়া সময় (গড়)
মোট আউটপুট টোকেন
স্কোর vs মোট আউটপুট টোকেন
বিভাগভিত্তিক বিশ্লেষণ
দ্রুত তুলনা
তুলনার জুটি বদলান
GPT-5.2mediumvsQwen3.8 27BhighGPT-5.2mediumvsGrok 4.5lowDeepSeek V4.1 FlashhighvsGrok 4.5mediumDeepSeek V4.1 FlashlowvsGrok 4.5mediumMuse Spark 1.2lowvsGrok 4.5mediumGPT-5.2mediumvsInkling SmallhighGPT-5.2mediumvsGLM 5.3 FlashXmaxDeepSeek V4.1 FlashmaxvsGPT-5.2mediumMuse Spark 1.2lowvsGPT-5.2mediumQwen3.8 27BhighvsGrok 4.5mediumDeepSeek V4.1 FlashhighvsGPT-5.2mediumDeepSeek V4.1 FlashlowvsGPT-5.2medium