- র্যাঙ্ক
- #54
- মোট আউটপুট টোকেন
- 80,538
- প্রতিক্রিয়া সময় (গড়)
- 31.29s
- মোট খরচ
- $1.558
GPT-5.2 (medium) vs Grok 4.6 (high)
GPT-5.2 (medium) average score-এ এগিয়ে: 8.7 vs 8.5. GPT-5.2 (medium)-এর benchmark খরচ কম: $1.558 vs $2.629. GPT-5.2 (medium) দ্রুত: 31.29s vs 87.48s, pass rates 73.9% vs 82.6%.
তুলনা করা মডেল
- র্যাঙ্ক
- #64
- মোট আউটপুট টোকেন
- 312,614
- প্রতিক্রিয়া সময় (গড়)
- 87.48s
- মোট খরচ
- $2.629
প্রস্তাবিত মডেল
GPT-5.2 (medium)
It has the best score here (8.7), while costing about 1.7x less than Grok 4.6 (high).
বিস্তারিত তুলনা
| মেট্রিক | GPT-5.2 GPT-5.2 medium | Grok 4.6 Grok 4.6 high |
|---|---|---|
| স্কোর | 8.7 | 8.5 |
| র্যাঙ্ক | #54 | #64 |
| নির্ভরযোগ্যতা | 10.0 | 10.0 |
| ধারাবাহিকতা | 8.5 | 10.0 |
| প্রচেষ্টা | 69/69 | 69/69 |
| সঠিক টেস্ট | ||
| প্রতি চেষ্টায় পাস রেট | 73.9% | 82.6% |
| অস্থির টেস্ট | 4 | 0 |
| মোট রান | 69 | 69 |
| প্রতি ফলাফলে খরচ | 10.261 | 13.833 |
| মোট খরচ | $1.558 | $2.629 |
| ইনপুট মূল্য | $1.750 / 1M | $2.000 / 1M |
| আউটপুট মূল্য | $14.000 / 1M | $6.000 / 1M |
| ক্যাশ পড়ার মূল্য | $0.175 / 1M | $0.500 / 1M |
| ক্যাশ লেখার মূল্য | প্রযোজ্য নয় | প্রযোজ্য নয় |
| মোট ইনপুট টোকেন | 235,207 | 376,233 |
| আউটপুট টোকেন | 11,065 | 6,687 |
| রিজনিং টোকেন | 69,473 | 305,927 |
| প্রতিক্রিয়া সময় (গড়) | 31.29s | 87.48s |
| প্রতিক্রিয়া সময় (সর্বোচ্চ) | 116.86s | 618.49s |
| প্রতিক্রিয়া সময় (মোট) | 531.98s | 2012.15s |
| প্যারামিটার | ~1.2T মোট (~80B সক্রিয়) | ~1.7T মোট (~170B সক্রিয়) |
| উপলভ্যতা | বন্ধ উৎস | বন্ধ উৎস |
ক্যাশের মূল্য ইনপুট টোকেনের জন্য প্রযোজ্য। পড়ার সময় ক্যাশ করা প্রম্পট আবার ব্যবহার হয়; লেখার সময় সেগুলি সংরক্ষিত হয় এবং বাড়তি খরচ হতে পারে। আউটপুট টোকেনের জন্য আউটপুট মূল্য প্রযোজ্য।
মডেল জেনারেশন শোকেস
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#54 GPT-5.2
medium- খরচ
- $0.047
- সময়
- 49.2s
- টোকেন
- 3,396 tok
#64 SpaceXAI: Grok 4.6
high- খরচ
- $0.107
- সময়
- 265.1s
- টোকেন
- 18,001 tok
স্কোর অনুযায়ী শীর্ষ মডেল
স্কোর বনাম মোট খরচ
প্রতিক্রিয়া সময় (গড়)
স্কোর vs প্রতিক্রিয়া সময় (গড়)
মোট আউটপুট টোকেন
স্কোর vs মোট আউটপুট টোকেন
বিভাগভিত্তিক বিশ্লেষণ
দ্রুত তুলনা
তুলনার জুটি বদলান
GPT-5.2mediumvsQwen3.8 27Bhighবিনামূল্যে উপলভ্যMuse Spark 1.3lowvsGrok 4.6highClaude Sonnet 5mediumvsGrok 4.6highQwen3.7 MaxmediumvsGrok 4.6highQwen3.8 Max (0902)lowvsGrok 4.6highDeepSeek V4.1 FlashmaxvsGPT-5.2mediumMuse Spark 1.2lowvsGPT-5.2mediumClaude Sonnet 5.5xhighvsGrok 4.6highMuse Spark 1.1lowvsGrok 4.6highDeepSeek V4.1 FlashhighvsGPT-5.2mediumMuse Spark 1.1lowvsGPT-5.2mediumClaude Sonnet 5.5xhighvsGPT-5.2medium