নেভিগেশন
AI BENCHY
Advertise here

Claude Opus 5 vs xAI: Grok 4.5

Claude Opus 5 (medium) average score-এ এগিয়ে: 9.2 vs 8.9. Claude Opus 5 (medium)-এর benchmark খরচ কম: $1.486 vs $1.707. Claude Opus 5 (medium) দ্রুত: 9.38s vs 76.50s, pass rates 83.3% vs 83.3%.

প্রস্তাবিত মডেলClaude Opus 5 (medium)It has the best score here (9.2), while responding about 8.2x faster than Grok 4.5 (high).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Claude Opus 5 Claude Opus 5 medium প্রকাশ: 2026-07-25 Grok 4.5 Grok 4.5 high প্রকাশ: 2026-07-08
স্কোর 9.2 8.9
র‍্যাঙ্ক #12 #17
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 9.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 83.3% 83.3%
অস্থির টেস্ট 1 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.253 10.041
মোট খরচ $1.486 $1.707
ইনপুট মূল্য $5.000 / 1M $2.000 / 1M
আউটপুট মূল্য $25.000 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 135,607 151,562
আউটপুট টোকেন 25,673 5,655
রিজনিং টোকেন 6,930 247,540
প্রতিক্রিয়া সময় (গড়) 9.38s 76.50s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 35.05s 676.83s
প্রতিক্রিয়া সময় (মোট) 206.26s 1683.07s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#12 Claude Opus 5

medium
খরচ
$0.125
সময়
69.3s
টোকেন
5,134 tok

#17 xAI: Grok 4.5

high
খরচ
$0.015
সময়
29.7s
টোকেন
2,737 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 5 10.0 10.0 100.0% 0 9.56s 10,590 5,224 1,162
Grok 4.5 10.0 10.0 100.0% 0 155.16s 9,579 357 100,752

দ্রুত তুলনা

তুলনার জুটি বদলান