নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 5 vs xAI: Grok Build 0.1

average score প্রায় সমান: 7.5 vs 7.6. Grok Build 0.1 (medium)-এর benchmark খরচ কম: $1.097 vs $1.550. Claude Opus 5 দ্রুত: 7.60s vs 52.06s, pass rates 57.6% vs 63.6%.

প্রস্তাবিত মডেলClaude Opus 5It has the best score here (7.5), while responding about 6.8x faster than Grok Build 0.1 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Claude Opus 5 Claude Opus 5 none প্রকাশ: 2026-07-25 Grok Build 0.1 Grok Build 0.1 medium প্রকাশ: 2026-05-21
স্কোর 7.5 7.6
র‍্যাঙ্ক #59 #55
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 57.6% 63.6%
অস্থির টেস্ট 1 0
মোট রান 66 66
প্রতি ফলাফলে খরচ 12.912 7.830
মোট খরচ $1.550 $1.097
ইনপুট মূল্য $5.000 / 1M $1.000 / 1M
আউটপুট মূল্য $25.000 / 1M $2.000 / 1M
মোট ইনপুট টোকেন 185,550 106,751
আউটপুট টোকেন 24,866 7,993
রিজনিং টোকেন 0 486,670
প্রতিক্রিয়া সময় (গড়) 7.60s 52.06s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 47.72s 252.69s
প্রতিক্রিয়া সময় (মোট) 167.28s 1145.27s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 Claude Opus 5

none
খরচ
$0.271
সময়
149.3s
টোকেন
10,962 tok

#55 xAI: Grok Build 0.1

medium
খরচ
$0.028
সময়
81.3s
টোকেন
14,009 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

দ্রুত তুলনা

তুলনার জুটি বদলান