नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 5 vs xAI: Grok Build 0.1

average score जवळपास समान आहे: 7.5 vs 7.6. Grok Build 0.1 (medium) चा benchmark खर्च कमी आहे: $1.097 vs $1.550. Claude Opus 5 वेगवान आहे: 7.60s vs 52.06s, pass rates 57.6% vs 63.6%.

शिफारस केलेले मॉडेलClaude Opus 5It has the best score here (7.5), while responding about 6.8x faster than Grok Build 0.1 (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 none प्रकाशन: 2026-07-25 Grok Build 0.1 Grok Build 0.1 medium प्रकाशन: 2026-05-21
स्कोअर 7.5 7.6
क्रमांक #59 #55
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 10.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 57.6% 63.6%
अस्थिर चाचण्या 1 0
एकूण रन 66 66
प्रति निकाल खर्च 12.912 7.830
एकूण खर्च $1.550 $1.097
इनपुट किंमत $5.000 / 1M $1.000 / 1M
आउटपुट किंमत $25.000 / 1M $2.000 / 1M
एकूण इनपुट टोकन्स 185,550 106,751
आउटपुट टोकन्स 24,866 7,993
रिझनिंग टोकन्स 0 486,670
प्रतिसाद वेळ (सरासरी) 7.60s 52.06s
प्रतिसाद वेळ (कमाल) 47.72s 252.69s
प्रतिसाद वेळ (एकूण) 167.28s 1145.27s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 Claude Opus 5

none
खर्च
$0.271
वेळ
149.3s
टोकन्स
10,962 tok

#55 xAI: Grok Build 0.1

medium
खर्च
$0.028
वेळ
81.3s
टोकन्स
14,009 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

झटपट तुलना

तुलना जोडी बदला