नेव्हिगेशन
AI BENCHY
Advertise here

DeepSeek V4 Pro (high) vs Grok Build 0.1 (medium)

DeepSeek V4 Pro (high) average score मध्ये पुढे आहे: 7.7 vs 7.6. DeepSeek V4 Pro (high) चा benchmark खर्च कमी आहे: $0.200 vs $1.097. Grok Build 0.1 (medium) वेगवान आहे: 52.06s vs 79.14s, pass rates 63.6% vs 63.6%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-01

क्रमांक
#58
एकूण आउटपुट टोकन्स
189,181
प्रतिसाद वेळ (सरासरी)
79.14s
एकूण खर्च
$0.200
क्रमांक
#60
एकूण आउटपुट टोकन्स
494,663
प्रतिसाद वेळ (सरासरी)
52.06s
एकूण खर्च
$1.097
शिफारस केलेले मॉडेल DeepSeek V4 Pro (high)

It has the best score here (7.7), while costing about 5.5x less than Grok Build 0.1 (medium).

तपशीलवार तुलना

मेट्रिक DeepSeek V4 Pro DeepSeek V4 Pro high प्रकाशन: 2026-04-24 Grok Build 0.1 Grok Build 0.1 medium प्रकाशन: 2026-05-21
स्कोअर 7.7 7.6
क्रमांक #58 #60
विश्वसनीयता 10.0 10.0
सुसंगतता 7.7 10.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 63.6% 63.6%
अस्थिर चाचण्या 6 0
एकूण रन 66 66
प्रति निकाल खर्च 2.000 7.830
एकूण खर्च $0.200 $1.097
इनपुट किंमत $0.435 / 1M $1.000 / 1M
आउटपुट किंमत $0.870 / 1M $2.000 / 1M
एकूण इनपुट टोकन्स 90,748 106,751
आउटपुट टोकन्स 10,462 7,993
रिझनिंग टोकन्स 178,719 486,670
प्रतिसाद वेळ (सरासरी) 79.14s 52.06s
प्रतिसाद वेळ (कमाल) 416.76s 252.69s
प्रतिसाद वेळ (एकूण) 1740.97s 1145.27s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#58 DeepSeek V4 Pro

high
खर्च
$0.023
वेळ
257.6s
टोकन्स
14,870 tok

#60 xAI: Grok Build 0.1

medium
खर्च
$0.028
वेळ
81.3s
टोकन्स
14,009 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Pro 6.3 8.7 33.3% 0 243.00s 5,090 383 84,580
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

झटपट तुलना

तुलना जोडी बदला