नेव्हिगेशन
Advertise here

Grok 4.7 (high) vs Grok Build 0.1 (medium)

average score जवळपास समान आहे: 6.7 vs 6.7. Grok Build 0.1 (medium) चा benchmark खर्च कमी आहे: $1.419 vs $3.037. Grok Build 0.1 (medium) वेगवान आहे: 55.13s vs 122.19s, pass rates 72.5% vs 58.0%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-03

तुलना केलेली मॉडेल्स

क्रमांक
#181
एकूण आउटपुट टोकन्स
487,184
प्रतिसाद वेळ (सरासरी)
122.19s
एकूण खर्च
$3.037
क्रमांक
#178
एकूण आउटपुट टोकन्स
529,806
प्रतिसाद वेळ (सरासरी)
55.13s
एकूण खर्च
$1.419
शिफारस केलेले मॉडेल Grok Build 0.1 (medium)

It has the best score here (6.7), while costing about 2.1x less than Grok 4.7 (high).

तपशीलवार तुलना

मेट्रिक Grok 4.7 Grok 4.7 high प्रकाशन: 2026-09-21 Grok Build 0.1 Grok Build 0.1 medium प्रकाशन: 2026-05-21
स्कोअर 6.7 6.7
क्रमांक #181 #178
विश्वसनीयता 9.6 10.0
सुसंगतता 7.7 9.6
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 72.5% 58.0%
अस्थिर चाचण्या 7 1
एकूण रन 69 69
प्रति निकाल खर्च 23.360 10.910
एकूण खर्च $3.037 $1.419
इनपुट किंमत $2.000 / 1M $1.000 / 1M
आउटपुट किंमत $6.000 / 1M $2.000 / 1M
कॅश वाचण्याची किंमत $0.500 / 1M $0.200 / 1M
कॅश लिहिण्याची किंमत लागू नाही लागू नाही
एकूण इनपुट टोकन्स 329,276 358,616
आउटपुट टोकन्स 8,172 9,651
रिझनिंग टोकन्स 479,012 520,155
प्रतिसाद वेळ (सरासरी) 122.19s 55.13s
प्रतिसाद वेळ (कमाल) 573.57s 252.69s
प्रतिसाद वेळ (एकूण) 2810.40s 1268.10s
पॅरामीटर्स ~1.7T एकूण (~170B सक्रिय) ~300B एकूण (~30B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#181 SpaceXAI: Grok 4.7

high
खर्च
$0.110
वेळ
301.3s
टोकन्स
23,143 tok

#178 SpaceXAI: Grok Build 0.1

medium
खर्च
$0.028
वेळ
81.3s
टोकन्स
14,009 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Grok 4.7 6.0 4.6 66.7% 2 335.92s 10,266 353 199,976
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

झटपट तुलना

तुलना जोडी बदला