नेव्हिगेशन
Advertise here

Tev1 4B Experimental vs Grok 4.20

Grok 4.20 average score मध्ये पुढे आहे: 3.4 vs 1.0. Tev1 4B Experimental चा benchmark खर्च कमी आहे: $0.002 vs $0.057. Tev1 4B Experimental वेगवान आहे: 498ms vs 1.11s, pass rates 13.0% vs 26.1%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-01

तुलना केलेली मॉडेल्स

क्रमांक
#381
एकूण आउटपुट टोकन्स
96
प्रतिसाद वेळ (सरासरी)
498ms
एकूण खर्च
$0.002
क्रमांक
#362
एकूण आउटपुट टोकन्स
1,923
प्रतिसाद वेळ (सरासरी)
1.11s
एकूण खर्च
$0.057
शिफारस केलेले मॉडेल Grok 4.20

It has the strongest score in this comparison (3.4) and the best overall balance of cost and response time across all 2 models.

तपशीलवार तुलना

मेट्रिक Tev1 4B Experimental Tev1 4B Experimental none प्रकाशन: 2026-09-30 Grok 4.20 Grok 4.20 none प्रकाशन: 2026-03-31
स्कोअर 1.0 3.4
क्रमांक #381 #362
विश्वसनीयता 10.0 लागू नाही
सुसंगतता 3.0 7.8
प्रयत्न 21/69 54/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 13.0% 26.1%
अस्थिर चाचण्या 0 0
एकूण रन 21 54
प्रति निकाल खर्च 0.048 1.570
एकूण खर्च $0.002 $0.057
इनपुट किंमत $0.042 / 1M $1.250 / 1M
आउटपुट किंमत $0.000 / 1M $2.500 / 1M
कॅश वाचण्याची किंमत लागू नाही $0.200 / 1M
कॅश लिहिण्याची किंमत लागू नाही लागू नाही
एकूण इनपुट टोकन्स 33,864 41,313
आउटपुट टोकन्स 96 1,923
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 498ms 1.11s
प्रतिसाद वेळ (कमाल) 602ms 6.04s
प्रतिसाद वेळ (एकूण) 3.49s 19.96s
पॅरामीटर्स 4B ~1T एकूण (~100B सक्रिय)
उपलब्धता वेट्स उपलब्ध बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#381 Together: Tev1 4B Experimental

none
या मॉडेलसाठी अद्याप कोणताही शोकेस निकाल तयार झालेला नाही.
खर्च
लागू नाही
वेळ
-
टोकन्स
0 tok

#362 xAI: Grok 4.20

none
खर्च
$0.004
वेळ
6.5s
टोकन्स
1,367 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Tev1 4B Experimental 0.0 0.0 0.0% 0 0ms 0 0 0
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0

झटपट तुलना

तुलना जोडी बदला

Command A+mediumvsGrok 4.20noneCommand A+highvsGrok 4.20noneLing 3.0 TinymediumvsGrok 4.20noneLing 3.0 TinylowvsGrok 4.20noneLing 3.0 TinyhighvsGrok 4.20noneCommand A+lowvsGrok 4.20noneQwen3.5-9BmediumvsGrok 4.20noneGemini 3 Flash PreviewhighvsTev1 4B ExperimentalnoneGrok 4.20nonevsGLM 4.7 FlashmediumMiniMax M2.5mediumvsGrok 4.20noneCobuddymediumमोफत उपलब्धvsGrok 4.20noneNemotron 3.5 Lightninglowमोफत उपलब्धvsGrok 4.20none