नेव्हिगेशन
Advertise here

GPT 5.3 Chat (default) vs Grok Build 0.1 (medium)

average score जवळपास समान आहे: 6.7 vs 6.7. GPT 5.3 Chat (default) चा benchmark खर्च कमी आहे: $0.533 vs $1.419. GPT 5.3 Chat (default) वेगवान आहे: 6.31s vs 55.13s, pass rates 62.3% vs 58.0%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-07

तुलना केलेली मॉडेल्स

क्रमांक
#193
एकूण आउटपुट टोकन्स
28,179
प्रतिसाद वेळ (सरासरी)
6.31s
एकूण खर्च
$0.533
क्रमांक
#187
एकूण आउटपुट टोकन्स
529,806
प्रतिसाद वेळ (सरासरी)
55.13s
एकूण खर्च
$1.419
शिफारस केलेले मॉडेल GPT 5.3 Chat (default)

It has the best score here (6.7), while costing about 2.7x less than Grok Build 0.1 (medium).

तपशीलवार तुलना

मेट्रिक GPT 5.3 Chat GPT 5.3 Chat default प्रकाशन: 2026-03-03 Grok Build 0.1 Grok Build 0.1 medium प्रकाशन: 2026-05-21
स्कोअर 6.7 6.7
क्रमांक #193 #187
विश्वसनीयता 10.0 10.0
सुसंगतता 8.6 9.6
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 62.3% 58.0%
अस्थिर चाचण्या 4 1
एकूण रन 69 69
प्रति निकाल खर्च 4.097 10.910
एकूण खर्च $0.533 $1.419
इनपुट किंमत $1.750 / 1M $1.000 / 1M
आउटपुट किंमत $14.000 / 1M $2.000 / 1M
कॅश वाचण्याची किंमत लागू नाही $0.200 / 1M
कॅश लिहिण्याची किंमत लागू नाही लागू नाही
एकूण इनपुट टोकन्स 78,846 358,616
आउटपुट टोकन्स 7,635 9,651
रिझनिंग टोकन्स 20,544 520,155
प्रतिसाद वेळ (सरासरी) 6.31s 55.13s
प्रतिसाद वेळ (कमाल) 18.33s 252.69s
प्रतिसाद वेळ (एकूण) 138.73s 1268.10s
पॅरामीटर्स ~400B एकूण (~17B सक्रिय) ~300B एकूण (~30B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#193 GPT 5.3 Chat

default
खर्च
$0.008
वेळ
8.1s
टोकन्स
634 tok

#187 SpaceXAI: Grok Build 0.1

medium
खर्च
$0.028
वेळ
81.3s
टोकन्स
14,009 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 808 5,824
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

तुलना जोडी बदला