नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.4 Nano (medium) vs Grok Build 0.1 (medium)

Grok Build 0.1 (medium) average score मध्ये पुढे आहे: 7.6 vs 7.5. GPT-5.4 Nano (medium) चा benchmark खर्च कमी आहे: $0.138 vs $1.097. GPT-5.4 Nano (medium) वेगवान आहे: 13.24s vs 52.06s, pass rates 65.2% vs 63.6%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#62
एकूण आउटपुट टोकन्स
97,122
प्रतिसाद वेळ (सरासरी)
13.24s
एकूण खर्च
$0.138
क्रमांक
#56
एकूण आउटपुट टोकन्स
494,663
प्रतिसाद वेळ (सरासरी)
52.06s
एकूण खर्च
$1.097
शिफारस केलेले मॉडेल GPT-5.4 Nano (medium)

Its score stays close to the best score here (7.5 vs 7.6), while costing about 7.9x less than Grok Build 0.1 (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.4 Nano GPT-5.4 Nano medium प्रकाशन: 2026-03-17 Grok Build 0.1 Grok Build 0.1 medium प्रकाशन: 2026-05-21
स्कोअर 7.5 7.6
क्रमांक #62 #56
विश्वसनीयता 10.0 10.0
सुसंगतता 8.5 10.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 63.6%
अस्थिर चाचण्या 4 0
एकूण रन 66 66
प्रति निकाल खर्च 1.150 7.830
एकूण खर्च $0.138 $1.097
इनपुट किंमत $0.200 / 1M $1.000 / 1M
आउटपुट किंमत $1.250 / 1M $2.000 / 1M
एकूण इनपुट टोकन्स 82,819 106,751
आउटपुट टोकन्स 7,100 7,993
रिझनिंग टोकन्स 90,022 486,670
प्रतिसाद वेळ (सरासरी) 13.24s 52.06s
प्रतिसाद वेळ (कमाल) 94.06s 252.69s
प्रतिसाद वेळ (एकूण) 291.33s 1145.27s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 GPT-5.4 Nano

medium
खर्च
$0.007
वेळ
24.6s
टोकन्स
4,943 tok

#56 xAI: Grok Build 0.1

medium
खर्च
$0.028
वेळ
81.3s
टोकन्स
14,009 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

झटपट तुलना

तुलना जोडी बदला