नेविगेशन
Advertise here

GPT-5.4 Nano (medium) vs Grok 4.7 (xhigh)

average score लगभग बराबर है: 7.5 vs 7.5. GPT-5.4 Nano (medium) की benchmark लागत कम है: $0.142 vs $2.625. GPT-5.4 Nano (medium) तेज है: 13.32s vs 115.74s, pass rates 65.2% vs 77.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-21

तुलना किए गए मॉडल

रैंक
#108
कुल आउटपुट टोकन
99,881
प्रतिक्रिया समय (औसत)
13.32s
कुल लागत
$0.142
रैंक
#107
कुल आउटपुट टोकन
505,069
प्रतिक्रिया समय (औसत)
115.74s
कुल लागत
$2.625
अनुशंसित मॉडल GPT-5.4 Nano (medium)

It has the best score here (7.5), while costing about 18.6x less than Grok 4.7 (xhigh).

विस्तृत तुलना

मेट्रिक GPT-5.4 Nano GPT-5.4 Nano medium रिलीज़: 2026-03-17 Grok 4.7 Grok 4.7 xhigh रिलीज़: 2026-09-21
स्कोर 7.5 7.5
रैंक #108 #107
विश्वसनीयता 10.0 9.6
संगति 8.5 7.7
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 65.2% 77.3%
अस्थिर टेस्ट 4 6
कुल रन 66 66
प्रति परिणाम लागत 1.179 18.745
कुल लागत $0.142 $2.625
इनपुट कीमत $0.200 / 1M $1.600 / 1M
आउटपुट कीमत $1.250 / 1M $4.800 / 1M
कुल इनपुट टोकन 82,828 124,896
आउटपुट टोकन 7,100 4,890
रीजनिंग टोकन 92,781 500,179
प्रतिक्रिया समय (औसत) 13.32s 115.74s
प्रतिक्रिया समय (अधिकतम) 94.06s 775.64s
प्रतिक्रिया समय (कुल) 292.97s 2546.31s
पैरामीटर ~120B कुल (~5B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#108 GPT-5.4 Nano

medium
लागत
$0.007
समय
24.6s
टोकन
4,943 tok

#107 SpaceXAI: Grok 4.7

xhigh
लागत
$0.235
समय
544.2s
टोकन
39,247 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
Grok 4.7 5.3 4.5 55.6% 2 414.53s 10,168 327 256,935

त्वरित तुलना

तुलना जोड़ी बदलें