नेविगेशन
AI BENCHY
Advertise here

GPT-5.4 (medium) vs Grok 4.5 (low)

GPT-5.4 (medium) average score में आगे है: 8.5 vs 8.4. Grok 4.5 (low) की benchmark लागत कम है: $0.945 vs $1.560. Grok 4.5 (low) तेज है: 16.17s vs 22.85s, pass rates 77.3% vs 77.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-29

रैंक
#37
कुल आउटपुट टोकन
90,466
प्रतिक्रिया समय (औसत)
22.85s
कुल लागत
$1.560
रैंक
#41
कुल आउटपुट टोकन
115,489
प्रतिक्रिया समय (औसत)
16.17s
कुल लागत
$0.945
अनुशंसित मॉडल Grok 4.5 (low)

Its score stays close to the best score here (8.4 vs 8.5), while costing about 1.7x less than GPT-5.4 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.4 GPT-5.4 medium रिलीज़: 2026-03-05 Grok 4.5 Grok 4.5 low रिलीज़: 2026-07-08
स्कोर 8.5 8.4
रैंक #37 #41
विश्वसनीयता 10.0 10.0
संगति 8.6 9.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 77.3% 77.3%
अस्थिर टेस्ट 4 2
कुल रन 66 66
प्रति परिणाम लागत 10.399 5.901
कुल लागत $1.560 $0.945
इनपुट कीमत $2.500 / 1M $2.000 / 1M
आउटपुट कीमत $15.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 81,136 125,605
आउटपुट टोकन 6,155 7,505
रीजनिंग टोकन 84,311 107,984
प्रतिक्रिया समय (औसत) 22.85s 16.17s
प्रतिक्रिया समय (अधिकतम) 100.41s 205.28s
प्रतिक्रिया समय (कुल) 502.78s 355.67s
पैरामीटर ~1.5T कुल (~100B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#37 GPT-5.4

medium
लागत
$0.214
समय
199.6s
टोकन
14,349 tok

#41 SpaceXAI: Grok 4.5

low
लागत
$0.011
समय
12.4s
टोकन
2,018 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641

त्वरित तुलना

तुलना जोड़ी बदलें