नेविगेशन
AI BENCHY
Advertise here

GPT-5.3-Codex (medium) vs Grok 4.6 (high)

Grok 4.6 (high) average score में आगे है: 9.2 vs 8.9. GPT-5.3-Codex (medium) की benchmark लागत कम है: $0.920 vs $1.809. GPT-5.3-Codex (medium) तेज है: 16.96s vs 79.38s, pass rates 83.3% vs 84.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#20
कुल आउटपुट टोकन
55,525
प्रतिक्रिया समय (औसत)
16.96s
कुल लागत
$0.920
रैंक
#11
कुल आउटपुट टोकन
265,604
प्रतिक्रिया समय (औसत)
79.38s
कुल लागत
$1.809
अनुशंसित मॉडल GPT-5.3-Codex (medium)

Its score stays close to the best score here (8.9 vs 9.2), while costing about 2.0x less than Grok 4.6 (high).

विस्तृत तुलना

मेट्रिक GPT-5.3-Codex GPT-5.3-Codex medium रिलीज़: 2026-02-05 Grok 4.6 Grok 4.6 high रिलीज़: 2026-08-12
स्कोर 8.9 9.2
रैंक #20 #11
विश्वसनीयता 10.0 10.0
संगति 8.6 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 83.3% 84.9%
अस्थिर टेस्ट 4 1
कुल रन 66 66
प्रति परिणाम लागत 5.748 10.046
कुल लागत $0.920 $1.809
इनपुट कीमत $1.750 / 1M $2.000 / 1M
आउटपुट कीमत $14.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 81,268 107,266
आउटपुट टोकन 6,251 5,094
रीजनिंग टोकन 49,274 260,510
प्रतिक्रिया समय (औसत) 16.96s 79.38s
प्रतिक्रिया समय (अधिकतम) 100.93s 618.49s
प्रतिक्रिया समय (कुल) 373.19s 1746.29s
पैरामीटर ~1.2T कुल (~80B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#20 GPT-5.3-Codex

medium
लागत
$0.049
समय
54.9s
टोकन
3,580 tok

#11 SpaceXAI: Grok 4.6

high
लागत
$0.107
समय
265.1s
टोकन
18,001 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890
Grok 4.6 10.0 10.0 100.0% 0 102.20s 9,579 379 51,829

त्वरित तुलना

तुलना जोड़ी बदलें