नेविगेशन
Advertise here

Claude Haiku 5.5 (xhigh) vs GPT-5.3-Codex (medium)

average score लगभग बराबर है: 9.1 vs 9.1. Claude Haiku 5.5 (xhigh) की benchmark लागत कम है: $0.140 vs $1.318. Claude Haiku 5.5 (xhigh) तेज है: 16.58s vs 18.87s, pass rates 81.2% vs 84.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#35
कुल आउटपुट टोकन
199,268
प्रतिक्रिया समय (औसत)
16.58s
कुल लागत
$0.140
रैंक
#34
कुल आउटपुट टोकन
66,287
प्रतिक्रिया समय (औसत)
18.87s
कुल लागत
$1.318
अनुशंसित मॉडल Claude Haiku 5.5 (xhigh)

It has the best score here (9.1), while costing about 9.5x less than GPT-5.3-Codex (medium).

विस्तृत तुलना

मेट्रिक Claude Haiku 5.5 Claude Haiku 5.5 xhigh रिलीज़: 2026-10-07 GPT-5.3-Codex GPT-5.3-Codex medium रिलीज़: 2026-02-05
स्कोर 9.1 9.1
रैंक #35 #34
विश्वसनीयता 10.0 10.0
संगति 9.3 8.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 81.2% 84.1%
अस्थिर टेस्ट 2 4
कुल रन 69 69
प्रति परिणाम लागत 0.773 7.753
कुल लागत $0.140 $1.318
इनपुट कीमत $0.100 / 1M $1.750 / 1M
आउटपुट कीमत $0.500 / 1M $14.000 / 1M
कैश पढ़ने की कीमत $0.010 / 1M $0.175 / 1M
कैश लिखने की कीमत $0.125 / 1M लागू नहीं
कुल इनपुट टोकन 394,509 222,794
आउटपुट टोकन 10,349 7,357
रीजनिंग टोकन 188,919 58,930
प्रतिक्रिया समय (औसत) 16.58s 18.87s
प्रतिक्रिया समय (अधिकतम) 92.74s 100.93s
प्रतिक्रिया समय (कुल) 381.40s 433.94s
पैरामीटर ~50B ~1.2T कुल (~80B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#35 Claude Haiku 5.5

xhigh
लागत
$0.021
समय
189.0s
टोकन
41,343 tok

#34 GPT-5.3-Codex

medium
लागत
$0.049
समय
54.9s
टोकन
3,580 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Haiku 5.5 10.0 10.0 100.0% 0 13.13s 10,608 504 26,396
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890

तुलना जोड़ी बदलें