नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Haiku 5.5 (xhigh) vs GPT-6 Luna (high)

Claude Haiku 5.5 (xhigh) average score में आगे है: 9.1 vs 7.7. GPT-6 Luna (high) की benchmark लागत कम है: $0.074 vs $0.140. Claude Haiku 5.5 (xhigh) तेज है: 16.58s vs 20.37s, pass rates 81.2% vs 73.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#35
कुल आउटपुट टोकन
199,268
प्रतिक्रिया समय (औसत)
16.58s
कुल लागत
$0.140
रैंक
#118
कुल आउटपुट टोकन
101,587
प्रतिक्रिया समय (औसत)
20.37s
कुल लागत
$0.074
अनुशंसित मॉडल Claude Haiku 5.5 (xhigh)

इस तुलना में इसका स्कोर सबसे अधिक है (9.1) और 2 मॉडलों में लागत और प्रतिक्रिया समय का समग्र संतुलन सबसे अच्छा है।

विस्तृत तुलना

मेट्रिक Claude Haiku 5.5 Claude Haiku 5.5 xhigh रिलीज़: 2026-10-07 GPT-6 Luna GPT-6 Luna high रिलीज़: 2026-09-23
स्कोर 9.1 7.7
रैंक #35 #118
विश्वसनीयता 10.0 10.0
संगति 9.3 8.7
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 81.2% 73.9%
अस्थिर टेस्ट 2 4
कुल रन 69 69
प्रति परिणाम लागत 0.773 0.492
कुल लागत $0.140 $0.074
इनपुट कीमत $0.100 / 1M $0.100 / 1M
आउटपुट कीमत $0.500 / 1M $0.500 / 1M
कैश पढ़ने की कीमत $0.010 / 1M $0.010 / 1M
कैश लिखने की कीमत $0.125 / 1M $0.125 / 1M
कुल इनपुट टोकन 394,509 229,986
आउटपुट टोकन 10,349 6,037
रीजनिंग टोकन 188,919 95,550
प्रतिक्रिया समय (औसत) 16.58s 20.37s
प्रतिक्रिया समय (अधिकतम) 92.74s 106.93s
प्रतिक्रिया समय (कुल) 381.40s 468.52s
पैरामीटर ~50B ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#35 Claude Haiku 5.5

xhigh
लागत
$0.021
समय
189.0s
टोकन
41,343 tok

#118 GPT-6 Luna

high
लागत
$0.003
समय
49.2s
टोकन
5,231 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Haiku 5.5 10.0 10.0 100.0% 0 13.13s 10,608 504 26,396
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691

तुलना जोड़ी बदलें