नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Haiku 5.5 (xhigh) vs GPT-6 Luna (high)

Claude Haiku 5.5 (xhigh) average score मध्ये पुढे आहे: 9.1 vs 7.7. GPT-6 Luna (high) चा benchmark खर्च कमी आहे: $0.074 vs $0.140. Claude Haiku 5.5 (xhigh) वेगवान आहे: 16.58s vs 20.37s, pass rates 81.2% vs 73.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-07

तुलना केलेली मॉडेल्स

क्रमांक
#35
एकूण आउटपुट टोकन्स
199,268
प्रतिसाद वेळ (सरासरी)
16.58s
एकूण खर्च
$0.140
क्रमांक
#118
एकूण आउटपुट टोकन्स
101,587
प्रतिसाद वेळ (सरासरी)
20.37s
एकूण खर्च
$0.074
शिफारस केलेले मॉडेल Claude Haiku 5.5 (xhigh)

या तुलनेत याचा गुण सर्वाधिक आहे (9.1) आणि 2 मॉडेल्समध्ये खर्च व प्रतिसाद वेळ यांचा एकूण समतोल सर्वोत्तम आहे.

तपशीलवार तुलना

मेट्रिक Claude Haiku 5.5 Claude Haiku 5.5 xhigh प्रकाशन: 2026-10-07 GPT-6 Luna GPT-6 Luna high प्रकाशन: 2026-09-23
स्कोअर 9.1 7.7
क्रमांक #35 #118
विश्वसनीयता 10.0 10.0
सुसंगतता 9.3 8.7
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 81.2% 73.9%
अस्थिर चाचण्या 2 4
एकूण रन 69 69
प्रति निकाल खर्च 0.773 0.492
एकूण खर्च $0.140 $0.074
इनपुट किंमत $0.100 / 1M $0.100 / 1M
आउटपुट किंमत $0.500 / 1M $0.500 / 1M
कॅश वाचण्याची किंमत $0.010 / 1M $0.010 / 1M
कॅश लिहिण्याची किंमत $0.125 / 1M $0.125 / 1M
एकूण इनपुट टोकन्स 394,509 229,986
आउटपुट टोकन्स 10,349 6,037
रिझनिंग टोकन्स 188,919 95,550
प्रतिसाद वेळ (सरासरी) 16.58s 20.37s
प्रतिसाद वेळ (कमाल) 92.74s 106.93s
प्रतिसाद वेळ (एकूण) 381.40s 468.52s
पॅरामीटर्स ~50B ~400B एकूण (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#35 Claude Haiku 5.5

xhigh
खर्च
$0.021
वेळ
189.0s
टोकन्स
41,343 tok

#118 GPT-6 Luna

high
खर्च
$0.003
वेळ
49.2s
टोकन्स
5,231 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Haiku 5.5 10.0 10.0 100.0% 0 13.13s 10,608 504 26,396
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691

तुलना जोडी बदला