नेव्हिगेशन
Advertise here

Claude Haiku 5.5 (medium) vs GPT-6 Luna (high)

average score जवळपास समान आहे: 7.7 vs 7.7. Claude Haiku 5.5 (medium) चा benchmark खर्च कमी आहे: $0.063 vs $0.074. Claude Haiku 5.5 (medium) वेगवान आहे: 7.71s vs 20.37s, pass rates 71.0% vs 73.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-07

तुलना केलेली मॉडेल्स

क्रमांक
#120
एकूण आउटपुट टोकन्स
66,174
प्रतिसाद वेळ (सरासरी)
7.71s
एकूण खर्च
$0.063
क्रमांक
#118
एकूण आउटपुट टोकन्स
101,587
प्रतिसाद वेळ (सरासरी)
20.37s
एकूण खर्च
$0.074
शिफारस केलेले मॉडेल Claude Haiku 5.5 (medium)

It has the best score here (7.7), while responding about 2.6x faster than GPT-6 Luna (high).

तपशीलवार तुलना

मेट्रिक Claude Haiku 5.5 Claude Haiku 5.5 medium प्रकाशन: 2026-10-07 GPT-6 Luna GPT-6 Luna high प्रकाशन: 2026-09-23
स्कोअर 7.7 7.7
क्रमांक #120 #118
विश्वसनीयता 10.0 10.0
सुसंगतता 7.5 8.7
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 71.0% 73.9%
अस्थिर चाचण्या 7 4
एकूण रन 69 69
प्रति निकाल खर्च 0.485 0.492
एकूण खर्च $0.063 $0.074
इनपुट किंमत $0.100 / 1M $0.100 / 1M
आउटपुट किंमत $0.500 / 1M $0.500 / 1M
कॅश वाचण्याची किंमत $0.010 / 1M $0.010 / 1M
कॅश लिहिण्याची किंमत $0.125 / 1M $0.125 / 1M
एकूण इनपुट टोकन्स 298,334 229,986
आउटपुट टोकन्स 10,328 6,037
रिझनिंग टोकन्स 55,846 95,550
प्रतिसाद वेळ (सरासरी) 7.71s 20.37s
प्रतिसाद वेळ (कमाल) 47.70s 106.93s
प्रतिसाद वेळ (एकूण) 177.29s 468.52s
पॅरामीटर्स ~50B ~400B एकूण (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#120 Claude Haiku 5.5

medium
खर्च
$0.002
वेळ
17.2s
टोकन्स
3,524 tok

#118 GPT-6 Luna

high
खर्च
$0.003
वेळ
49.2s
टोकन्स
5,231 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Haiku 5.5 6.3 4.8 66.7% 2 7.16s 10,608 518 11,415
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691

तुलना जोडी बदला