नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Haiku 5.5 (medium) vs GPT-6 Luna (low)

Claude Haiku 5.5 (medium) average score मध्ये पुढे आहे: 7.7 vs 7.6. GPT-6 Luna (low) चा benchmark खर्च कमी आहे: $0.033 vs $0.063. Claude Haiku 5.5 (medium) वेगवान आहे: 7.71s vs 23.23s, pass rates 71.0% vs 63.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-07

तुलना केलेली मॉडेल्स

क्रमांक
#120
एकूण आउटपुट टोकन्स
66,174
प्रतिसाद वेळ (सरासरी)
7.71s
एकूण खर्च
$0.063
क्रमांक
#125
एकूण आउटपुट टोकन्स
24,880
प्रतिसाद वेळ (सरासरी)
23.23s
एकूण खर्च
$0.033
शिफारस केलेले मॉडेल Claude Haiku 5.5 (medium)

It has the best score here (7.7), while responding about 3.0x faster than GPT-6 Luna (low).

तपशीलवार तुलना

मेट्रिक Claude Haiku 5.5 Claude Haiku 5.5 medium प्रकाशन: 2026-10-07 GPT-6 Luna GPT-6 Luna low प्रकाशन: 2026-09-23
स्कोअर 7.7 7.6
क्रमांक #120 #125
विश्वसनीयता 10.0 9.7
सुसंगतता 7.5 8.5
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 71.0% 63.8%
अस्थिर चाचण्या 7 4
एकूण रन 69 69
प्रति निकाल खर्च 0.485 0.267
एकूण खर्च $0.063 $0.033
इनपुट किंमत $0.100 / 1M $0.100 / 1M
आउटपुट किंमत $0.500 / 1M $0.500 / 1M
कॅश वाचण्याची किंमत $0.010 / 1M $0.010 / 1M
कॅश लिहिण्याची किंमत $0.125 / 1M $0.125 / 1M
एकूण इनपुट टोकन्स 298,334 195,928
आउटपुट टोकन्स 10,328 5,728
रिझनिंग टोकन्स 55,846 19,152
प्रतिसाद वेळ (सरासरी) 7.71s 23.23s
प्रतिसाद वेळ (कमाल) 47.70s 89.37s
प्रतिसाद वेळ (एकूण) 177.29s 534.22s
पॅरामीटर्स ~50B ~400B एकूण (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#120 Claude Haiku 5.5

medium
खर्च
$0.002
वेळ
17.2s
टोकन्स
3,524 tok

#125 GPT-6 Luna

low
खर्च
$0.002
वेळ
19.2s
टोकन्स
2,598 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Haiku 5.5 6.3 4.8 66.7% 2 7.16s 10,608 518 11,415
GPT-6 Luna 6.0 7.2 55.6% 1 15.39s 7,302 493 6,655

तुलना जोडी बदला