नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Haiku 5.5 (low) vs GPT-5.6 Luna (high)

Claude Haiku 5.5 (low) average score मध्ये पुढे आहे: 8.6 vs 8.0. Claude Haiku 5.5 (low) चा benchmark खर्च कमी आहे: $0.061 vs $0.118. Claude Haiku 5.5 (low) वेगवान आहे: 7.51s vs 18.39s, pass rates 76.8% vs 71.0%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-07

तुलना केलेली मॉडेल्स

क्रमांक
#64
एकूण आउटपुट टोकन्स
61,650
प्रतिसाद वेळ (सरासरी)
7.51s
एकूण खर्च
$0.061
क्रमांक
#96
एकूण आउटपुट टोकन्स
139,395
प्रतिसाद वेळ (सरासरी)
18.39s
एकूण खर्च
$0.118
शिफारस केलेले मॉडेल Claude Haiku 5.5 (low)

It has the best score here (8.6), while costing about 1.9x less than GPT-5.6 Luna (high).

तपशीलवार तुलना

मेट्रिक Claude Haiku 5.5 Claude Haiku 5.5 low प्रकाशन: 2026-10-07 GPT-5.6 Luna GPT-5.6 Luna high प्रकाशन: 2026-07-09
स्कोअर 8.6 8.0
क्रमांक #64 #96
विश्वसनीयता 10.0 10.0
सुसंगतता 8.9 8.6
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 76.8% 71.0%
अस्थिर चाचण्या 3 4
एकूण रन 69 69
प्रति निकाल खर्च 0.378 5.882
एकूण खर्च $0.061 $0.118
इनपुट किंमत $0.100 / 1M $0.200 / 1M
आउटपुट किंमत $0.500 / 1M $1.200 / 1M
कॅश वाचण्याची किंमत $0.010 / 1M $0.020 / 1M
कॅश लिहिण्याची किंमत $0.125 / 1M $0.250 / 1M
एकूण इनपुट टोकन्स 296,301 197,896
आउटपुट टोकन्स 10,672 6,211
रिझनिंग टोकन्स 50,978 133,184
प्रतिसाद वेळ (सरासरी) 7.51s 18.39s
प्रतिसाद वेळ (कमाल) 44.43s 111.09s
प्रतिसाद वेळ (एकूण) 172.74s 422.93s
पॅरामीटर्स ~50B ~400B एकूण (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#64 Claude Haiku 5.5

low
खर्च
$0.001
वेळ
7.4s
टोकन्स
1,851 tok

#96 GPT-5.6 Luna

high
खर्च
$0.033
वेळ
34.2s
टोकन्स
5,484 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Haiku 5.5 7.9 7.5 77.8% 1 7.30s 10,608 531 11,618
GPT-5.6 Luna 5.5 4.7 55.6% 2 15.63s 7,302 510 17,746

तुलना जोडी बदला