नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Haiku 5.5 (medium) vs GPT-6 Luna (low)

Claude Haiku 5.5 (medium) average score में आगे है: 7.7 vs 7.6. GPT-6 Luna (low) की benchmark लागत कम है: $0.033 vs $0.063. Claude Haiku 5.5 (medium) तेज है: 7.71s vs 23.23s, pass rates 71.0% vs 63.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#120
कुल आउटपुट टोकन
66,174
प्रतिक्रिया समय (औसत)
7.71s
कुल लागत
$0.063
रैंक
#125
कुल आउटपुट टोकन
24,880
प्रतिक्रिया समय (औसत)
23.23s
कुल लागत
$0.033
अनुशंसित मॉडल Claude Haiku 5.5 (medium)

It has the best score here (7.7), while responding about 3.0x faster than GPT-6 Luna (low).

विस्तृत तुलना

मेट्रिक Claude Haiku 5.5 Claude Haiku 5.5 medium रिलीज़: 2026-10-07 GPT-6 Luna GPT-6 Luna low रिलीज़: 2026-09-23
स्कोर 7.7 7.6
रैंक #120 #125
विश्वसनीयता 10.0 9.7
संगति 7.5 8.5
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 71.0% 63.8%
अस्थिर टेस्ट 7 4
कुल रन 69 69
प्रति परिणाम लागत 0.485 0.267
कुल लागत $0.063 $0.033
इनपुट कीमत $0.100 / 1M $0.100 / 1M
आउटपुट कीमत $0.500 / 1M $0.500 / 1M
कैश पढ़ने की कीमत $0.010 / 1M $0.010 / 1M
कैश लिखने की कीमत $0.125 / 1M $0.125 / 1M
कुल इनपुट टोकन 298,334 195,928
आउटपुट टोकन 10,328 5,728
रीजनिंग टोकन 55,846 19,152
प्रतिक्रिया समय (औसत) 7.71s 23.23s
प्रतिक्रिया समय (अधिकतम) 47.70s 89.37s
प्रतिक्रिया समय (कुल) 177.29s 534.22s
पैरामीटर ~50B ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#120 Claude Haiku 5.5

medium
लागत
$0.002
समय
17.2s
टोकन
3,524 tok

#125 GPT-6 Luna

low
लागत
$0.002
समय
19.2s
टोकन
2,598 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Haiku 5.5 6.3 4.8 66.7% 2 7.16s 10,608 518 11,415
GPT-6 Luna 6.0 7.2 55.6% 1 15.39s 7,302 493 6,655

तुलना जोड़ी बदलें