नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Haiku 5.5 (low) vs GPT-5.6 Luna (medium)

Claude Haiku 5.5 (low) average score में आगे है: 8.6 vs 7.4. Claude Haiku 5.5 (low) की benchmark लागत कम है: $0.061 vs $0.065. Claude Haiku 5.5 (low) तेज है: 7.51s vs 9.64s, pass rates 76.8% vs 62.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#64
कुल आउटपुट टोकन
61,650
प्रतिक्रिया समय (औसत)
7.51s
कुल लागत
$0.061
रैंक
#132
कुल आउटपुट टोकन
47,986
प्रतिक्रिया समय (औसत)
9.64s
कुल लागत
$0.065
अनुशंसित मॉडल Claude Haiku 5.5 (low)

इस तुलना में इसका स्कोर सबसे अधिक है (8.6) और 2 मॉडलों में लागत और प्रतिक्रिया समय का समग्र संतुलन सबसे अच्छा है।

विस्तृत तुलना

मेट्रिक Claude Haiku 5.5 Claude Haiku 5.5 low रिलीज़: 2026-10-07 GPT-5.6 Luna GPT-5.6 Luna medium रिलीज़: 2026-07-09
स्कोर 8.6 7.4
रैंक #64 #132
विश्वसनीयता 10.0 10.0
संगति 8.9 9.0
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 76.8% 62.3%
अस्थिर टेस्ट 3 3
कुल रन 69 69
प्रति परिणाम लागत 0.378 2.822
कुल लागत $0.061 $0.065
इनपुट कीमत $0.100 / 1M $0.200 / 1M
आउटपुट कीमत $0.500 / 1M $1.200 / 1M
कैश पढ़ने की कीमत $0.010 / 1M $0.020 / 1M
कैश लिखने की कीमत $0.125 / 1M $0.250 / 1M
कुल इनपुट टोकन 296,301 212,780
आउटपुट टोकन 10,672 6,849
रीजनिंग टोकन 50,978 41,137
प्रतिक्रिया समय (औसत) 7.51s 9.64s
प्रतिक्रिया समय (अधिकतम) 44.43s 58.09s
प्रतिक्रिया समय (कुल) 172.74s 221.62s
पैरामीटर ~50B ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#64 Claude Haiku 5.5

low
लागत
$0.001
समय
7.4s
टोकन
1,851 tok

#132 GPT-5.6 Luna

medium
लागत
$0.014
समय
14.6s
टोकन
2,362 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Haiku 5.5 7.9 7.5 77.8% 1 7.30s 10,608 531 11,618
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928

तुलना जोड़ी बदलें