नेविगेशन
Advertise here

Claude Haiku 5.5 (high) vs GPT-6 Luna (medium)

average score लगभग बराबर है: 8.3 vs 8.3. GPT-6 Luna (medium) की benchmark लागत कम है: $0.047 vs $0.088. Claude Haiku 5.5 (high) तेज है: 10.41s vs 18.07s, pass rates 76.8% vs 73.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#80
कुल आउटपुट टोकन
105,640
प्रतिक्रिया समय (औसत)
10.41s
कुल लागत
$0.088
रैंक
#83
कुल आउटपुट टोकन
53,161
प्रतिक्रिया समय (औसत)
18.07s
कुल लागत
$0.047
अनुशंसित मॉडल Claude Haiku 5.5 (high)

It has the best score here (8.3), while responding about 1.7x faster than GPT-6 Luna (medium).

विस्तृत तुलना

मेट्रिक Claude Haiku 5.5 Claude Haiku 5.5 high रिलीज़: 2026-10-07 GPT-6 Luna GPT-6 Luna medium रिलीज़: 2026-09-23
स्कोर 8.3 8.3
रैंक #80 #83
विश्वसनीयता 10.0 10.0
संगति 8.5 8.9
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 76.8% 73.9%
अस्थिर टेस्ट 4 3
कुल रन 69 69
प्रति परिणाम लागत 0.584 0.313
कुल लागत $0.088 $0.047
इनपुट कीमत $0.100 / 1M $0.100 / 1M
आउटपुट कीमत $0.500 / 1M $0.500 / 1M
कैश पढ़ने की कीमत $0.010 / 1M $0.010 / 1M
कैश लिखने की कीमत $0.125 / 1M $0.125 / 1M
कुल इनपुट टोकन 346,451 203,193
आउटपुट टोकन 10,136 5,751
रीजनिंग टोकन 95,504 47,410
प्रतिक्रिया समय (औसत) 10.41s 18.07s
प्रतिक्रिया समय (अधिकतम) 52.61s 66.44s
प्रतिक्रिया समय (कुल) 239.38s 415.53s
पैरामीटर ~50B ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#80 Claude Haiku 5.5

high
लागत
$0.003
समय
28.0s
टोकन
5,775 tok

#83 GPT-6 Luna

medium
लागत
$0.002
समय
23.6s
टोकन
2,966 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Haiku 5.5 6.0 7.2 55.6% 1 9.54s 10,608 503 16,741
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222

तुलना जोड़ी बदलें