नेविगेशन
Advertise here

Claude Sonnet 5.5 (xhigh) vs GPT-6 Luna (high)

average score लगभग बराबर है: 8.3 vs 8.3. GPT-6 Luna (high) की benchmark लागत कम है: $0.054 vs $1.069. Claude Sonnet 5.5 (xhigh) तेज है: 13.17s vs 17.53s, pass rates 78.8% vs 75.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-29

तुलना किए गए मॉडल

रैंक
#79
कुल आउटपुट टोकन
77,105
प्रतिक्रिया समय (औसत)
13.17s
कुल लागत
$1.069
रैंक
#81
कुल आउटपुट टोकन
91,405
प्रतिक्रिया समय (औसत)
17.53s
कुल लागत
$0.054
अनुशंसित मॉडल GPT-6 Luna (high)

It has the best score here (8.3), while costing about 19.9x less than Claude Sonnet 5.5 (xhigh).

विस्तृत तुलना

मेट्रिक Claude Sonnet 5.5 Claude Sonnet 5.5 xhigh रिलीज़: 2026-09-29 GPT-6 Luna GPT-6 Luna high रिलीज़: 2026-09-23
स्कोर 8.3 8.3
रैंक #79 #81
विश्वसनीयता 10.0 10.0
संगति 8.7 9.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 78.8% 75.8%
अस्थिर टेस्ट 4 3
कुल रन 66 66
प्रति परिणाम लागत 7.123 0.359
कुल लागत $1.069 $0.054
इनपुट कीमत $2.000 / 1M $0.100 / 1M
आउटपुट कीमत $10.000 / 1M $0.500 / 1M
कुल इनपुट टोकन 148,643 80,441
आउटपुट टोकन 9,700 4,761
रीजनिंग टोकन 67,405 86,644
प्रतिक्रिया समय (औसत) 13.17s 17.53s
प्रतिक्रिया समय (अधिकतम) 54.91s 106.93s
प्रतिक्रिया समय (कुल) 289.67s 385.74s
पैरामीटर ~1T कुल (~100B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#79 Claude Sonnet 5.5

xhigh
लागत
$0.319
समय
258.6s
टोकन
31,969 tok

#81 GPT-6 Luna

high
लागत
$0.003
समय
49.2s
टोकन
5,231 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5.5 8.2 7.2 88.9% 1 11.90s 10,608 555 9,501
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691

त्वरित तुलना

तुलना जोड़ी बदलें