नेविगेशन
AI BENCHY
Advertise here

Claude Sonnet 5 vs GPT-5.6 Luna (low)

average score लगभग बराबर है: 6.1 vs 6.2. GPT-5.6 Luna (low) की benchmark लागत कम है: $0.051 vs $0.548. GPT-5.6 Luna (low) तेज है: 5.20s vs 6.05s, pass rates 40.9% vs 54.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-29

रैंक
#170
कुल आउटपुट टोकन
22,508
प्रतिक्रिया समय (औसत)
6.05s
कुल लागत
$0.548
रैंक
#169
कुल आउटपुट टोकन
26,286
प्रतिक्रिया समय (औसत)
5.20s
कुल लागत
$0.051
अनुशंसित मॉडल GPT-5.6 Luna (low)

It has the best score here (6.2), while costing about 10.8x less than Claude Sonnet 5.

विस्तृत तुलना

मेट्रिक Claude Sonnet 5 Claude Sonnet 5 none रिलीज़: 2026-06-30 GPT-5.6 Luna GPT-5.6 Luna low रिलीज़: 2026-07-09
स्कोर 6.1 6.2
रैंक #170 #169
विश्वसनीयता 10.0 10.0
संगति 8.7 8.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 40.9% 54.5%
अस्थिर टेस्ट 4 5
कुल रन 66 66
प्रति परिणाम लागत 7.817 2.437
कुल लागत $0.548 $0.051
इनपुट कीमत $2.000 / 1M $0.200 / 1M
आउटपुट कीमत $10.000 / 1M $1.200 / 1M
कुल इनपुट टोकन 161,032 96,355
आउटपुट टोकन 22,508 8,213
रीजनिंग टोकन 0 18,073
प्रतिक्रिया समय (औसत) 6.05s 5.20s
प्रतिक्रिया समय (अधिकतम) 33.39s 19.44s
प्रतिक्रिया समय (कुल) 132.99s 114.46s
पैरामीटर ~1T कुल (~100B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#170 Claude Sonnet 5

none
लागत
$0.061
समय
53.7s
टोकन
6,172 tok

#169 GPT-5.6 Luna

low
लागत
$0.011
समय
10.2s
टोकन
1,897 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5 4.6 7.9 22.2% 1 3.67s 10,590 1,864 0
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535

त्वरित तुलना

तुलना जोड़ी बदलें