नेविगेशन
Advertise here

Claude Opus 5 vs GPT-5.6 Luna (high)

average score लगभग बराबर है: 7.5 vs 7.6. GPT-5.6 Luna (high) की benchmark लागत कम है: $0.179 vs $1.550. Claude Opus 5 तेज है: 7.65s vs 16.49s, pass rates 57.6% vs 69.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-08

तुलना किए गए मॉडल

रैंक
#97
कुल आउटपुट टोकन
24,866
प्रतिक्रिया समय (औसत)
7.65s
कुल लागत
$1.550
रैंक
#94
कुल आउटपुट टोकन
135,315
प्रतिक्रिया समय (औसत)
16.49s
कुल लागत
$0.179
अनुशंसित मॉडल GPT-5.6 Luna (high)

It has the best score here (7.6), while costing about 8.7x less than Claude Opus 5.

विस्तृत तुलना

मेट्रिक Claude Opus 5 Claude Opus 5 none रिलीज़: 2026-07-25 GPT-5.6 Luna GPT-5.6 Luna high रिलीज़: 2026-07-09
स्कोर 7.5 7.6
रैंक #97 #94
विश्वसनीयता 10.0 10.0
संगति 9.6 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 57.6% 69.7%
अस्थिर टेस्ट 1 4
कुल रन 66 66
प्रति परिणाम लागत 12.912 6.100
कुल लागत $1.550 $0.179
इनपुट कीमत $5.000 / 1M $0.200 / 1M
आउटपुट कीमत $25.000 / 1M $1.200 / 1M
कुल इनपुट टोकन 185,547 80,927
आउटपुट टोकन 24,866 5,088
रीजनिंग टोकन 0 130,227
प्रतिक्रिया समय (औसत) 7.65s 16.49s
प्रतिक्रिया समय (अधिकतम) 47.72s 111.09s
प्रतिक्रिया समय (कुल) 168.35s 362.78s
पैरामीटर ~5T कुल (~500B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#97 Claude Opus 5

none
लागत
$0.271
समय
149.3s
टोकन
10,962 tok

#94 GPT-5.6 Luna

high
लागत
$0.033
समय
34.2s
टोकन
5,484 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
GPT-5.6 Luna 5.5 4.7 55.6% 2 15.63s 7,302 510 17,746

त्वरित तुलना

तुलना जोड़ी बदलें