नेव्हिगेशन
Advertise here

Claude Opus 5 vs GPT-5.6 Luna (high)

average score जवळपास समान आहे: 7.5 vs 7.6. GPT-5.6 Luna (high) चा benchmark खर्च कमी आहे: $0.179 vs $1.550. Claude Opus 5 वेगवान आहे: 7.65s vs 16.49s, pass rates 57.6% vs 69.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-08

तुलना केलेली मॉडेल्स

क्रमांक
#97
एकूण आउटपुट टोकन्स
24,866
प्रतिसाद वेळ (सरासरी)
7.65s
एकूण खर्च
$1.550
क्रमांक
#94
एकूण आउटपुट टोकन्स
135,315
प्रतिसाद वेळ (सरासरी)
16.49s
एकूण खर्च
$0.179
शिफारस केलेले मॉडेल GPT-5.6 Luna (high)

It has the best score here (7.6), while costing about 8.7x less than Claude Opus 5.

तपशीलवार तुलना

मेट्रिक Claude Opus 5 Claude Opus 5 none प्रकाशन: 2026-07-25 GPT-5.6 Luna GPT-5.6 Luna high प्रकाशन: 2026-07-09
स्कोअर 7.5 7.6
क्रमांक #97 #94
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 8.5
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 57.6% 69.7%
अस्थिर चाचण्या 1 4
एकूण रन 66 66
प्रति निकाल खर्च 12.912 6.100
एकूण खर्च $1.550 $0.179
इनपुट किंमत $5.000 / 1M $0.200 / 1M
आउटपुट किंमत $25.000 / 1M $1.200 / 1M
एकूण इनपुट टोकन्स 185,547 80,927
आउटपुट टोकन्स 24,866 5,088
रिझनिंग टोकन्स 0 130,227
प्रतिसाद वेळ (सरासरी) 7.65s 16.49s
प्रतिसाद वेळ (कमाल) 47.72s 111.09s
प्रतिसाद वेळ (एकूण) 168.35s 362.78s
पॅरामीटर्स ~5T एकूण (~500B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#97 Claude Opus 5

none
खर्च
$0.271
वेळ
149.3s
टोकन्स
10,962 tok

#94 GPT-5.6 Luna

high
खर्च
$0.033
वेळ
34.2s
टोकन्स
5,484 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
GPT-5.6 Luna 5.5 4.7 55.6% 2 15.63s 7,302 510 17,746

झटपट तुलना

तुलना जोडी बदला