नेव्हिगेशन
AI BENCHY
Advertise here

Claude Opus 5 vs OpenAI: GPT-5.6 Luna

average score जवळपास समान आहे: 7.5 vs 7.6. GPT-5.6 Luna (medium) चा benchmark खर्च कमी आहे: $0.352 vs $1.550. GPT-5.6 Luna (medium) वेगवान आहे: 7.28s vs 7.60s, pass rates 57.6% vs 65.2%.

शिफारस केलेले मॉडेलGPT-5.6 Luna (medium)It has the best score here (7.6), while costing about 4.4x less than Claude Opus 5.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 none प्रकाशन: 2026-07-25 GPT-5.6 Luna GPT-5.6 Luna medium प्रकाशन: 2026-07-09
स्कोअर 7.5 7.6
क्रमांक #59 #57
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 9.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 57.6% 65.2%
अस्थिर चाचण्या 1 1
एकूण रन 66 66
प्रति निकाल खर्च 12.912 2.513
एकूण खर्च $1.550 $0.352
इनपुट किंमत $5.000 / 1M $1.000 / 1M
आउटपुट किंमत $25.000 / 1M $6.000 / 1M
एकूण इनपुट टोकन्स 185,550 89,676
आउटपुट टोकन्स 24,866 5,699
रिझनिंग टोकन्स 0 37,980
प्रतिसाद वेळ (सरासरी) 7.60s 7.28s
प्रतिसाद वेळ (कमाल) 47.72s 29.85s
प्रतिसाद वेळ (एकूण) 167.28s 160.27s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 Claude Opus 5

none
खर्च
$0.271
वेळ
149.3s
टोकन्स
10,962 tok

#57 GPT-5.6 Luna

medium
खर्च
$0.014
वेळ
14.6s
टोकन्स
2,362 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928

झटपट तुलना

तुलना जोडी बदला