नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 4.8 (medium) vs GPT-6 Luna (medium)

average score जवळपास समान आहे: 8.3 vs 8.3. GPT-6 Luna (medium) चा benchmark खर्च कमी आहे: $0.047 vs $3.490. Claude Opus 4.8 (medium) वेगवान आहे: 16.72s vs 18.07s, pass rates 82.6% vs 73.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-09

तुलना केलेली मॉडेल्स

क्रमांक
#84
एकूण आउटपुट टोकन्स
67,522
प्रतिसाद वेळ (सरासरी)
16.72s
एकूण खर्च
$3.490
क्रमांक
#83
एकूण आउटपुट टोकन्स
53,161
प्रतिसाद वेळ (सरासरी)
18.07s
एकूण खर्च
$0.047
शिफारस केलेले मॉडेल GPT-6 Luna (medium)

It has the best score here (8.3), while costing about 74.4x less than Claude Opus 4.8 (medium).

तपशीलवार तुलना

मेट्रिक Claude Opus 4.8 Claude Opus 4.8 medium प्रकाशन: 2026-05-28 GPT-6 Luna GPT-6 Luna medium प्रकाशन: 2026-09-23
स्कोअर 8.3 8.3
क्रमांक #84 #83
विश्वसनीयता 10.0 10.0
सुसंगतता 9.0 8.9
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 82.6% 73.9%
अस्थिर चाचण्या 3 3
एकूण रन 69 69
प्रति निकाल खर्च 20.527 0.313
एकूण खर्च $3.490 $0.047
इनपुट किंमत $5.000 / 1M $0.100 / 1M
आउटपुट किंमत $25.000 / 1M $0.500 / 1M
कॅश वाचण्याची किंमत $0.500 / 1M $0.010 / 1M
कॅश लिहिण्याची किंमत $6.250 / 1M $0.125 / 1M
एकूण इनपुट टोकन्स 360,294 203,193
आउटपुट टोकन्स 43,441 5,751
रिझनिंग टोकन्स 24,401 47,410
प्रतिसाद वेळ (सरासरी) 16.72s 18.07s
प्रतिसाद वेळ (कमाल) 99.37s 66.44s
प्रतिसाद वेळ (एकूण) 384.66s 415.53s
पॅरामीटर्स ~5T एकूण (~500B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#84 Claude Opus 4.8

medium
खर्च
$0.057
वेळ
23.1s
टोकन्स
2,412 tok

#83 GPT-6 Luna

medium
खर्च
$0.002
वेळ
23.6s
टोकन्स
2,966 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 10.0 10.0 100.0% 0 15.33s 10,590 9,945 1,381
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222

तुलना जोडी बदला