नेव्हिगेशन
Advertise here

Claude Opus 4.8 vs GPT-5.6 Luna (low)

average score जवळपास समान आहे: 6.9 vs 6.9. GPT-5.6 Luna (low) चा benchmark खर्च कमी आहे: $0.075 vs $2.334. GPT-5.6 Luna (low) वेगवान आहे: 6.96s vs 7.54s, pass rates 60.9% vs 56.5%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-01

तुलना केलेली मॉडेल्स

क्रमांक
#167
एकूण आउटपुट टोकन्स
24,343
प्रतिसाद वेळ (सरासरी)
7.54s
एकूण खर्च
$2.334
क्रमांक
#165
एकूण आउटपुट टोकन्स
28,001
प्रतिसाद वेळ (सरासरी)
6.96s
एकूण खर्च
$0.075
शिफारस केलेले मॉडेल GPT-5.6 Luna (low)

It has the best score here (6.9), while costing about 31.5x less than Claude Opus 4.8.

तपशीलवार तुलना

मेट्रिक Claude Opus 4.8 Claude Opus 4.8 none प्रकाशन: 2026-05-28 GPT-5.6 Luna GPT-5.6 Luna low प्रकाशन: 2026-07-09
स्कोअर 6.9 6.9
क्रमांक #167 #165
विश्वसनीयता 10.0 10.0
सुसंगतता 9.3 8.3
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 60.9% 56.5%
अस्थिर चाचण्या 2 5
एकूण रन 69 69
प्रति निकाल खर्च 17.953 2.428
एकूण खर्च $2.334 $0.075
इनपुट किंमत $5.000 / 1M $0.200 / 1M
आउटपुट किंमत $25.000 / 1M $1.200 / 1M
एकूण इनपुट टोकन्स 345,059 202,680
आउटपुट टोकन्स 24,343 9,230
रिझनिंग टोकन्स 0 18,771
प्रतिसाद वेळ (सरासरी) 7.54s 6.96s
प्रतिसाद वेळ (कमाल) 65.07s 45.74s
प्रतिसाद वेळ (एकूण) 173.31s 160.19s
पॅरामीटर्स ~5T एकूण (~500B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#167 Claude Opus 4.8

none
खर्च
$0.053
वेळ
22.0s
टोकन्स
2,253 tok

#165 GPT-5.6 Luna

low
खर्च
$0.011
वेळ
10.2s
टोकन्स
1,897 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 5.5 10.0 33.3% 0 3.29s 10,590 1,332 0
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535

झटपट तुलना

तुलना जोडी बदला