नेव्हिगेशन
AI BENCHY
Advertise here

Claude Sonnet 5 vs GPT-5.6 Luna (low)

average score जवळपास समान आहे: 6.1 vs 6.2. GPT-5.6 Luna (low) चा benchmark खर्च कमी आहे: $0.051 vs $0.548. GPT-5.6 Luna (low) वेगवान आहे: 5.20s vs 6.05s, pass rates 40.9% vs 54.5%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-29

क्रमांक
#170
एकूण आउटपुट टोकन्स
22,508
प्रतिसाद वेळ (सरासरी)
6.05s
एकूण खर्च
$0.548
क्रमांक
#169
एकूण आउटपुट टोकन्स
26,286
प्रतिसाद वेळ (सरासरी)
5.20s
एकूण खर्च
$0.051
शिफारस केलेले मॉडेल GPT-5.6 Luna (low)

It has the best score here (6.2), while costing about 10.8x less than Claude Sonnet 5.

तपशीलवार तुलना

मेट्रिक Claude Sonnet 5 Claude Sonnet 5 none प्रकाशन: 2026-06-30 GPT-5.6 Luna GPT-5.6 Luna low प्रकाशन: 2026-07-09
स्कोअर 6.1 6.2
क्रमांक #170 #169
विश्वसनीयता 10.0 10.0
सुसंगतता 8.7 8.2
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 40.9% 54.5%
अस्थिर चाचण्या 4 5
एकूण रन 66 66
प्रति निकाल खर्च 7.817 2.437
एकूण खर्च $0.548 $0.051
इनपुट किंमत $2.000 / 1M $0.200 / 1M
आउटपुट किंमत $10.000 / 1M $1.200 / 1M
एकूण इनपुट टोकन्स 161,032 96,355
आउटपुट टोकन्स 22,508 8,213
रिझनिंग टोकन्स 0 18,073
प्रतिसाद वेळ (सरासरी) 6.05s 5.20s
प्रतिसाद वेळ (कमाल) 33.39s 19.44s
प्रतिसाद वेळ (एकूण) 132.99s 114.46s
पॅरामीटर्स ~1T एकूण (~100B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#170 Claude Sonnet 5

none
खर्च
$0.061
वेळ
53.7s
टोकन्स
6,172 tok

#169 GPT-5.6 Luna

low
खर्च
$0.011
वेळ
10.2s
टोकन्स
1,897 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 5 4.6 7.9 22.2% 1 3.67s 10,590 1,864 0
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535

झटपट तुलना

तुलना जोडी बदला