नेव्हिगेशन
Advertise here

Claude Opus 4.8 vs GPT-6 Sol

Claude Opus 4.8 average score मध्ये पुढे आहे: 7.3 vs 7.2. GPT-6 Sol चा benchmark खर्च कमी आहे: $0.280 vs $1.166. Claude Opus 4.8 वेगवान आहे: 4.92s vs 6.84s, pass rates 63.6% vs 66.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-23

तुलना केलेली मॉडेल्स

क्रमांक
#144
एकूण आउटपुट टोकन्स
16,797
प्रतिसाद वेळ (सरासरी)
4.92s
एकूण खर्च
$1.166
क्रमांक
#148
एकूण आउटपुट टोकन्स
6,696
प्रतिसाद वेळ (सरासरी)
6.84s
एकूण खर्च
$0.280
शिफारस केलेले मॉडेल GPT-6 Sol

Its score stays close to the best score here (7.2 vs 7.3), while costing about 4.2x less than Claude Opus 4.8.

तपशीलवार तुलना

मेट्रिक Claude Opus 4.8 Claude Opus 4.8 none प्रकाशन: 2026-05-28 GPT-6 Sol GPT-6 Sol none प्रकाशन: 2026-09-23
स्कोअर 7.3 7.2
क्रमांक #144 #148
विश्वसनीयता 10.0 10.0
सुसंगतता 9.2 8.5
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 63.6% 66.7%
अस्थिर चाचण्या 2 4
एकूण रन 66 66
प्रति निकाल खर्च 8.969 2.151
एकूण खर्च $1.166 $0.280
इनपुट किंमत $5.000 / 1M $2.000 / 1M
आउटपुट किंमत $25.000 / 1M $10.000 / 1M
एकूण इनपुट टोकन्स 149,203 106,332
आउटपुट टोकन्स 16,797 6,696
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 4.92s 6.84s
प्रतिसाद वेळ (कमाल) 35.03s 23.89s
प्रतिसाद वेळ (एकूण) 108.24s 150.43s
पॅरामीटर्स ~5T एकूण (~500B सक्रिय) ~2T एकूण (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#144 Claude Opus 4.8

none
खर्च
$0.053
वेळ
22.0s
टोकन्स
2,253 tok

#148 GPT-6 Sol

none
खर्च
$0.030
वेळ
31.9s
टोकन्स
3,055 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 5.5 10.0 33.3% 0 3.29s 10,590 1,332 0
GPT-6 Sol 5.5 10.0 33.3% 0 12.23s 7,302 389 0

झटपट तुलना

तुलना जोडी बदला