नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 5.5 (medium) vs GPT-5.6 Sol (high)

GPT-5.6 Sol (high) average score मध्ये पुढे आहे: 9.5 vs 9.2. GPT-5.6 Sol (high) चा benchmark खर्च कमी आहे: $1.595 vs $1.804. GPT-5.6 Sol (high) वेगवान आहे: 13.59s vs 25.85s, pass rates 89.9% vs 89.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-07

तुलना केलेली मॉडेल्स

क्रमांक
#29
एकूण आउटपुट टोकन्स
32,127
प्रतिसाद वेळ (सरासरी)
25.85s
एकूण खर्च
$1.804
क्रमांक
#21
एकूण आउटपुट टोकन्स
32,071
प्रतिसाद वेळ (सरासरी)
13.59s
एकूण खर्च
$1.595
शिफारस केलेले मॉडेल GPT-5.6 Sol (high)

It has the best score here (9.5), while responding about 1.9x faster than Claude Opus 5.5 (medium).

तपशीलवार तुलना

मेट्रिक Claude Opus 5.5 Claude Opus 5.5 medium प्रकाशन: 2026-09-23 GPT-5.6 Sol GPT-5.6 Sol high प्रकाशन: 2026-07-09
स्कोअर 9.2 9.5
क्रमांक #29 #21
विश्वसनीयता 10.0 10.0
सुसंगतता 9.7 8.9
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 89.9% 89.9%
अस्थिर चाचण्या 1 3
एकूण रन 69 69
प्रति निकाल खर्च 9.016 8.020
एकूण खर्च $1.804 $1.595
इनपुट किंमत $4.000 / 1M $2.000 / 1M
आउटपुट किंमत $20.000 / 1M $10.000 / 1M
कॅश वाचण्याची किंमत $0.200 / 1M $0.200 / 1M
कॅश लिहिण्याची किंमत $5.000 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 290,117 195,567
आउटपुट टोकन्स 9,805 5,841
रिझनिंग टोकन्स 22,322 26,230
प्रतिसाद वेळ (सरासरी) 25.85s 13.59s
प्रतिसाद वेळ (कमाल) 90.20s 59.99s
प्रतिसाद वेळ (एकूण) 594.63s 312.61s
पॅरामीटर्स ~5T एकूण (~500B सक्रिय) ~2T एकूण (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#29 Claude Opus 5.5

medium
खर्च
$0.053
वेळ
25.6s
टोकन्स
2,781 tok

#21 GPT-5.6 Sol

high
खर्च
$0.151
वेळ
201.9s
टोकन्स
5,100 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 5.5 8.4 7.4 88.9% 1 13.50s 10,608 636 4,341
GPT-5.6 Sol 10.0 10.0 100.0% 0 12.52s 7,302 404 5,656

तुलना जोडी बदला