नेव्हिगेशन
Advertise here

Claude Opus 5.5 (medium) vs GPT-5.5 (low)

GPT-5.5 (low) average score मध्ये पुढे आहे: 9.5 vs 9.2. Claude Opus 5.5 (medium) चा benchmark खर्च कमी आहे: $1.804 vs $1.822. GPT-5.5 (low) वेगवान आहे: 11.91s vs 25.85s, pass rates 89.9% vs 87.0%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-07

तुलना केलेली मॉडेल्स

क्रमांक
#29
एकूण आउटपुट टोकन्स
32,127
प्रतिसाद वेळ (सरासरी)
25.85s
एकूण खर्च
$1.804
क्रमांक
#22
एकूण आउटपुट टोकन्स
31,065
प्रतिसाद वेळ (सरासरी)
11.91s
एकूण खर्च
$1.822
शिफारस केलेले मॉडेल GPT-5.5 (low)

It has the best score here (9.5), while responding about 2.2x faster than Claude Opus 5.5 (medium).

तपशीलवार तुलना

मेट्रिक Claude Opus 5.5 Claude Opus 5.5 medium प्रकाशन: 2026-09-23 GPT-5.5 GPT-5.5 low प्रकाशन: 2026-04-24
स्कोअर 9.2 9.5
क्रमांक #29 #22
विश्वसनीयता 10.0 10.0
सुसंगतता 9.7 10.0
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 89.9% 87.0%
अस्थिर चाचण्या 1 0
एकूण रन 69 69
प्रति निकाल खर्च 9.016 9.109
एकूण खर्च $1.804 $1.822
इनपुट किंमत $4.000 / 1M $5.000 / 1M
आउटपुट किंमत $20.000 / 1M $30.000 / 1M
कॅश वाचण्याची किंमत $0.200 / 1M $0.500 / 1M
कॅश लिहिण्याची किंमत $5.000 / 1M लागू नाही
एकूण इनपुट टोकन्स 290,117 177,939
आउटपुट टोकन्स 9,805 6,283
रिझनिंग टोकन्स 22,322 24,782
प्रतिसाद वेळ (सरासरी) 25.85s 11.91s
प्रतिसाद वेळ (कमाल) 90.20s 56.19s
प्रतिसाद वेळ (एकूण) 594.63s 273.82s
पॅरामीटर्स ~5T एकूण (~500B सक्रिय) ~1.5T एकूण (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#29 Claude Opus 5.5

medium
खर्च
$0.053
वेळ
25.6s
टोकन्स
2,781 tok

#22 GPT-5.5

low
खर्च
$0.068
वेळ
37.0s
टोकन्स
2,339 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 5.5 8.4 7.4 88.9% 1 13.50s 10,608 636 4,341
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

तुलना जोडी बदला