नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Sonnet 5.5 (max) vs GPT-5.5 (low)

GPT-5.5 (low) average score मध्ये पुढे आहे: 9.5 vs 9.2. GPT-5.5 (low) चा benchmark खर्च कमी आहे: $1.822 vs $8.557. GPT-5.5 (low) वेगवान आहे: 11.91s vs 84.26s, pass rates 82.6% vs 87.0%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-07

तुलना केलेली मॉडेल्स

क्रमांक
#31
एकूण आउटपुट टोकन्स
758,707
प्रतिसाद वेळ (सरासरी)
84.26s
एकूण खर्च
$8.557
क्रमांक
#22
एकूण आउटपुट टोकन्स
31,065
प्रतिसाद वेळ (सरासरी)
11.91s
एकूण खर्च
$1.822
शिफारस केलेले मॉडेल GPT-5.5 (low)

It has the best score here (9.5), while costing about 4.7x less than Claude Sonnet 5.5 (max).

तपशीलवार तुलना

मेट्रिक Claude Sonnet 5.5 Claude Sonnet 5.5 max प्रकाशन: 2026-09-29 GPT-5.5 GPT-5.5 low प्रकाशन: 2026-04-24
स्कोअर 9.2 9.5
क्रमांक #31 #22
विश्वसनीयता 10.0 10.0
सुसंगतता 9.4 10.0
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 82.6% 87.0%
अस्थिर चाचण्या 2 0
एकूण रन 69 69
प्रति निकाल खर्च 47.536 9.109
एकूण खर्च $8.557 $1.822
इनपुट किंमत $2.000 / 1M $5.000 / 1M
आउटपुट किंमत $10.000 / 1M $30.000 / 1M
कॅश वाचण्याची किंमत $0.200 / 1M $0.500 / 1M
कॅश लिहिण्याची किंमत $2.500 / 1M लागू नाही
एकूण इनपुट टोकन्स 484,627 177,939
आउटपुट टोकन्स 11,026 6,283
रिझनिंग टोकन्स 747,681 24,782
प्रतिसाद वेळ (सरासरी) 84.26s 11.91s
प्रतिसाद वेळ (कमाल) 488.39s 56.19s
प्रतिसाद वेळ (एकूण) 1937.91s 273.82s
पॅरामीटर्स ~1T एकूण (~100B सक्रिय) ~1.5T एकूण (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#31 Claude Sonnet 5.5

max
OpenRouter returned no showcase content (finish_reason: length).
खर्च
$0.000
वेळ
571.7s
टोकन्स
0 tok

#22 GPT-5.5

low
खर्च
$0.068
वेळ
37.0s
टोकन्स
2,339 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Sonnet 5.5 10.0 10.0 100.0% 0 55.26s 10,608 580 70,730
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

तुलना जोडी बदला