नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 5 vs OpenAI: GPT-5.5

Claude Opus 5 (medium) average score मध्ये पुढे आहे: 9.2 vs 9.0. Claude Opus 5 (medium) चा benchmark खर्च कमी आहे: $1.486 vs $4.137. Claude Opus 5 (medium) वेगवान आहे: 9.38s vs 38.42s, pass rates 83.3% vs 87.9%.

शिफारस केलेले मॉडेलClaude Opus 5 (medium)It has the best score here (9.2), while costing about 2.8x less than GPT-5.5 (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 medium प्रकाशन: 2026-07-25 GPT-5.5 GPT-5.5 medium प्रकाशन: 2026-04-24
स्कोअर 9.2 9.0
क्रमांक #12 #15
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 83.3% 87.9%
अस्थिर चाचण्या 1 3
एकूण रन 66 66
प्रति निकाल खर्च 8.253 22.980
एकूण खर्च $1.486 $4.137
इनपुट किंमत $5.000 / 1M $5.000 / 1M
आउटपुट किंमत $25.000 / 1M $30.000 / 1M
एकूण इनपुट टोकन्स 135,607 80,659
आउटपुट टोकन्स 25,673 5,617
रिझनिंग टोकन्स 6,930 118,819
प्रतिसाद वेळ (सरासरी) 9.38s 38.42s
प्रतिसाद वेळ (कमाल) 35.05s 332.10s
प्रतिसाद वेळ (एकूण) 206.26s 845.35s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#12 Claude Opus 5

medium
खर्च
$0.125
वेळ
69.3s
टोकन्स
5,134 tok

#15 GPT-5.5

medium
खर्च
$0.112
वेळ
71.9s
टोकन्स
3,807 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 5 10.0 10.0 100.0% 0 9.56s 10,590 5,224 1,162
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959

झटपट तुलना

तुलना जोडी बदला