नेव्हिगेशन
AI BENCHY
Advertise here

Claude Opus 5 vs OpenAI: GPT-5.5

GPT-5.5 (low) average score मध्ये पुढे आहे: 9.3 vs 9.2. GPT-5.5 (low) चा benchmark खर्च कमी आहे: $1.253 vs $2.835. GPT-5.5 (low) वेगवान आहे: 10.13s vs 20.44s, pass rates 84.9% vs 86.4%.

शिफारस केलेले मॉडेलGPT-5.5 (low)It has the best score here (9.3), while costing about 2.3x less than Claude Opus 5 (high).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 high प्रकाशन: 2026-07-25 GPT-5.5 GPT-5.5 low प्रकाशन: 2026-04-24
स्कोअर 9.2 9.3
क्रमांक #11 #9
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 10.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 84.9% 86.4%
अस्थिर चाचण्या 1 0
एकूण रन 66 66
प्रति निकाल खर्च 15.747 6.594
एकूण खर्च $2.835 $1.253
इनपुट किंमत $5.000 / 1M $5.000 / 1M
आउटपुट किंमत $25.000 / 1M $30.000 / 1M
एकूण इनपुट टोकन्स 135,959 80,058
आउटपुट टोकन्स 67,066 5,378
रिझनिंग टोकन्स 19,114 23,040
प्रतिसाद वेळ (सरासरी) 20.44s 10.13s
प्रतिसाद वेळ (कमाल) 159.01s 56.19s
प्रतिसाद वेळ (एकूण) 449.68s 222.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#11 Claude Opus 5

high
खर्च
$0.265
वेळ
144.5s
टोकन्स
10,741 tok

#9 GPT-5.5

low
खर्च
$0.068
वेळ
37.0s
टोकन्स
2,339 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 5 10.0 10.0 100.0% 0 12.73s 10,590 7,547 1,721
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

झटपट तुलना

तुलना जोडी बदला