नेविगेशन
AI BENCHY
Advertise here

Claude Opus 5 vs OpenAI: GPT-5.5

Claude Opus 5 (medium) average score में आगे है: 9.2 vs 9.0. Claude Opus 5 (medium) की benchmark लागत कम है: $1.486 vs $4.137. Claude Opus 5 (medium) तेज है: 9.38s vs 38.42s, pass rates 83.3% vs 87.9%.

अनुशंसित मॉडलClaude Opus 5 (medium)It has the best score here (9.2), while costing about 2.8x less than GPT-5.5 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 medium रिलीज़: 2026-07-25 GPT-5.5 GPT-5.5 medium रिलीज़: 2026-04-24
स्कोर 9.2 9.0
रैंक #12 #15
विश्वसनीयता 10.0 10.0
संगति 9.6 8.9
सही परीक्षण
प्रति प्रयास पास दर 83.3% 87.9%
अस्थिर टेस्ट 1 3
कुल रन 66 66
प्रति परिणाम लागत 8.253 22.980
कुल लागत $1.486 $4.137
इनपुट कीमत $5.000 / 1M $5.000 / 1M
आउटपुट कीमत $25.000 / 1M $30.000 / 1M
कुल इनपुट टोकन 135,607 80,659
आउटपुट टोकन 25,673 5,617
रीजनिंग टोकन 6,930 118,819
प्रतिक्रिया समय (औसत) 9.38s 38.42s
प्रतिक्रिया समय (अधिकतम) 35.05s 332.10s
प्रतिक्रिया समय (कुल) 206.26s 845.35s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#12 Claude Opus 5

medium
लागत
$0.125
समय
69.3s
टोकन
5,134 tok

#15 GPT-5.5

medium
लागत
$0.112
समय
71.9s
टोकन
3,807 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 10.0 10.0 100.0% 0 9.56s 10,590 5,224 1,162
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959

त्वरित तुलना

तुलना जोड़ी बदलें