नेविगेशन
AI BENCHY
Advertise here

Claude Opus 5 vs OpenAI: GPT-5.5

GPT-5.5 (low) average score में आगे है: 9.3 vs 9.2. GPT-5.5 (low) की benchmark लागत कम है: $1.253 vs $2.835. GPT-5.5 (low) तेज है: 10.13s vs 20.44s, pass rates 84.9% vs 86.4%.

अनुशंसित मॉडलGPT-5.5 (low)It has the best score here (9.3), while costing about 2.3x less than Claude Opus 5 (high).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 high रिलीज़: 2026-07-25 GPT-5.5 GPT-5.5 low रिलीज़: 2026-04-24
स्कोर 9.2 9.3
रैंक #11 #9
विश्वसनीयता 10.0 10.0
संगति 9.6 10.0
सही परीक्षण
प्रति प्रयास पास दर 84.9% 86.4%
अस्थिर टेस्ट 1 0
कुल रन 66 66
प्रति परिणाम लागत 15.747 6.594
कुल लागत $2.835 $1.253
इनपुट कीमत $5.000 / 1M $5.000 / 1M
आउटपुट कीमत $25.000 / 1M $30.000 / 1M
कुल इनपुट टोकन 135,959 80,058
आउटपुट टोकन 67,066 5,378
रीजनिंग टोकन 19,114 23,040
प्रतिक्रिया समय (औसत) 20.44s 10.13s
प्रतिक्रिया समय (अधिकतम) 159.01s 56.19s
प्रतिक्रिया समय (कुल) 449.68s 222.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#11 Claude Opus 5

high
लागत
$0.265
समय
144.5s
टोकन
10,741 tok

#9 GPT-5.5

low
लागत
$0.068
समय
37.0s
टोकन
2,339 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 10.0 10.0 100.0% 0 12.73s 10,590 7,547 1,721
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

त्वरित तुलना

तुलना जोड़ी बदलें