नेविगेशन
Advertise here

Claude Opus 5 (medium) vs GPT-5.5 (low)

GPT-5.5 (low) average score में आगे है: 9.3 vs 9.2. GPT-5.5 (low) की benchmark लागत कम है: $1.257 vs $1.586. GPT-5.5 (low) तेज है: 10.15s vs 10.26s, pass rates 83.3% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-07

तुलना किए गए मॉडल

रैंक
#21
कुल आउटपुट टोकन
36,618
प्रतिक्रिया समय (औसत)
10.26s
कुल लागत
$1.586
रैंक
#16
कुल आउटपुट टोकन
28,540
प्रतिक्रिया समय (औसत)
10.15s
कुल लागत
$1.257
अनुशंसित मॉडल GPT-5.5 (low)

It has the strongest score in this comparison (9.3) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Claude Opus 5 Claude Opus 5 medium रिलीज़: 2026-07-25 GPT-5.5 GPT-5.5 low रिलीज़: 2026-04-24
स्कोर 9.2 9.3
रैंक #21 #16
विश्वसनीयता 10.0 10.0
संगति 9.6 10.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 83.3% 86.4%
अस्थिर टेस्ट 1 0
कुल रन 66 66
प्रति परिणाम लागत 8.811 6.614
कुल लागत $1.586 $1.257
इनपुट कीमत $5.000 / 1M $5.000 / 1M
आउटपुट कीमत $25.000 / 1M $30.000 / 1M
कुल इनपुट टोकन 135,604 80,067
आउटपुट टोकन 23,814 5,378
रीजनिंग टोकन 12,804 23,162
प्रतिक्रिया समय (औसत) 10.26s 10.15s
प्रतिक्रिया समय (अधिकतम) 35.43s 56.19s
प्रतिक्रिया समय (कुल) 225.66s 223.24s
पैरामीटर ~5T कुल (~500B सक्रिय) ~1.5T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#21 Claude Opus 5

medium
लागत
$0.125
समय
69.3s
टोकन
5,134 tok

#16 GPT-5.5

low
लागत
$0.068
समय
37.0s
टोकन
2,339 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 10.0 10.0 100.0% 0 9.56s 10,590 5,224 1,162
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

त्वरित तुलना

तुलना जोड़ी बदलें