नेविगेशन
Advertise here

Claude Opus 5.5 (medium) vs GPT-5.5 (low)

GPT-5.5 (low) average score में आगे है: 9.5 vs 9.2. Claude Opus 5.5 (medium) की benchmark लागत कम है: $1.804 vs $1.822. GPT-5.5 (low) तेज है: 11.91s vs 25.85s, pass rates 89.9% vs 87.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#29
कुल आउटपुट टोकन
32,127
प्रतिक्रिया समय (औसत)
25.85s
कुल लागत
$1.804
रैंक
#22
कुल आउटपुट टोकन
31,065
प्रतिक्रिया समय (औसत)
11.91s
कुल लागत
$1.822
अनुशंसित मॉडल GPT-5.5 (low)

It has the best score here (9.5), while responding about 2.2x faster than Claude Opus 5.5 (medium).

विस्तृत तुलना

मेट्रिक Claude Opus 5.5 Claude Opus 5.5 medium रिलीज़: 2026-09-23 GPT-5.5 GPT-5.5 low रिलीज़: 2026-04-24
स्कोर 9.2 9.5
रैंक #29 #22
विश्वसनीयता 10.0 10.0
संगति 9.7 10.0
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 89.9% 87.0%
अस्थिर टेस्ट 1 0
कुल रन 69 69
प्रति परिणाम लागत 9.016 9.109
कुल लागत $1.804 $1.822
इनपुट कीमत $4.000 / 1M $5.000 / 1M
आउटपुट कीमत $20.000 / 1M $30.000 / 1M
कैश पढ़ने की कीमत $0.200 / 1M $0.500 / 1M
कैश लिखने की कीमत $5.000 / 1M लागू नहीं
कुल इनपुट टोकन 290,117 177,939
आउटपुट टोकन 9,805 6,283
रीजनिंग टोकन 22,322 24,782
प्रतिक्रिया समय (औसत) 25.85s 11.91s
प्रतिक्रिया समय (अधिकतम) 90.20s 56.19s
प्रतिक्रिया समय (कुल) 594.63s 273.82s
पैरामीटर ~5T कुल (~500B सक्रिय) ~1.5T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#29 Claude Opus 5.5

medium
लागत
$0.053
समय
25.6s
टोकन
2,781 tok

#22 GPT-5.5

low
लागत
$0.068
समय
37.0s
टोकन
2,339 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5.5 8.4 7.4 88.9% 1 13.50s 10,608 636 4,341
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

तुलना जोड़ी बदलें