नेविगेशन
Advertise here

Claude Opus 5.5 (high) vs GPT-6 Astra (medium)

GPT-6 Astra (medium) average score में आगे है: 9.4 vs 9.3. Claude Opus 5.5 (high) की benchmark लागत कम है: $1.266 vs $1.774. GPT-6 Astra (medium) तेज है: 8.08s vs 25.88s, pass rates 86.4% vs 90.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#21
कुल आउटपुट टोकन
36,457
प्रतिक्रिया समय (औसत)
25.88s
कुल लागत
$1.266
रैंक
#16
कुल आउटपुट टोकन
19,627
प्रतिक्रिया समय (औसत)
8.08s
कुल लागत
$1.774
अनुशंसित मॉडल GPT-6 Astra (medium)

It has the best score here (9.4), while responding about 3.2x faster than Claude Opus 5.5 (high).

विस्तृत तुलना

मेट्रिक Claude Opus 5.5 Claude Opus 5.5 high रिलीज़: 2026-09-23 GPT-6 Astra GPT-6 Astra medium रिलीज़: 2026-09-04
स्कोर 9.3 9.4
रैंक #21 #16
विश्वसनीयता 10.0 9.9
संगति 9.3 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 86.4% 90.9%
अस्थिर टेस्ट 2 2
कुल रन 66 66
प्रति परिणाम लागत 7.029 9.337
कुल लागत $1.266 $1.774
इनपुट कीमत $4.000 / 1M $10.000 / 1M
आउटपुट कीमत $20.000 / 1M $50.000 / 1M
कुल इनपुट टोकन 134,020 79,264
आउटपुट टोकन 7,237 4,789
रीजनिंग टोकन 29,220 14,838
प्रतिक्रिया समय (औसत) 25.88s 8.08s
प्रतिक्रिया समय (अधिकतम) 95.95s 73.48s
प्रतिक्रिया समय (कुल) 569.33s 177.70s
पैरामीटर ~5T कुल (~500B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#21 Claude Opus 5.5

high
लागत
$0.136
समय
75.6s
टोकन
6,934 tok

#16 GPT-6 Astra

medium
लागत
$0.231
समय
81.0s
टोकन
4,708 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5.5 10.0 10.0 100.0% 0 13.44s 10,608 584 5,042
GPT-6 Astra 10.0 10.0 100.0% 0 4.95s 7,302 394 1,673

त्वरित तुलना

तुलना जोड़ी बदलें