नेविगेशन
Advertise here

Claude Opus 5.5 (low) vs GPT-6 Astra (high)

GPT-6 Astra (high) average score में आगे है: 9.9 vs 9.3. Claude Opus 5.5 (low) की benchmark लागत कम है: $0.952 vs $3.474. GPT-6 Astra (high) तेज है: 18.65s vs 23.72s, pass rates 87.9% vs 97.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#20
कुल आउटपुट टोकन
21,004
प्रतिक्रिया समय (औसत)
23.72s
कुल लागत
$0.952
रैंक
#5
कुल आउटपुट टोकन
53,622
प्रतिक्रिया समय (औसत)
18.65s
कुल लागत
$3.474
अनुशंसित मॉडल Claude Opus 5.5 (low)

Its score stays close to the best score here (9.3 vs 9.9), while costing about 3.7x less than GPT-6 Astra (high).

विस्तृत तुलना

मेट्रिक Claude Opus 5.5 Claude Opus 5.5 low रिलीज़: 2026-09-23 GPT-6 Astra GPT-6 Astra high रिलीज़: 2026-09-04
स्कोर 9.3 9.9
रैंक #20 #5
विश्वसनीयता 10.0 9.9
संगति 9.3 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 87.9% 97.0%
अस्थिर टेस्ट 2 1
कुल रन 66 66
प्रति परिणाम लागत 5.284 16.543
कुल लागत $0.952 $3.474
इनपुट कीमत $4.000 / 1M $10.000 / 1M
आउटपुट कीमत $20.000 / 1M $50.000 / 1M
कुल इनपुट टोकन 132,746 79,290
आउटपुट टोकन 6,454 4,847
रीजनिंग टोकन 14,550 48,775
प्रतिक्रिया समय (औसत) 23.72s 18.65s
प्रतिक्रिया समय (अधिकतम) 89.16s 254.93s
प्रतिक्रिया समय (कुल) 521.82s 410.28s
पैरामीटर ~5T कुल (~500B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#20 Claude Opus 5.5

low
अमान्य SVG
लागत
$0.038
समय
19.1s
टोकन
2,010 tok

#5 GPT-6 Astra

high
लागत
$0.457
समय
176.7s
टोकन
9,218 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5.5 10.0 10.0 100.0% 0 12.23s 10,608 575 2,777
GPT-6 Astra 10.0 10.0 100.0% 0 5.86s 7,302 392 2,387

त्वरित तुलना

तुलना जोड़ी बदलें