Anthropic: Claude Opus 4.6 vs OpenAI: GPT-5.3 Chat

Claude Opus 4.6 (medium) average score में आगे है: 7.7 vs 7.5. GPT-5.3 Chat की benchmark लागत कम है: $0.571 vs $3.059. GPT-5.3 Chat तेज है: 6.88s vs 34.27s, pass rates 63.6% vs 68.2%.

अनुशंसित मॉडलGPT-5.3 ChatIts score stays close to the best score here (7.5 vs 7.7), while costing about 5.4x less than Claude Opus 4.6 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक	Claude Opus 4.6 Claude Opus 4.6 medium रिलीज़: 2026-02-05	GPT-5.3 Chat GPT-5.3 Chat none रिलीज़: 2026-03-03

मेट्रिक	Claude Opus 4.6 Claude Opus 4.6 medium रिलीज़: 2026-02-05	GPT-5.3 Chat GPT-5.3 Chat none रिलीज़: 2026-03-03
स्कोर	7.7	7.5
रैंक	#50	#62
विश्वसनीयता	10.0	10.0
संगति	8.8	8.2
सही परीक्षण
प्रति प्रयास पास दर	63.6%	68.2%
अस्थिर टेस्ट	3	5
कुल रन	66	66
प्रति परिणाम लागत	23.524	4.387
कुल लागत	$3.059	$0.571
इनपुट कीमत	$5.000 / 1M	$1.750 / 1M
आउटपुट कीमत	$25.000 / 1M	$14.000 / 1M
कुल इनपुट टोकन	108,615	78,990
आउटपुट टोकन	72,286	30,854
रीजनिंग टोकन	28,315	0
प्रतिक्रिया समय (औसत)	34.27s	6.88s
प्रतिक्रिया समय (अधिकतम)	151.51s	18.33s
प्रतिक्रिया समय (कुल)	513.99s	151.31s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#50 Claude Opus 4.6

medium

अमान्य SVG

लागत: $0.000
समय: 300.0s
टोकन: 0 tok

#62 GPT-5.3 Chat

none

लागत: $0.008
समय: 8.1s
टोकन: 634 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

श्रेणी:

एंटी-एआई ट्रिक्स	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Opus 4.6	6.4	5.8	66.7%	2		7.45s	840	986	1,071
GPT-5.3 Chat	6.7	8.1	58.3%	1		3.86s	606	3,167	0

कोडिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Opus 4.6	5.7	7.1	44.4%	1		30.10s	8,522	13,057	4,121
GPT-5.3 Chat	5.6	4.7	55.6%	2		10.52s	7,302	6,632	0

संयुक्त	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Opus 4.6	10.0	10.0	100.0%	0		114.08s	76,073	33,018	9,509
GPT-5.3 Chat	10.0	10.0	100.0%	0		15.07s	55,800	6,851	0

डेटा पार्सिंग और निष्कर्षण	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Opus 4.6	10.0	10.0	100.0%	0		7.37s	8,676	691	757
GPT-5.3 Chat	10.0	10.0	100.0%	0		2.21s	7,140	942	0

डोमेन-विशिष्ट	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Opus 4.6	3.0	10.0	0.0%	0		83.40s	674	14,642	8,687
GPT-5.3 Chat	3.5	4.4	33.3%	2		13.01s	723	8,264	0

Samanya Buddhimatta	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Opus 4.6	10.0	10.0	100.0%	0		5.04s	564	188	292
GPT-5.3 Chat	4.6	10.0	0.0%	0		1.99s	477	319	0

निर्देश पालन	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Opus 4.6	10.0	10.0	100.0%	0		2.43s	792	266	467
GPT-5.3 Chat	9.8	10.0	100.0%	0		3.51s	660	1,491	0

पहेली समाधान	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Opus 4.6	7.7	10.0	66.7%	0		4.71s	816	532	630
GPT-5.3 Chat	10.0	10.0	100.0%	0		2.99s	642	1,758	0

टूल कॉलिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Opus 4.6	10.0	10.0	100.0%	0		9.73s	11,454	861	329
GPT-5.3 Chat	10.0	10.0	100.0%	0		8.36s	5,445	861	0

सामान्य ज्ञान	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Opus 4.6	3.0	10.0	0.0%	0		63.24s	204	8,045	2,452
GPT-5.3 Chat	3.0	10.0	0.0%	0		4.38s	195	569	0

त्वरित तुलना

तुलना जोड़ी बदलें

Claude Opus 4.6mediumvsGPT-5.6 Lunahigh Kimi K2.7 CodemediumvsGPT-5.3 Chatnone GPT-5.3 ChatnonevsQwen3.5 Plus 2026-02-15medium Claude Opus 4.6mediumvsDeepSeek V4 Flashhigh Nemotron 3 Ultramediumनिःशुल्क उपलब्धvsGPT-5.3 Chatnone Claude Opus 4.6mediumvsDeepSeek V4 Prohigh GPT-5.3 ChatnonevsQwen3.5-27Bmedium GPT-5.3 ChatnonevsGrok Build 0.1medium LongCat 2.0mediumvsGPT-5.3 Chatnone MiniMax M3mediumvsGPT-5.3 Chatnone Gemini 3 Flash PreviewlowvsGPT-5.3 Chatnone KAT-Coder-Pro V2.5lowvsGPT-5.3 Chatnone