नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

Anthropic: Claude Opus 4.7 vs OpenAI: GPT-5.3 Chat

सारांश

Claude Opus 4.7 (medium) average score में आगे है: 8.7 vs 7.5. GPT-5.3 Chat की benchmark लागत कम है: $0.433 vs $0.679. Claude Opus 4.7 (medium) तेज है: 4.73s vs 6.34s, pass rates 82.5% vs 66.7%.

अनुशंसित मॉडलClaude Opus 4.7 (medium)It has the strongest score in this comparison (8.7) and the best overall balance of cost and response time across all 2 models.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-14

मेट्रिक Claude Opus 4.7 Claude Opus 4.7 medium रिलीज़: 2026-04-16 GPT-5.3 Chat GPT-5.3 Chat none रिलीज़: 2026-03-03
स्कोर 8.7 7.5
रैंक #16 #61
विश्वसनीयता 10.0 10.0
संगति 9.6 8.1
सही परीक्षण
प्रति प्रयास पास दर 82.5% 66.7%
अस्थिर टेस्ट 1 5
कुल रन 63 63
प्रति परिणाम लागत 3.991 3.605
कुल लागत $0.679 $0.433
इनपुट कीमत $5.000 / 1M $1.750 / 1M
आउटपुट कीमत $25.000 / 1M $14.000 / 1M
कुल इनपुट टोकन 65,406 34,209
आउटपुट टोकन 11,858 26,617
रीजनिंग टोकन 2,198 0
प्रतिक्रिया समय (औसत) 4.73s 6.34s
प्रतिक्रिया समय (अधिकतम) 23.18s 18.33s
प्रतिक्रिया समय (कुल) 94.51s 133.13s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#16 Claude Opus 4.7

medium
लागत
$0.059
समय
26.8s
टोकन
2,475 tok

#61 GPT-5.3 Chat

none
लागत
$0.008
समय
8.1s
टोकन
634 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0

त्वरित तुलना

तुलना जोड़ी बदलें