नेविगेशन
AI BENCHY
Advertise here

Claude Opus 4.7 (medium) vs GPT-5.2 Chat

Claude Opus 4.7 (medium) average score में आगे है: 8.7 vs 8.0. GPT-5.2 Chat की benchmark लागत कम है: $0.604 vs $1.477. Claude Opus 4.7 (medium) तेज है: 7.61s vs 7.65s, pass rates 83.3% vs 74.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-07

रैंक
#23
कुल आउटपुट टोकन
29,990
प्रतिक्रिया समय (औसत)
7.61s
कुल लागत
$1.477
रैंक
#44
कुल आउटपुट टोकन
30,424
प्रतिक्रिया समय (औसत)
7.65s
कुल लागत
$0.604
अनुशंसित मॉडल Claude Opus 4.7 (medium)

It has the strongest score in this comparison (8.7) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Claude Opus 4.7 Claude Opus 4.7 medium रिलीज़: 2026-04-16 GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11
स्कोर 8.7 8.0
रैंक #23 #44
विश्वसनीयता 10.0 10.0
संगति 9.6 8.6
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 83.3% 74.2%
अस्थिर टेस्ट 1 4
कुल रन 66 66
प्रति परिणाम लागत 8.201 4.308
कुल लागत $1.477 $0.604
इनपुट कीमत $5.000 / 1M $1.750 / 1M
आउटपुट कीमत $25.000 / 1M $14.000 / 1M
कुल इनपुट टोकन 145,252 101,248
आउटपुट टोकन 24,948 30,424
रीजनिंग टोकन 5,042 0
प्रतिक्रिया समय (औसत) 7.61s 7.65s
प्रतिक्रिया समय (अधिकतम) 65.40s 38.52s
प्रतिक्रिया समय (कुल) 159.91s 168.39s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#23 Claude Opus 4.7

medium
लागत
$0.059
समय
26.8s
टोकन
2,475 tok

#44 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0

त्वरित तुलना

तुलना जोड़ी बदलें