नेव्हिगेशन
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs OpenAI: GPT-5.3 Chat

सारांश

Claude Opus 4.7 (medium) average score मध्ये पुढे आहे: 8.7 vs 7.5. GPT-5.3 Chat चा benchmark खर्च कमी आहे: $0.433 vs $0.679. Claude Opus 4.7 (medium) वेगवान आहे: 4.73s vs 6.34s, pass rates 82.5% vs 66.7%.

शिफारस केलेले मॉडेलClaude Opus 4.7 (medium)It has the strongest score in this comparison (8.7) and the best overall balance of cost and response time across all 2 models.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-14

मेट्रिक Claude Opus 4.7 Claude Opus 4.7 medium प्रकाशन: 2026-04-16 GPT-5.3 Chat GPT-5.3 Chat none प्रकाशन: 2026-03-03
स्कोअर 8.7 7.5
क्रमांक #16 #61
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 8.1
बरोबर चाचण्या
प्रति प्रयत्न पास दर 82.5% 66.7%
अस्थिर चाचण्या 1 5
एकूण रन 63 63
प्रति निकाल खर्च 3.991 3.605
एकूण खर्च $0.679 $0.433
इनपुट किंमत $5.000 / 1M $1.750 / 1M
आउटपुट किंमत $25.000 / 1M $14.000 / 1M
एकूण इनपुट टोकन्स 65,406 34,209
आउटपुट टोकन्स 11,858 26,617
रिझनिंग टोकन्स 2,198 0
प्रतिसाद वेळ (सरासरी) 4.73s 6.34s
प्रतिसाद वेळ (कमाल) 23.18s 18.33s
प्रतिसाद वेळ (एकूण) 94.51s 133.13s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#16 Claude Opus 4.7

medium
खर्च
$0.059
वेळ
26.8s
टोकन्स
2,475 tok

#61 GPT-5.3 Chat

none
खर्च
$0.008
वेळ
8.1s
टोकन्स
634 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0

झटपट तुलना

तुलना जोडी बदला