नेव्हिगेशन
AI BENCHY
Advertise here

Anthropic: Claude Opus 4.7 vs Anthropic: Claude Sonnet 4.6

Claude Opus 4.7 (medium) average score मध्ये पुढे आहे: 8.7 vs 7.8. Claude Opus 4.7 (medium) चा benchmark खर्च कमी आहे: $1.477 vs $2.057. Claude Opus 4.7 (medium) वेगवान आहे: 7.61s vs 25.91s, pass rates 83.3% vs 66.7%.

शिफारस केलेले मॉडेलClaude Opus 4.7 (medium)It has the best score here (8.7), while responding about 3.4x faster than Claude Sonnet 4.6 (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-20

मेट्रिक Claude Opus 4.7 Claude Opus 4.7 medium प्रकाशन: 2026-04-16 Claude Sonnet 4.6 Claude Sonnet 4.6 medium प्रकाशन: 2026-02-17
स्कोअर 8.7 7.8
क्रमांक #15 #40
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 9.2
बरोबर चाचण्या
प्रति प्रयत्न पास दर 83.3% 66.7%
अस्थिर चाचण्या 1 2
एकूण रन 66 66
प्रति निकाल खर्च 8.201 14.692
एकूण खर्च $1.477 $2.057
इनपुट किंमत $5.000 / 1M $3.000 / 1M
आउटपुट किंमत $25.000 / 1M $15.000 / 1M
एकूण इनपुट टोकन्स 145,252 106,292
आउटपुट टोकन्स 24,948 80,748
रिझनिंग टोकन्स 5,042 35,117
प्रतिसाद वेळ (सरासरी) 7.61s 25.91s
प्रतिसाद वेळ (कमाल) 65.40s 140.96s
प्रतिसाद वेळ (एकूण) 159.91s 362.78s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#15 Claude Opus 4.7

medium
खर्च
$0.059
वेळ
26.8s
टोकन्स
2,475 tok

#40 Claude Sonnet 4.6

medium
अवैध SVG
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114
Claude Sonnet 4.6 5.7 6.6 44.4% 1 33.29s 6,995 16,089 3,686

झटपट तुलना

तुलना जोडी बदला