नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

Anthropic: Claude Opus 4.7 vs Anthropic: Claude Opus 4.7

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-04-16

मेट्रिक Claude Opus 4.7 Claude Opus 4.7 medium रिलीज़: 2026-04-16 Claude Opus 4.7 Claude Opus 4.7 none रिलीज़: 2026-04-16
स्कोर 9.2 9.2
रैंक #3 #4
संगति 10.0 10.0
सही परीक्षण
प्रति प्रयास पास दर 88.9% 88.9%
अस्थिर टेस्ट 0 0
कुल रन 54 54
प्रति परिणाम लागत 2.790 3.155
कुल लागत $0.447 $0.505
???? ??? $5.000 / 1M $5.000 / 1M
????? ??? $25.000 / 1M $25.000 / 1M
आउटपुट टोकन 5,375 6,326
रीजनिंग टोकन 1,341 0
प्रतिक्रिया समय (औसत) 3.53s 3.13s
प्रतिक्रिया समय (अधिकतम) 21.45s 18.27s
प्रतिक्रिया समय (कुल) 60.03s 56.33s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.7 8.3 10.0 75.0% 0 1.85s 348 0
Claude Opus 4.7 8.3 10.0 75.0% 0 2.12s 522 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.7 10.0 10.0 100.0% 0 6.41s 1,141 257
Claude Opus 4.7 10.0 10.0 100.0% 0 2.84s 494 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.7 10.0 10.0 100.0% 0 21.45s 2,369 1,084
Claude Opus 4.7 9.5 10.0 100.0% 0 18.27s 3,504 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.7 10.0 10.0 100.0% 0 2.37s 324 0
Claude Opus 4.7 10.0 10.0 100.0% 0 2.15s 324 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.7 7.7 10.0 66.7% 0 1.17s 51 0
Claude Opus 4.7 7.7 10.0 66.7% 0 1.19s 78 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.7 10.0 10.0 100.0% 0 2.87s 256 0
Claude Opus 4.7 10.0 10.0 100.0% 0 3.47s 257 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.7 10.0 10.0 100.0% 0 1.57s 114 0
Claude Opus 4.7 10.0 10.0 100.0% 0 1.46s 114 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.7 10.0 10.0 100.0% 0 2.51s 399 0
Claude Opus 4.7 10.0 10.0 100.0% 0 2.58s 661 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.7 10.0 10.0 100.0% 0 4.17s 373 0
Claude Opus 4.7 10.0 10.0 100.0% 0 4.74s 372 0

त्वरित तुलना

तुलना जोड़ी बदलें