नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Anthropic: Claude Sonnet 4.6 vs OpenAI: GPT-5.5

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-04-24

मेट्रिक Claude Sonnet 4.6 Claude Sonnet 4.6 none रिलीज़: 2026-02-17 GPT-5.5 GPT-5.5 medium रिलीज़: 2026-04-24
स्कोर 7.4 9.0
रैंक #50 #5
विश्वसनीयता लागू नहीं लागू नहीं
संगति 9.6 9.2
सही परीक्षण
प्रति प्रयास पास दर 64.8% 87.0%
अस्थिर टेस्ट 1 2
कुल रन 54 54
प्रति परिणाम लागत 2.376 19.226
कुल लागत $0.262 $2.884
???? ??? $3.000 / 1M $5.000 / 1M
????? ??? $15.000 / 1M $30.000 / 1M
आउटपुट टोकन 7,433 1,920
रीजनिंग टोकन 0 89,632
प्रतिक्रिया समय (औसत) 4.98s 32.75s
प्रतिक्रिया समय (अधिकतम) 23.84s 332.10s
प्रतिक्रिया समय (कुल) 54.83s 589.59s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 4.8 10.0 25.0% 0 2.94s 1,214 0
GPT-5.5 10.0 10.0 100.0% 0 4.66s 250 1,335
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 3.67s 523 0
GPT-5.5 10.0 10.0 100.0% 0 9.09s 318 1,391
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 9.5 10.0 100.0% 0 23.84s 3,766 0
GPT-5.5 10.0 10.0 100.0% 0 19.29s 312 2,841
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 3.43s 252 0
GPT-5.5 10.0 10.0 100.0% 0 4.18s 234 593
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 7.7 10.0 66.7% 0 3.54s 413 0
GPT-5.5 5.3 7.2 44.4% 1 164.14s 67 79,625
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 6.1 3.1 66.7% 1 2.56s 192 0
GPT-5.5 10.0 10.0 100.0% 0 4.16s 138 223
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 6.5 10.0 50.0% 0 1.96s 90 0
GPT-5.5 10.0 10.0 100.0% 0 3.36s 93 538
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 7.7 10.0 66.7% 0 2.92s 536 0
GPT-5.5 8.6 7.9 77.8% 1 6.78s 250 2,254
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.11s 447 0
GPT-5.5 10.0 10.0 100.0% 0 10.57s 258 832

त्वरित तुलना

तुलना जोड़ी बदलें