नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Anthropic: Claude Sonnet 4.6 vs Google: Gemini 2.5 Flash

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-05-22

मेट्रिक Claude Sonnet 4.6 Claude Sonnet 4.6 medium रिलीज़: 2026-02-17 Gemini 2.5 Flash Gemini 2.5 Flash medium रिलीज़: 2025-06-17
स्कोर 7.6 7.7
रैंक #47 #38
विश्वसनीयता 10.0 10.0
संगति 9.2 9.6
सही परीक्षण
प्रति प्रयास पास दर 68.3% 68.3%
अस्थिर टेस्ट 2 1
कुल रन 60 60
प्रति परिणाम लागत 10.227 2.750
कुल लागत $1.330 $0.358
???? ??? $3.000 / 1M $0.300 / 1M
????? ??? $15.000 / 1M $2.500 / 1M
आउटपुट टोकन 49,888 1,924
रीजनिंग टोकन 29,554 137,255
प्रतिक्रिया समय (औसत) 15.72s 15.69s
प्रतिक्रिया समय (अधिकतम) 46.35s 95.48s
प्रतिक्रिया समय (कुल) 188.69s 313.76s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 6.5 10.0 50.0% 0 2.98s 1,046 1,093
Gemini 2.5 Flash 8.4 10.0 75.0% 0 6.30s 255 10,233
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 6.9 6.0 66.7% 1 33.87s 11,277 3,281
Gemini 2.5 Flash 6.6 10.0 50.0% 0 54.56s 537 24,413
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 46.35s 5,871 3,962
Gemini 2.5 Flash 10.0 10.0 100.0% 0 28.44s 303 11,922
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 13.90s 649 742
Gemini 2.5 Flash 10.0 10.0 100.0% 0 4.06s 279 2,325
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 2.9 7.2 11.1% 1 0ms 25,790 16,919
Gemini 2.5 Flash 5.9 7.2 55.6% 1 37.34s 18 80,702
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.94s 256 433
Gemini 2.5 Flash 4.8 10.0 0.0% 0 4.86s 92 1,899
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 2.61s 318 552
Gemini 2.5 Flash 9.8 10.0 100.0% 0 2.62s 69 1,203
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.80s 589 635
Gemini 2.5 Flash 7.7 10.0 66.7% 0 3.94s 126 2,499
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 7.48s 655 351
Gemini 2.5 Flash 10.0 10.0 100.0% 0 6.20s 234 1,140
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 3.0 10.0 0.0% 0 30.09s 3,437 1,586
Gemini 2.5 Flash 3.0 10.0 0.0% 0 2.76s 11 919

त्वरित तुलना

तुलना जोड़ी बदलें