नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

Anthropic: Claude Opus 4.8 vs Google: Gemma 4 26B A4B

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-05-29

मेट्रिक Claude Opus 4.8 Claude Opus 4.8 none रिलीज़: 2026-05-28 Gemma 4 26B A4B Gemma 4 26B A4B medium रिलीज़: 2026-04-03 निःशुल्क उपलब्ध
स्कोर 7.3 7.8
रैंक #65 #34
विश्वसनीयता 10.0 10.0
संगति 9.2 9.2
सही परीक्षण
प्रति प्रयास पास दर 65.0% 73.3%
अस्थिर टेस्ट 2 2
कुल रन 60 60
प्रति परिणाम लागत 4.324 0.317
कुल लागत $0.519 $0.045
इनपुट कीमत $5.000 / 1M $0.060 / 1M
आउटपुट कीमत $25.000 / 1M $0.330 / 1M
आउटपुट टोकन 8,098 28,000
रीजनिंग टोकन 0 82,045
प्रतिक्रिया समय (औसत) 3.51s 50.92s
प्रतिक्रिया समय (अधिकतम) 17.73s 369.32s
प्रतिक्रिया समय (कुल) 70.19s 967.47s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 6.5 10.0 50.0% 0 3.40s 1,472 0
Gemma 4 26B A4B 10.0 10.0 100.0% 0 6.20s 1,142 3,045
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 6.8 10.0 50.0% 0 3.59s 1,323 0
Gemma 4 26B A4B 2.9 10.0 0.0% 0 258.40s 14,838 26,122
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 9.5 10.0 100.0% 0 17.73s 3,259 0
Gemma 4 26B A4B 9.6 10.0 100.0% 0 73.55s 5,415 13,112
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 7.3 5.8 83.3% 1 1.77s 308 0
Gemma 4 26B A4B 10.0 10.0 100.0% 0 16.51s 1,567 2,827
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 5.3 7.2 44.4% 1 1.66s 61 0
Gemma 4 26B A4B 2.9 4.4 22.2% 2 23.62s 2,469 7,105
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 10.0 10.0 100.0% 0 3.48s 230 0
Gemma 4 26B A4B 10.0 10.0 100.0% 0 29.76s 25 5,075
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 9.9 10.0 100.0% 0 1.37s 95 0
Gemma 4 26B A4B 10.0 10.0 100.0% 0 17.54s 887 4,470
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 7.7 10.0 66.7% 0 2.74s 783 0
Gemma 4 26B A4B 10.0 10.0 100.0% 0 5.79s 410 2,128
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 10.0 10.0 100.0% 0 5.35s 355 0
Gemma 4 26B A4B 10.0 10.0 100.0% 0 9.01s 450 1,256
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 3.0 10.0 0.0% 0 3.41s 212 0
Gemma 4 26B A4B 3.0 10.0 0.0% 0 180.87s 797 16,905

त्वरित तुलना

तुलना जोड़ी बदलें