नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

ByteDance Seed: Seed-2.0-Lite vs Google: Gemini 3.1 Pro Preview

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-03-12

मेट्रिक Seed-2.0-Lite Seed-2.0-Lite medium रिलीज़: 2026-02-14 Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium रिलीज़: 2026-02-19
रैंक #3 #2
औसत स्कोर 8.5 9.4
संगति 8.7 10.0
प्रति परिणाम लागत 0.870 3.417
कुल लागत $0.105 $0.513
सही परीक्षण
प्रति प्रयास पास दर 87.5% 93.8%
अस्थिर टेस्ट 3 0
कुल रन 48 48
आउटपुट टोकन 2,815 1,521
रीजनिंग टोकन 44,618 35,656
प्रतिक्रिया समय (औसत) 29.39s 16.60s
प्रतिक्रिया समय (अधिकतम) 168.71s 40.61s
प्रतिक्रिया समय (कुल) 470.29s 149.36s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

औसत स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

औसत स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 100.0% 0 23.34s 990 7,037
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 9.52s 106 2,533
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 100.0% 0 37.67s 506 4,299
Gemini 3.1 Pro Preview 9.0 10.0 100.0% 0 40.61s 432 9,281
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 9.9 10.0 100.0% 0 9.07s 246 1,742
Gemini 3.1 Pro Preview 9.9 10.0 100.0% 0 7.72s 279 3,904
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 4.0 7.2 55.6% 1 88.74s 15 23,897
Gemini 3.1 Pro Preview 7.0 10.0 66.7% 0 32.73s 18 12,424
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 7.0 3.6 66.7% 1 18.25s 304 1,620
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 11.77s 108 1,179
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 100.0% 0 7.26s 71 1,480
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 9.56s 72 2,236
Puzzle Solving स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 9.3 7.9 88.9% 1 11.03s 461 3,532
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.15s 232 3,117
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 100.0% 0 12.38s 222 1,011
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 23.15s 274 982

त्वरित तुलना

तुलना जोड़ी बदलें