नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

ByteDance Seed: Seed-2.0-Lite vs Google: Gemini 2.5 Flash

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-03-15

मेट्रिक Seed-2.0-Lite Seed-2.0-Lite medium रिलीज़: 2026-02-14 Gemini 2.5 Flash Gemini 2.5 Flash medium रिलीज़: 2025-06-17
रैंक #3 #15
स्कोर 8.8 8.0
संगति 8.7 9.5
प्रति परिणाम लागत 0.870 2.619
कुल लागत $0.105 $0.288
सही परीक्षण
प्रति प्रयास पास दर 87.5% 72.9%
अस्थिर टेस्ट 3 1
कुल रन 48 48
आउटपुट टोकन 2,815 1,370
रीजनिंग टोकन 44,618 110,522
प्रतिक्रिया समय (औसत) 29.39s 12.35s
प्रतिक्रिया समय (अधिकतम) 168.71s 95.48s
प्रतिक्रिया समय (कुल) 470.29s 197.62s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 100.0% 0 23.34s 990 7,037
Gemini 2.5 Flash 7.8 10.0 66.7% 0 6.98s 249 8,832
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 100.0% 0 37.67s 506 4,299
Gemini 2.5 Flash 10.0 10.0 100.0% 0 28.44s 303 11,922
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 100.0% 0 9.07s 246 1,742
Gemini 2.5 Flash 10.0 10.0 100.0% 0 4.06s 279 2,325
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 5.9 7.2 55.6% 1 88.74s 15 23,897
Gemini 2.5 Flash 5.9 7.2 55.6% 1 37.34s 18 80,702
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 6.7 3.6 66.7% 1 18.25s 304 1,620
Gemini 2.5 Flash 4.8 10.0 0.0% 0 4.86s 92 1,899
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 100.0% 0 7.26s 71 1,480
Gemini 2.5 Flash 9.8 10.0 100.0% 0 2.62s 69 1,203
Puzzle Solving स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 9.0 7.9 88.9% 1 11.03s 461 3,532
Gemini 2.5 Flash 7.7 10.0 66.7% 0 3.94s 126 2,499
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 100.0% 0 12.38s 222 1,011
Gemini 2.5 Flash 10.0 10.0 100.0% 0 6.20s 234 1,140

त्वरित तुलना

तुलना जोड़ी बदलें