नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

ByteDance Seed: Seed-2.0-Lite vs Google: Gemini 2.5 Flash

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-03-12

मेट्रिक Seed-2.0-Lite Seed-2.0-Lite none रिलीज़: 2026-02-14 Gemini 2.5 Flash Gemini 2.5 Flash none रिलीज़: 2025-06-17
रैंक #45 #42
औसत स्कोर 4.9 5.2
संगति 7.4 9.1
प्रति परिणाम लागत 0.214 0.191
कुल लागत $0.015 $0.012
सही परीक्षण
प्रति प्रयास पास दर 56.3% 43.8%
अस्थिर टेस्ट 5 2
कुल रन 48 48
आउटपुट टोकन 2,743 1,270
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 2.49s 923ms
प्रतिक्रिया समय (अधिकतम) 6.70s 4.39s
प्रतिक्रिया समय (कुल) 39.91s 14.78s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

औसत स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

औसत स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 4.6 22.2% 2 2.93s 703 0
Gemini 2.5 Flash 10.0 10.0 0.0% 0 668ms 99 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 0.0% 0 6.59s 498 0
Gemini 2.5 Flash 10.0 10.0 0.0% 0 4.39s 366 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 9.9 10.0 100.0% 0 1.82s 246 0
Gemini 2.5 Flash 9.9 10.0 100.0% 0 652ms 279 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 7.2 22.2% 1 1.33s 17 0
Gemini 2.5 Flash 4.0 7.2 55.6% 1 495ms 12 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 100.0% 0 3.45s 294 0
Gemini 2.5 Flash 5.0 10.0 0.0% 0 615ms 78 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 100.0% 0 1.06s 73 0
Gemini 2.5 Flash 9.0 6.8 66.7% 1 672ms 70 0
Puzzle Solving स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 4.0 4.4 55.6% 2 2.46s 620 0
Gemini 2.5 Flash 4.7 10.0 33.3% 0 576ms 132 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 100.0% 0 3.94s 292 0
Gemini 2.5 Flash 10.0 10.0 100.0% 0 1.91s 234 0

त्वरित तुलना

तुलना जोड़ी बदलें