नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

ByteDance Seed: Seed-2.0-Lite vs Google: Gemma 4 31B

सारांश

Seed-2.0-Lite vs Gemma 4 31B benchmark तुलना: Gemma 4 31B average score में आगे है: 6.3 vs 6.2. Seed-2.0-Lite की benchmark लागत कम है: $0.019 vs $0.033. Seed-2.0-Lite तेज है: 2.49s vs 56.55s, pass rates 46.0% vs 69.8%.

अनुशंसित मॉडल: Seed-2.0-Lite - Its score stays close to the best score here (6.2 vs 6.3), while costing about 1.8x less than Gemma 4 31B.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-12

मेट्रिक Seed-2.0-Lite Seed-2.0-Lite none रिलीज़: 2026-02-14 Gemma 4 31B Gemma 4 31B medium रिलीज़: 2026-04-02 निःशुल्क उपलब्ध
स्कोर 6.2 6.3
रैंक #93 #87
विश्वसनीयता 10.0 10.0
संगति 8.4 9.4
सही परीक्षण
प्रति प्रयास पास दर 46.0% 69.8%
अस्थिर टेस्ट 4 1
कुल रन 63 63
प्रति परिणाम लागत 0.228 0.257
कुल लागत $0.019 $0.033
इनपुट कीमत $0.250 / 1M $0.120 / 1M
आउटपुट कीमत $2.000 / 1M $0.350 / 1M
कुल इनपुट टोकन 46,573 17,957
आउटपुट टोकन 3,259 22,356
रीजनिंग टोकन 0 65,726
प्रतिक्रिया समय (औसत) 2.49s 56.55s
प्रतिक्रिया समय (अधिकतम) 6.70s 437.40s
प्रतिक्रिया समय (कुल) 52.26s 1074.41s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#93 Seed-2.0-Lite

none
Cost
$0.005
Time
83.8s
Tokens
2,311 tok

#87 Gemma 4 31B

medium
Cost
$0.002
Time
45.7s
Tokens
2,696 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 3.0 5.9 16.7% 2 2.43s 894 709 0
Gemma 4 31B 10.0 10.0 100.0% 0 12.89s 816 962 2,046
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 5.6 10.0 33.3% 0 2.83s 8,215 410 0
Gemma 4 31B 4.3 5.8 22.2% 1 219.76s 5,568 11,098 33,212
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 3.0 10.0 0.0% 0 6.59s 16,215 498 0
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 100.0% 0 1.82s 8,538 246 0
Gemma 4 31B 10.0 10.0 100.0% 0 21.11s 8,334 1,822 2,951
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 3.6 7.2 22.2% 1 1.33s 939 17 0
Gemma 4 31B 7.7 10.0 66.7% 0 38.48s 876 4,349 8,985
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 100.0% 0 3.45s 570 294 0
Gemma 4 31B 10.0 10.0 100.0% 0 9.57s 567 105 888
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 100.0% 0 1.06s 810 73 0
Gemma 4 31B 10.0 10.0 100.0% 0 12.76s 777 533 2,035
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 5.3 7.2 44.4% 1 2.78s 858 709 0
Gemma 4 31B 9.9 10.0 100.0% 0 26.91s 801 1,795 5,595
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 100.0% 0 3.94s 9,270 292 0
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 3.0 10.0 0.0% 0 1.96s 264 11 0
Gemma 4 31B 3.0 10.0 0.0% 0 90.14s 218 1,692 10,014

त्वरित तुलना

तुलना जोड़ी बदलें