नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

ByteDance Seed: Seed-2.0-Lite vs OpenAI: GPT-5 Mini

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-03-12

मेट्रिक Seed-2.0-Lite Seed-2.0-Lite none रिलीज़: 2026-02-14 GPT-5 Mini GPT-5 Mini medium रिलीज़: 2025-08-07
रैंक #45 #34
औसत स्कोर 4.9 6.0
संगति 7.4 8.9
प्रति परिणाम लागत 0.214 1.457
कुल लागत $0.015 $0.117
सही परीक्षण
प्रति प्रयास पास दर 56.3% 58.3%
अस्थिर टेस्ट 5 2
कुल रन 48 48
आउटपुट टोकन 2,743 5,826
रीजनिंग टोकन 0 48,768
प्रतिक्रिया समय (औसत) 2.49s 25.14s
प्रतिक्रिया समय (अधिकतम) 6.70s 88.15s
प्रतिक्रिया समय (कुल) 39.91s 402.29s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

औसत स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

औसत स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 4.6 22.2% 2 2.93s 703 0
GPT-5 Mini 7.0 9.6 66.7% 0 16.45s 1,645 5,824
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 0.0% 0 6.59s 498 0
GPT-5 Mini 10.0 10.0 100.0% 0 88.15s 754 11,520
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 9.9 10.0 100.0% 0 1.82s 246 0
GPT-5 Mini 9.9 10.0 100.0% 0 12.58s 453 3,200
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 7.2 22.2% 1 1.33s 17 0
GPT-5 Mini 10.0 7.2 22.2% 1 44.63s 293 14,016
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 100.0% 0 3.45s 294 0
GPT-5 Mini 4.0 10.0 0.0% 0 13.50s 349 1,856
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 100.0% 0 1.06s 73 0
GPT-5 Mini 7.5 6.6 83.3% 1 15.66s 318 4,992
Puzzle Solving स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 4.0 4.4 55.6% 2 2.46s 620 0
GPT-5 Mini 4.3 9.8 33.3% 0 14.09s 1,527 5,760
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 10.0 10.0 100.0% 0 3.94s 292 0
GPT-5 Mini 10.0 10.0 100.0% 0 18.64s 487 1,600

त्वरित तुलना

तुलना जोड़ी बदलें