नेविगेशन
Advertise here

Seed-2.0-Lite (medium) vs GPT-5.2 Chat

GPT-5.2 Chat average score में आगे है: 7.9 vs 7.8. Seed-2.0-Lite (medium) की benchmark लागत कम है: $0.236 vs $0.594. GPT-5.2 Chat तेज है: 7.73s vs 47.94s, pass rates 69.7% vs 69.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-08

तुलना किए गए मॉडल

रैंक
#85
कुल आउटपुट टोकन
101,296
प्रतिक्रिया समय (औसत)
47.94s
कुल लागत
$0.236
रैंक
#75
कुल आउटपुट टोकन
29,742
प्रतिक्रिया समय (औसत)
7.73s
कुल लागत
$0.594
अनुशंसित मॉडल GPT-5.2 Chat

It has the best score here (7.9), while responding about 6.2x faster than Seed-2.0-Lite (medium).

विस्तृत तुलना

मेट्रिक Seed-2.0-Lite Seed-2.0-Lite medium रिलीज़: 2026-02-14 GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11
स्कोर 7.8 7.9
रैंक #85 #75
विश्वसनीयता 10.0 10.0
संगति 8.6 8.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 69.7% 69.7%
अस्थिर टेस्ट 4 4
कुल रन 66 66
प्रति परिणाम लागत 1.809 4.564
कुल लागत $0.236 $0.594
इनपुट कीमत $0.250 / 1M $1.750 / 1M
आउटपुट कीमत $2.000 / 1M $14.000 / 1M
कुल इनपुट टोकन 129,906 101,104
आउटपुट टोकन 12,530 29,742
रीजनिंग टोकन 88,766 0
प्रतिक्रिया समय (औसत) 47.94s 7.73s
प्रतिक्रिया समय (अधिकतम) 254.92s 38.52s
प्रतिक्रिया समय (कुल) 1054.57s 162.40s
पैरामीटर ~200B कुल (~20B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#85 Seed-2.0-Lite

medium
लागत
$0.005
समय
86.7s
टोकन
2,354 tok

#75 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 8.0 9.8 66.7% 0 156.74s 8,247 458 31,890
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0

त्वरित तुलना

तुलना जोड़ी बदलें