नेविगेशन
Advertise here

Seed 2.1 Turbo (medium) vs GPT-5.2 (medium)

average score लगभग बराबर है: 8.4 vs 8.4. GPT-5.2 (medium) की benchmark लागत कम है: $1.182 vs $1.951. GPT-5.2 (medium) तेज है: 28.51s vs 193.59s, pass rates 78.8% vs 72.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-24

तुलना किए गए मॉडल

रैंक
#67
कुल आउटपुट टोकन
759,191
प्रतिक्रिया समय (औसत)
193.59s
कुल लागत
$1.951
रैंक
#64
कुल आउटपुट टोकन
71,252
प्रतिक्रिया समय (औसत)
28.51s
कुल लागत
$1.182
अनुशंसित मॉडल GPT-5.2 (medium)

It has the best score here (8.4), while costing about 1.7x less than Seed 2.1 Turbo (medium).

विस्तृत तुलना

मेट्रिक Seed 2.1 Turbo Seed 2.1 Turbo medium रिलीज़: 2026-08-12 GPT-5.2 GPT-5.2 medium रिलीज़: 2025-12-11
स्कोर 8.4 8.4
रैंक #67 #64
विश्वसनीयता 10.0 10.0
संगति 8.2 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 78.8% 72.7%
अस्थिर टेस्ट 5 4
कुल रन 66 66
प्रति परिणाम लागत 13.002 8.438
कुल लागत $1.951 $1.182
इनपुट कीमत $0.500 / 1M $1.750 / 1M
आउटपुट कीमत $2.500 / 1M $14.000 / 1M
कुल इनपुट टोकन 104,433 105,013
आउटपुट टोकन 6,511 9,914
रीजनिंग टोकन 752,680 61,338
प्रतिक्रिया समय (औसत) 193.59s 28.51s
प्रतिक्रिया समय (अधिकतम) 885.33s 116.86s
प्रतिक्रिया समय (कुल) 4258.98s 456.13s
पैरामीटर ~200B कुल (~20B सक्रिय) ~1.2T कुल (~80B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#67 Seed 2.1 Turbo

medium
लागत
$0.099
समय
583.9s
टोकन
39,514 tok

#64 GPT-5.2

medium
लागत
$0.047
समय
49.2s
टोकन
3,396 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed 2.1 Turbo 8.2 7.2 88.9% 1 354.87s 8,220 384 205,892
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912

त्वरित तुलना

तुलना जोड़ी बदलें