नेविगेशन
Advertise here

Seed 2.1 Turbo (high) vs GPT-5.3-Codex (medium)

average score लगभग बराबर है: 8.9 vs 8.9. GPT-5.3-Codex (medium) की benchmark लागत कम है: $0.988 vs $1.797. GPT-5.3-Codex (medium) तेज है: 16.91s vs 173.96s, pass rates 78.8% vs 83.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-24

तुलना किए गए मॉडल

रैंक
#40
कुल आउटपुट टोकन
697,731
प्रतिक्रिया समय (औसत)
173.96s
कुल लागत
$1.797
रैंक
#37
कुल आउटपुट टोकन
60,374
प्रतिक्रिया समय (औसत)
16.91s
कुल लागत
$0.988
अनुशंसित मॉडल GPT-5.3-Codex (medium)

It has the best score here (8.9), while costing about 1.8x less than Seed 2.1 Turbo (high).

विस्तृत तुलना

मेट्रिक Seed 2.1 Turbo Seed 2.1 Turbo high रिलीज़: 2026-08-12 GPT-5.3-Codex GPT-5.3-Codex medium रिलीज़: 2026-02-05
स्कोर 8.9 8.9
रैंक #40 #37
विश्वसनीयता 10.0 10.0
संगति 8.9 8.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 78.8% 83.3%
अस्थिर टेस्ट 3 4
कुल रन 66 66
प्रति परिणाम लागत 11.230 6.171
कुल लागत $1.797 $0.988
इनपुट कीमत $0.500 / 1M $1.750 / 1M
आउटपुट कीमत $2.500 / 1M $14.000 / 1M
कुल इनपुट टोकन 104,695 81,187
आउटपुट टोकन 6,645 6,258
रीजनिंग टोकन 691,086 54,116
प्रतिक्रिया समय (औसत) 173.96s 16.91s
प्रतिक्रिया समय (अधिकतम) 584.71s 100.93s
प्रतिक्रिया समय (कुल) 3827.19s 372.03s
पैरामीटर ~200B कुल (~20B सक्रिय) ~1.2T कुल (~80B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#40 Seed 2.1 Turbo

high
लागत
$0.058
समय
355.4s
टोकन
23,053 tok

#37 GPT-5.3-Codex

medium
लागत
$0.049
समय
54.9s
टोकन
3,580 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed 2.1 Turbo 10.0 10.0 100.0% 0 336.02s 8,220 370 194,578
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890

त्वरित तुलना

तुलना जोड़ी बदलें