नेविगेशन
AI BENCHY
Advertise here

Seed 2.1 Turbo (low) vs GPT-5.5 (medium)

Seed 2.1 Turbo (low) average score में आगे है: 9.1 vs 9.0. Seed 2.1 Turbo (low) की benchmark लागत कम है: $1.631 vs $4.137. GPT-5.5 (medium) तेज है: 38.42s vs 168.41s, pass rates 83.3% vs 87.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#15
कुल आउटपुट टोकन
631,257
प्रतिक्रिया समय (औसत)
168.41s
कुल लागत
$1.631
रैंक
#17
कुल आउटपुट टोकन
124,436
प्रतिक्रिया समय (औसत)
38.42s
कुल लागत
$4.137
अनुशंसित मॉडल Seed 2.1 Turbo (low)

It has the best score here (9.1), while costing about 2.5x less than GPT-5.5 (medium).

विस्तृत तुलना

मेट्रिक Seed 2.1 Turbo Seed 2.1 Turbo low रिलीज़: 2026-08-12 GPT-5.5 GPT-5.5 medium रिलीज़: 2026-04-24
स्कोर 9.1 9.0
रैंक #15 #17
विश्वसनीयता 9.9 10.0
संगति 8.9 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 83.3% 87.9%
अस्थिर टेस्ट 3 3
कुल रन 66 66
प्रति परिणाम लागत 9.591 22.980
कुल लागत $1.631 $4.137
इनपुट कीमत $0.500 / 1M $5.000 / 1M
आउटपुट कीमत $2.500 / 1M $30.000 / 1M
कुल इनपुट टोकन 104,483 80,659
आउटपुट टोकन 6,848 5,617
रीजनिंग टोकन 624,409 118,819
प्रतिक्रिया समय (औसत) 168.41s 38.42s
प्रतिक्रिया समय (अधिकतम) 739.98s 332.10s
प्रतिक्रिया समय (कुल) 3705.09s 845.35s
पैरामीटर ~200B कुल (~20B सक्रिय) ~1.5T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#15 Seed 2.1 Turbo

low
लागत
$0.049
समय
298.8s
टोकन
19,730 tok

#17 GPT-5.5

medium
लागत
$0.112
समय
71.9s
टोकन
3,807 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed 2.1 Turbo 10.0 10.0 100.0% 0 360.85s 8,220 385 207,368
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959

त्वरित तुलना

तुलना जोड़ी बदलें