नेविगेशन
Advertise here

Seed 2.1 Turbo (low) vs GPT-5.6 Sol (medium)

GPT-5.6 Sol (medium) average score में आगे है: 9.4 vs 9.1. GPT-5.6 Sol (medium) की benchmark लागत कम है: $0.508 vs $1.546. GPT-5.6 Sol (medium) तेज है: 12.63s vs 163.90s, pass rates 80.3% vs 90.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-24

तुलना किए गए मॉडल

रैंक
#28
कुल आउटपुट टोकन
597,236
प्रतिक्रिया समय (औसत)
163.90s
कुल लागत
$1.546
रैंक
#15
कुल आउटपुट टोकन
34,977
प्रतिक्रिया समय (औसत)
12.63s
कुल लागत
$0.508
अनुशंसित मॉडल GPT-5.6 Sol (medium)

It has the best score here (9.4), while costing about 3.0x less than Seed 2.1 Turbo (low).

विस्तृत तुलना

मेट्रिक Seed 2.1 Turbo Seed 2.1 Turbo low रिलीज़: 2026-08-12 GPT-5.6 Sol GPT-5.6 Sol medium रिलीज़: 2026-07-09
स्कोर 9.1 9.4
रैंक #28 #15
विश्वसनीयता 10.0 10.0
संगति 9.2 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 80.3% 90.9%
अस्थिर टेस्ट 2 3
कुल रन 66 66
प्रति परिणाम लागत 9.091 8.025
कुल लागत $1.546 $0.508
इनपुट कीमत $0.500 / 1M $2.000 / 1M
आउटपुट कीमत $2.500 / 1M $10.000 / 1M
कुल इनपुट टोकन 104,464 79,006
आउटपुट टोकन 6,844 4,696
रीजनिंग टोकन 590,392 30,281
प्रतिक्रिया समय (औसत) 163.90s 12.63s
प्रतिक्रिया समय (अधिकतम) 739.98s 79.40s
प्रतिक्रिया समय (कुल) 3605.87s 277.88s
पैरामीटर ~200B कुल (~20B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#28 Seed 2.1 Turbo

low
लागत
$0.049
समय
298.8s
टोकन
19,730 tok

#15 GPT-5.6 Sol

medium
लागत
$0.124
समय
57.2s
टोकन
4,199 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed 2.1 Turbo 10.0 10.0 100.0% 0 360.85s 8,220 385 207,368
GPT-5.6 Sol 10.0 10.0 100.0% 0 9.40s 7,302 394 4,706

त्वरित तुलना

तुलना जोड़ी बदलें