नेविगेशन
AI BENCHY
Advertise here

Seed 2.1 Turbo (low) vs GPT-5.6 Sol (medium)

GPT-5.6 Sol (medium) average score में आगे है: 9.4 vs 9.1. GPT-5.6 Sol (medium) की benchmark लागत कम है: $1.316 vs $1.631. GPT-5.6 Sol (medium) तेज है: 11.35s vs 168.41s, pass rates 83.3% vs 90.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#15
कुल आउटपुट टोकन
631,257
प्रतिक्रिया समय (औसत)
168.41s
कुल लागत
$1.631
रैंक
#6
कुल आउटपुट टोकन
30,698
प्रतिक्रिया समय (औसत)
11.35s
कुल लागत
$1.316
अनुशंसित मॉडल GPT-5.6 Sol (medium)

It has the best score here (9.4), while responding about 14.8x faster than Seed 2.1 Turbo (low).

विस्तृत तुलना

मेट्रिक Seed 2.1 Turbo Seed 2.1 Turbo low रिलीज़: 2026-08-12 GPT-5.6 Sol GPT-5.6 Sol medium रिलीज़: 2026-07-09
स्कोर 9.1 9.4
रैंक #15 #6
विश्वसनीयता 9.9 10.0
संगति 8.9 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 83.3% 90.9%
अस्थिर टेस्ट 3 3
कुल रन 66 66
प्रति परिणाम लागत 9.591 7.311
कुल लागत $1.631 $1.316
इनपुट कीमत $0.500 / 1M $5.000 / 1M
आउटपुट कीमत $2.500 / 1M $30.000 / 1M
कुल इनपुट टोकन 104,483 78,997
आउटपुट टोकन 6,848 4,696
रीजनिंग टोकन 624,409 26,002
प्रतिक्रिया समय (औसत) 168.41s 11.35s
प्रतिक्रिया समय (अधिकतम) 739.98s 79.40s
प्रतिक्रिया समय (कुल) 3705.09s 249.73s
पैरामीटर ~200B कुल (~20B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#15 Seed 2.1 Turbo

low
लागत
$0.049
समय
298.8s
टोकन
19,730 tok

#6 GPT-5.6 Sol

medium
लागत
$0.124
समय
57.2s
टोकन
4,199 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed 2.1 Turbo 10.0 10.0 100.0% 0 360.85s 8,220 385 207,368
GPT-5.6 Sol 10.0 10.0 100.0% 0 9.40s 7,302 394 4,706

त्वरित तुलना

तुलना जोड़ी बदलें