नेविगेशन
AI BENCHY
Advertise here

Seed-2.0-Mini (medium) vs GPT-5.6 Sol

GPT-5.6 Sol average score में आगे है: 7.0 vs 7.0. Seed-2.0-Mini (medium) की benchmark लागत कम है: $0.116 vs $0.201. GPT-5.6 Sol तेज है: 2.17s vs 93.10s, pass rates 57.6% vs 63.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-29

रैंक
#124
कुल आउटपुट टोकन
258,322
प्रतिक्रिया समय (औसत)
93.10s
कुल लागत
$0.116
रैंक
#118
कुल आउटपुट टोकन
4,357
प्रतिक्रिया समय (औसत)
2.17s
कुल लागत
$0.201
अनुशंसित मॉडल GPT-5.6 Sol

It has the best score here (7.0), while responding about 43.0x faster than Seed-2.0-Mini (medium).

विस्तृत तुलना

मेट्रिक Seed-2.0-Mini Seed-2.0-Mini medium रिलीज़: 2026-02-14 GPT-5.6 Sol GPT-5.6 Sol none रिलीज़: 2026-07-09
स्कोर 7.0 7.0
रैंक #124 #118
विश्वसनीयता 8.7 10.0
संगति 8.9 9.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 57.6% 63.6%
अस्थिर टेस्ट 3 3
कुल रन 66 66
प्रति परिणाम लागत 1.054 4.365
कुल लागत $0.116 $0.201
इनपुट कीमत $0.100 / 1M $2.000 / 1M
आउटपुट कीमत $0.400 / 1M $10.000 / 1M
कुल इनपुट टोकन 125,704 78,602
आउटपुट टोकन 10,781 4,357
रीजनिंग टोकन 247,541 0
प्रतिक्रिया समय (औसत) 93.10s 2.17s
प्रतिक्रिया समय (अधिकतम) 301.78s 12.81s
प्रतिक्रिया समय (कुल) 1768.91s 47.66s
पैरामीटर ~50B कुल (~5B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#124 Seed-2.0-Mini

medium
लागत
$0.002
समय
161.7s
टोकन
4,379 tok

#118 GPT-5.6 Sol

none
लागत
$0.116
समय
78.7s
टोकन
3,944 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Mini 5.5 9.8 33.3% 0 220.48s 3,823 464 34,964
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0

त्वरित तुलना

तुलना जोड़ी बदलें