नेविगेशन
AI BENCHY
Advertise here

Seed-2.0-Code (high) vs GPT-5.5

average score लगभग बराबर है: 6.9 vs 6.9. GPT-5.5 की benchmark लागत कम है: $0.544 vs $1.312. GPT-5.5 तेज है: 2.36s vs 127.79s, pass rates 71.2% vs 56.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#123
कुल आउटपुट टोकन
423,424
प्रतिक्रिया समय (औसत)
127.79s
कुल लागत
$1.312
रैंक
#126
कुल आउटपुट टोकन
4,915
प्रतिक्रिया समय (औसत)
2.36s
कुल लागत
$0.544
अनुशंसित मॉडल GPT-5.5

It has the best score here (6.9), while costing about 2.4x less than Seed-2.0-Code (high).

विस्तृत तुलना

मेट्रिक Seed-2.0-Code Seed-2.0-Code high रिलीज़: 2026-08-12 GPT-5.5 GPT-5.5 none रिलीज़: 2026-04-24
स्कोर 6.9 6.9
रैंक #123 #126
विश्वसनीयता 6.0 10.0
संगति 7.0 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 71.2% 56.1%
अस्थिर टेस्ट 8 3
कुल रन 66 66
प्रति परिणाम लागत 11.921 4.945
कुल लागत $1.312 $0.544
इनपुट कीमत $0.500 / 1M $5.000 / 1M
आउटपुट कीमत $3.000 / 1M $30.000 / 1M
कुल इनपुट टोकन 81,961 79,285
आउटपुट टोकन 7,187 4,915
रीजनिंग टोकन 416,237 0
प्रतिक्रिया समय (औसत) 127.79s 2.36s
प्रतिक्रिया समय (अधिकतम) 675.30s 12.24s
प्रतिक्रिया समय (कुल) 2811.27s 51.88s
पैरामीटर ~200B कुल (~20B सक्रिय) ~1.5T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#123 Seed-2.0-Code

high
लागत
$0.037
समय
183.6s
टोकन
12,388 tok

#126 GPT-5.5

none
लागत
$0.090
समय
54.3s
टोकन
3,063 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Code 5.9 4.4 66.7% 2 266.74s 6,750 432 124,956
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0

त्वरित तुलना

तुलना जोड़ी बदलें