नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Seed-2.0-Code (medium) vs GPT-5.6 Sol

average score लगभग बराबर है: 6.9 vs 6.9. GPT-5.6 Sol की benchmark लागत कम है: $0.524 vs $1.049. GPT-5.6 Sol तेज है: 2.16s vs 93.60s, pass rates 71.2% vs 59.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#124
कुल आउटपुट टोकन
336,696
प्रतिक्रिया समय (औसत)
93.60s
कुल लागत
$1.049
रैंक
#120
कुल आउटपुट टोकन
4,357
प्रतिक्रिया समय (औसत)
2.16s
कुल लागत
$0.524
अनुशंसित मॉडल GPT-5.6 Sol

It has the best score here (6.9), while costing about 2.0x less than Seed-2.0-Code (medium).

विस्तृत तुलना

मेट्रिक Seed-2.0-Code Seed-2.0-Code medium रिलीज़: 2026-08-12 GPT-5.6 Sol GPT-5.6 Sol none रिलीज़: 2026-07-09
स्कोर 6.9 6.9
रैंक #124 #120
विश्वसनीयता 4.7 10.0
संगति 6.7 9.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 71.2% 59.1%
अस्थिर टेस्ट 9 3
कुल रन 66 66
प्रति परिणाम लागत 10.482 4.761
कुल लागत $1.049 $0.524
इनपुट कीमत $0.500 / 1M $5.000 / 1M
आउटपुट कीमत $3.000 / 1M $30.000 / 1M
कुल इनपुट टोकन 76,027 78,593
आउटपुट टोकन 7,268 4,357
रीजनिंग टोकन 329,428 0
प्रतिक्रिया समय (औसत) 93.60s 2.16s
प्रतिक्रिया समय (अधिकतम) 626.58s 12.81s
प्रतिक्रिया समय (कुल) 2059.27s 47.62s
पैरामीटर ~200B कुल (~20B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#124 Seed-2.0-Code

medium
लागत
$0.026
समय
122.8s
टोकन
8,630 tok

#120 GPT-5.6 Sol

none
लागत
$0.116
समय
78.7s
टोकन
3,944 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Code 8.9 7.8 88.9% 1 89.94s 8,247 496 44,062
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0

त्वरित तुलना

तुलना जोड़ी बदलें