नेव्हिगेशन
AI BENCHY
Advertise here

Seed-2.0-Code (high) vs GPT-5.6 Sol

average score जवळपास समान आहे: 6.9 vs 6.9. GPT-5.6 Sol चा benchmark खर्च कमी आहे: $0.524 vs $1.312. GPT-5.6 Sol वेगवान आहे: 2.16s vs 127.79s, pass rates 71.2% vs 59.1%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-12

क्रमांक
#123
एकूण आउटपुट टोकन्स
423,424
प्रतिसाद वेळ (सरासरी)
127.79s
एकूण खर्च
$1.312
क्रमांक
#120
एकूण आउटपुट टोकन्स
4,357
प्रतिसाद वेळ (सरासरी)
2.16s
एकूण खर्च
$0.524
शिफारस केलेले मॉडेल GPT-5.6 Sol

It has the best score here (6.9), while costing about 2.5x less than Seed-2.0-Code (high).

तपशीलवार तुलना

मेट्रिक Seed-2.0-Code Seed-2.0-Code high प्रकाशन: 2026-08-12 GPT-5.6 Sol GPT-5.6 Sol none प्रकाशन: 2026-07-09
स्कोअर 6.9 6.9
क्रमांक #123 #120
विश्वसनीयता 6.0 10.0
सुसंगतता 7.0 9.0
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 71.2% 59.1%
अस्थिर चाचण्या 8 3
एकूण रन 66 66
प्रति निकाल खर्च 11.921 4.761
एकूण खर्च $1.312 $0.524
इनपुट किंमत $0.500 / 1M $5.000 / 1M
आउटपुट किंमत $3.000 / 1M $30.000 / 1M
एकूण इनपुट टोकन्स 81,961 78,593
आउटपुट टोकन्स 7,187 4,357
रिझनिंग टोकन्स 416,237 0
प्रतिसाद वेळ (सरासरी) 127.79s 2.16s
प्रतिसाद वेळ (कमाल) 675.30s 12.81s
प्रतिसाद वेळ (एकूण) 2811.27s 47.62s
पॅरामीटर्स ~200B एकूण (~20B सक्रिय) ~2T एकूण (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#123 Seed-2.0-Code

high
खर्च
$0.037
वेळ
183.6s
टोकन्स
12,388 tok

#120 GPT-5.6 Sol

none
खर्च
$0.116
वेळ
78.7s
टोकन्स
3,944 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Seed-2.0-Code 5.9 4.4 66.7% 2 266.74s 6,750 432 124,956
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0

झटपट तुलना

तुलना जोडी बदला