नेव्हिगेशन
AI BENCHY
Advertise here

Seed-2.0-Code (high) vs GPT-5.5

average score जवळपास समान आहे: 6.9 vs 6.9. GPT-5.5 चा benchmark खर्च कमी आहे: $0.544 vs $1.312. GPT-5.5 वेगवान आहे: 2.36s vs 127.79s, pass rates 71.2% vs 56.1%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-12

क्रमांक
#123
एकूण आउटपुट टोकन्स
423,424
प्रतिसाद वेळ (सरासरी)
127.79s
एकूण खर्च
$1.312
क्रमांक
#126
एकूण आउटपुट टोकन्स
4,915
प्रतिसाद वेळ (सरासरी)
2.36s
एकूण खर्च
$0.544
शिफारस केलेले मॉडेल GPT-5.5

It has the best score here (6.9), while costing about 2.4x less than Seed-2.0-Code (high).

तपशीलवार तुलना

मेट्रिक Seed-2.0-Code Seed-2.0-Code high प्रकाशन: 2026-08-12 GPT-5.5 GPT-5.5 none प्रकाशन: 2026-04-24
स्कोअर 6.9 6.9
क्रमांक #123 #126
विश्वसनीयता 6.0 10.0
सुसंगतता 7.0 8.9
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 71.2% 56.1%
अस्थिर चाचण्या 8 3
एकूण रन 66 66
प्रति निकाल खर्च 11.921 4.945
एकूण खर्च $1.312 $0.544
इनपुट किंमत $0.500 / 1M $5.000 / 1M
आउटपुट किंमत $3.000 / 1M $30.000 / 1M
एकूण इनपुट टोकन्स 81,961 79,285
आउटपुट टोकन्स 7,187 4,915
रिझनिंग टोकन्स 416,237 0
प्रतिसाद वेळ (सरासरी) 127.79s 2.36s
प्रतिसाद वेळ (कमाल) 675.30s 12.24s
प्रतिसाद वेळ (एकूण) 2811.27s 51.88s
पॅरामीटर्स ~200B एकूण (~20B सक्रिय) ~1.5T एकूण (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#123 Seed-2.0-Code

high
खर्च
$0.037
वेळ
183.6s
टोकन्स
12,388 tok

#126 GPT-5.5

none
खर्च
$0.090
वेळ
54.3s
टोकन्स
3,063 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Seed-2.0-Code 5.9 4.4 66.7% 2 266.74s 6,750 432 124,956
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0

झटपट तुलना

तुलना जोडी बदला