नेव्हिगेशन
AI BENCHY
Advertise here

Seed-2.0-Mini (medium) vs GPT-5.5

average score जवळपास समान आहे: 7.0 vs 7.0. Seed-2.0-Mini (medium) चा benchmark खर्च कमी आहे: $0.116 vs $0.544. GPT-5.5 वेगवान आहे: 2.35s vs 93.10s, pass rates 57.6% vs 59.1%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-04

क्रमांक
#138
एकूण आउटपुट टोकन्स
258,322
प्रतिसाद वेळ (सरासरी)
93.10s
एकूण खर्च
$0.116
क्रमांक
#135
एकूण आउटपुट टोकन्स
4,915
प्रतिसाद वेळ (सरासरी)
2.35s
एकूण खर्च
$0.544
शिफारस केलेले मॉडेल GPT-5.5

It has the best score here (7.0), while responding about 39.6x faster than Seed-2.0-Mini (medium).

तपशीलवार तुलना

मेट्रिक Seed-2.0-Mini Seed-2.0-Mini medium प्रकाशन: 2026-02-14 GPT-5.5 GPT-5.5 none प्रकाशन: 2026-04-24
स्कोअर 7.0 7.0
क्रमांक #138 #135
विश्वसनीयता 8.7 10.0
सुसंगतता 8.9 9.2
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 57.6% 59.1%
अस्थिर चाचण्या 3 2
एकूण रन 66 66
प्रति निकाल खर्च 1.054 4.533
एकूण खर्च $0.116 $0.544
इनपुट किंमत $0.100 / 1M $5.000 / 1M
आउटपुट किंमत $0.400 / 1M $30.000 / 1M
एकूण इनपुट टोकन्स 125,704 79,294
आउटपुट टोकन्स 10,781 4,915
रिझनिंग टोकन्स 247,541 0
प्रतिसाद वेळ (सरासरी) 93.10s 2.35s
प्रतिसाद वेळ (कमाल) 301.78s 12.24s
प्रतिसाद वेळ (एकूण) 1768.91s 51.78s
पॅरामीटर्स ~50B एकूण (~5B सक्रिय) ~1.5T एकूण (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#138 Seed-2.0-Mini

medium
खर्च
$0.002
वेळ
161.7s
टोकन्स
4,379 tok

#135 GPT-5.5

none
खर्च
$0.090
वेळ
54.3s
टोकन्स
3,063 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Seed-2.0-Mini 5.5 9.8 33.3% 0 220.48s 3,823 464 34,964
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0

झटपट तुलना

तुलना जोडी बदला