नेव्हिगेशन
Advertise here

Seed-2.0-Code (medium) vs GPT-5.6 Luna (medium)

average score जवळपास समान आहे: 7.4 vs 7.4. GPT-5.6 Luna (medium) चा benchmark खर्च कमी आहे: $0.065 vs $1.275. GPT-5.6 Luna (medium) वेगवान आहे: 9.64s vs 100.65s, pass rates 65.2% vs 62.3%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-07

तुलना केलेली मॉडेल्स

क्रमांक
#135
एकूण आउटपुट टोकन्स
384,093
प्रतिसाद वेळ (सरासरी)
100.65s
एकूण खर्च
$1.275
क्रमांक
#132
एकूण आउटपुट टोकन्स
47,986
प्रतिसाद वेळ (सरासरी)
9.64s
एकूण खर्च
$0.065
शिफारस केलेले मॉडेल GPT-5.6 Luna (medium)

It has the best score here (7.4), while costing about 19.8x less than Seed-2.0-Code (medium).

तपशीलवार तुलना

मेट्रिक Seed-2.0-Code Seed-2.0-Code medium प्रकाशन: 2026-08-12 GPT-5.6 Luna GPT-5.6 Luna medium प्रकाशन: 2026-07-09
स्कोअर 7.4 7.4
क्रमांक #135 #132
विश्वसनीयता 8.0 10.0
सुसंगतता 7.4 9.0
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 62.3%
अस्थिर चाचण्या 7 3
एकूण रन 69 69
प्रति निकाल खर्च 11.587 2.822
एकूण खर्च $1.275 $0.065
इनपुट किंमत $0.500 / 1M $0.200 / 1M
आउटपुट किंमत $3.000 / 1M $1.200 / 1M
कॅश वाचण्याची किंमत लागू नाही $0.020 / 1M
कॅश लिहिण्याची किंमत लागू नाही $0.250 / 1M
एकूण इनपुट टोकन्स 244,499 212,780
आउटपुट टोकन्स 8,744 6,849
रिझनिंग टोकन्स 375,349 41,137
प्रतिसाद वेळ (सरासरी) 100.65s 9.64s
प्रतिसाद वेळ (कमाल) 626.58s 58.09s
प्रतिसाद वेळ (एकूण) 2314.88s 221.62s
पॅरामीटर्स ~200B एकूण (~20B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#135 Seed-2.0-Code

medium
खर्च
$0.026
वेळ
122.8s
टोकन्स
8,630 tok

#132 GPT-5.6 Luna

medium
खर्च
$0.014
वेळ
14.6s
टोकन्स
2,362 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Seed-2.0-Code 8.9 7.8 88.9% 1 89.94s 8,247 496 44,062
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928

तुलना जोडी बदला