नेव्हिगेशन
Advertise here

Seed-2.0-Code (low) vs GPT-6 Luna (medium)

GPT-6 Luna (medium) average score मध्ये पुढे आहे: 8.3 vs 8.1. GPT-6 Luna (medium) चा benchmark खर्च कमी आहे: $0.047 vs $0.881. GPT-6 Luna (medium) वेगवान आहे: 18.07s vs 73.02s, pass rates 78.3% vs 73.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-02

तुलना केलेली मॉडेल्स

क्रमांक
#86
एकूण आउटपुट टोकन्स
253,807
प्रतिसाद वेळ (सरासरी)
73.02s
एकूण खर्च
$0.881
क्रमांक
#79
एकूण आउटपुट टोकन्स
53,161
प्रतिसाद वेळ (सरासरी)
18.07s
एकूण खर्च
$0.047
शिफारस केलेले मॉडेल GPT-6 Luna (medium)

It has the best score here (8.3), while costing about 18.8x less than Seed-2.0-Code (low).

तपशीलवार तुलना

मेट्रिक Seed-2.0-Code Seed-2.0-Code low प्रकाशन: 2026-08-12 GPT-6 Luna GPT-6 Luna medium प्रकाशन: 2026-09-23
स्कोअर 8.1 8.3
क्रमांक #86 #79
विश्वसनीयता 8.9 10.0
सुसंगतता 7.9 8.9
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 78.3% 73.9%
अस्थिर चाचण्या 6 3
एकूण रन 69 69
प्रति निकाल खर्च 6.288 0.313
एकूण खर्च $0.881 $0.047
इनपुट किंमत $0.500 / 1M $0.100 / 1M
आउटपुट किंमत $3.000 / 1M $0.500 / 1M
कॅश वाचण्याची किंमत लागू नाही $0.010 / 1M
कॅश लिहिण्याची किंमत लागू नाही $0.125 / 1M
एकूण इनपुट टोकन्स 237,604 203,193
आउटपुट टोकन्स 9,617 5,751
रिझनिंग टोकन्स 244,190 47,410
प्रतिसाद वेळ (सरासरी) 73.02s 18.07s
प्रतिसाद वेळ (कमाल) 485.92s 66.44s
प्रतिसाद वेळ (एकूण) 1679.49s 415.53s
पॅरामीटर्स ~200B एकूण (~20B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#86 Seed-2.0-Code

low
Provider returned error
खर्च
$0.000
वेळ
0.3s
टोकन्स
0 tok

#79 GPT-6 Luna

medium
खर्च
$0.002
वेळ
23.6s
टोकन्स
2,966 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Seed-2.0-Code 7.0 7.1 55.6% 1 109.70s 7,948 455 55,759
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222

झटपट तुलना

तुलना जोडी बदला