नेविगेशन
AI BENCHY
Advertise here

Seed-2.0-Code (low) vs GPT-5.6 Luna (high)

average score लगभग बराबर है: 7.7 vs 7.7. GPT-5.6 Luna (high) की benchmark लागत कम है: $0.102 vs $0.681. GPT-5.6 Luna (high) तेज है: 18.68s vs 65.89s, pass rates 80.3% vs 72.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#66
कुल आउटपुट टोकन
212,558
प्रतिक्रिया समय (औसत)
65.89s
कुल लागत
$0.681
रैंक
#69
कुल आउटपुट टोकन
155,998
प्रतिक्रिया समय (औसत)
18.68s
कुल लागत
$0.102
अनुशंसित मॉडल GPT-5.6 Luna (high)

It has the best score here (7.7), while costing about 6.7x less than Seed-2.0-Code (low).

विस्तृत तुलना

मेट्रिक Seed-2.0-Code Seed-2.0-Code low रिलीज़: 2026-08-12 GPT-5.6 Luna GPT-5.6 Luna high रिलीज़: 2026-07-09
स्कोर 7.7 7.7
रैंक #66 #69
विश्वसनीयता 5.7 10.0
संगति 7.5 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 80.3% 72.7%
अस्थिर टेस्ट 7 3
कुल रन 66 66
प्रति परिणाम लागत 5.235 6.780
कुल लागत $0.681 $0.102
इनपुट कीमत $0.500 / 1M $0.100 / 1M
आउटपुट कीमत $3.000 / 1M $0.600 / 1M
कुल इनपुट टोकन 85,648 80,918
आउटपुट टोकन 8,142 5,088
रीजनिंग टोकन 204,416 150,910
प्रतिक्रिया समय (औसत) 65.89s 18.68s
प्रतिक्रिया समय (अधिकतम) 485.92s 111.09s
प्रतिक्रिया समय (कुल) 1449.53s 411.05s
पैरामीटर ~200B कुल (~20B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#66 Seed-2.0-Code

low
Provider returned error
लागत
$0.000
समय
0.3s
टोकन
0 tok

#69 GPT-5.6 Luna

high
लागत
$0.033
समय
34.2s
टोकन
5,484 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Code 7.0 5.0 77.8% 2 109.70s 7,948 455 55,759
GPT-5.6 Luna 5.5 4.7 55.6% 2 15.63s 7,302 510 17,746

त्वरित तुलना

तुलना जोड़ी बदलें