नेविगेशन
AI BENCHY
Advertise here

Seed-2.0-Lite vs GPT-5.6 Luna (low)

average score लगभग बराबर है: 6.2 vs 6.2. GPT-5.6 Luna (low) की benchmark लागत कम है: $0.051 vs $0.066. Seed-2.0-Lite तेज है: 4.37s vs 5.20s, pass rates 40.9% vs 54.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#165
कुल आउटपुट टोकन
14,744
प्रतिक्रिया समय (औसत)
4.37s
कुल लागत
$0.066
रैंक
#167
कुल आउटपुट टोकन
26,286
प्रतिक्रिया समय (औसत)
5.20s
कुल लागत
$0.051
अनुशंसित मॉडल Seed-2.0-Lite

It has the strongest score in this comparison (6.2) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Seed-2.0-Lite Seed-2.0-Lite none रिलीज़: 2026-02-14 GPT-5.6 Luna GPT-5.6 Luna low रिलीज़: 2026-07-09
स्कोर 6.2 6.2
रैंक #165 #167
विश्वसनीयता 10.0 10.0
संगति 8.9 8.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 40.9% 54.5%
अस्थिर टेस्ट 3 5
कुल रन 66 66
प्रति परिणाम लागत 0.813 2.437
कुल लागत $0.066 $0.051
इनपुट कीमत $0.250 / 1M $0.200 / 1M
आउटपुट कीमत $2.000 / 1M $1.200 / 1M
कुल इनपुट टोकन 142,206 96,355
आउटपुट टोकन 14,744 8,213
रीजनिंग टोकन 0 18,073
प्रतिक्रिया समय (औसत) 4.37s 5.20s
प्रतिक्रिया समय (अधिकतम) 44.58s 19.44s
प्रतिक्रिया समय (कुल) 96.20s 114.46s
पैरामीटर ~200B कुल (~20B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#165 Seed-2.0-Lite

none
लागत
$0.005
समय
83.8s
टोकन
2,311 tok

#167 GPT-5.6 Luna

low
लागत
$0.011
समय
10.2s
टोकन
1,897 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 5.6 10.0 33.3% 0 2.83s 8,215 410 0
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535

त्वरित तुलना

तुलना जोड़ी बदलें