नेविगेशन
AI BENCHY
Advertise here

Seed-2.0-Lite (medium) vs GPT-5.4 (medium)

GPT-5.4 (medium) average score में आगे है: 8.5 vs 7.9. Seed-2.0-Lite (medium) की benchmark लागत कम है: $0.234 vs $1.533. GPT-5.4 (medium) तेज है: 23.10s vs 48.53s, pass rates 74.2% vs 77.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#42
कुल आउटपुट टोकन
100,580
प्रतिक्रिया समय (औसत)
48.53s
कुल लागत
$0.234
रैंक
#24
कुल आउटपुट टोकन
88,670
प्रतिक्रिया समय (औसत)
23.10s
कुल लागत
$1.533
अनुशंसित मॉडल Seed-2.0-Lite (medium)

Its score stays close to the best score here (7.9 vs 8.5), while costing about 6.6x less than GPT-5.4 (medium).

विस्तृत तुलना

मेट्रिक Seed-2.0-Lite Seed-2.0-Lite medium रिलीज़: 2026-02-14 GPT-5.4 GPT-5.4 medium रिलीज़: 2026-03-05
स्कोर 7.9 8.5
रैंक #42 #24
विश्वसनीयता 10.0 10.0
संगति 8.6 8.6
सही परीक्षण
प्रति प्रयास पास दर 74.2% 77.3%
अस्थिर टेस्ट 4 4
कुल रन 66 66
प्रति परिणाम लागत 1.669 10.220
कुल लागत $0.234 $1.533
इनपुट कीमत $0.250 / 1M $2.500 / 1M
आउटपुट कीमत $2.000 / 1M $15.000 / 1M
कुल इनपुट टोकन 129,897 81,127
आउटपुट टोकन 12,533 6,155
रीजनिंग टोकन 88,047 82,515
प्रतिक्रिया समय (औसत) 48.53s 23.10s
प्रतिक्रिया समय (अधिकतम) 254.92s 100.41s
प्रतिक्रिया समय (कुल) 1067.74s 508.26s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#42 Seed-2.0-Lite

medium
लागत
$0.005
समय
86.7s
टोकन
2,354 tok

#24 GPT-5.4

medium
लागत
$0.214
समय
199.6s
टोकन
14,349 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 8.0 9.8 66.7% 0 156.74s 8,247 458 31,890
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216

त्वरित तुलना

तुलना जोड़ी बदलें