नेव्हिगेशन
AI BENCHY
Advertise here

Seed-2.0-Lite (medium) vs GPT-5.4 (medium)

GPT-5.4 (medium) average score मध्ये पुढे आहे: 8.5 vs 7.9. Seed-2.0-Lite (medium) चा benchmark खर्च कमी आहे: $0.234 vs $1.533. GPT-5.4 (medium) वेगवान आहे: 23.10s vs 48.53s, pass rates 74.2% vs 77.3%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

क्रमांक
#42
एकूण आउटपुट टोकन्स
100,580
प्रतिसाद वेळ (सरासरी)
48.53s
एकूण खर्च
$0.234
क्रमांक
#24
एकूण आउटपुट टोकन्स
88,670
प्रतिसाद वेळ (सरासरी)
23.10s
एकूण खर्च
$1.533
शिफारस केलेले मॉडेल Seed-2.0-Lite (medium)

Its score stays close to the best score here (7.9 vs 8.5), while costing about 6.6x less than GPT-5.4 (medium).

तपशीलवार तुलना

मेट्रिक Seed-2.0-Lite Seed-2.0-Lite medium प्रकाशन: 2026-02-14 GPT-5.4 GPT-5.4 medium प्रकाशन: 2026-03-05
स्कोअर 7.9 8.5
क्रमांक #42 #24
विश्वसनीयता 10.0 10.0
सुसंगतता 8.6 8.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 74.2% 77.3%
अस्थिर चाचण्या 4 4
एकूण रन 66 66
प्रति निकाल खर्च 1.669 10.220
एकूण खर्च $0.234 $1.533
इनपुट किंमत $0.250 / 1M $2.500 / 1M
आउटपुट किंमत $2.000 / 1M $15.000 / 1M
एकूण इनपुट टोकन्स 129,897 81,127
आउटपुट टोकन्स 12,533 6,155
रिझनिंग टोकन्स 88,047 82,515
प्रतिसाद वेळ (सरासरी) 48.53s 23.10s
प्रतिसाद वेळ (कमाल) 254.92s 100.41s
प्रतिसाद वेळ (एकूण) 1067.74s 508.26s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#42 Seed-2.0-Lite

medium
खर्च
$0.005
वेळ
86.7s
टोकन्स
2,354 tok

#24 GPT-5.4

medium
खर्च
$0.214
वेळ
199.6s
टोकन्स
14,349 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Seed-2.0-Lite 8.0 9.8 66.7% 0 156.74s 8,247 458 31,890
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216

झटपट तुलना

तुलना जोडी बदला