नेविगेशन
Advertise here

Seed-2.0-Lite (medium) vs Grok 4.5 (high)

Grok 4.5 (high) average score में आगे है: 8.2 vs 8.2. Seed-2.0-Lite (medium) की benchmark लागत कम है: $0.271 vs $2.571. Seed-2.0-Lite (medium) तेज है: 48.87s vs 72.50s, pass rates 71.0% vs 82.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#85
कुल आउटपुट टोकन
106,419
प्रतिक्रिया समय (औसत)
48.87s
कुल लागत
$0.271
रैंक
#82
कुल आउटपुट टोकन
333,632
प्रतिक्रिया समय (औसत)
72.50s
कुल लागत
$2.571
अनुशंसित मॉडल Seed-2.0-Lite (medium)

Its score stays close to the best score here (8.2 vs 8.2), while costing about 9.5x less than Grok 4.5 (high).

विस्तृत तुलना

मेट्रिक Seed-2.0-Lite Seed-2.0-Lite medium रिलीज़: 2026-02-14 Grok 4.5 Grok 4.5 high रिलीज़: 2026-07-08
स्कोर 8.2 8.2
रैंक #85 #82
विश्वसनीयता 10.0 10.0
संगति 8.7 8.9
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 71.0% 82.6%
अस्थिर टेस्ट 4 3
कुल रन 69 69
प्रति परिणाम लागत 1.931 15.123
कुल लागत $0.271 $2.571
इनपुट कीमत $0.250 / 1M $2.000 / 1M
आउटपुट कीमत $2.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 229,530 342,124
आउटपुट टोकन 13,757 7,135
रीजनिंग टोकन 92,662 326,497
प्रतिक्रिया समय (औसत) 48.87s 72.50s
प्रतिक्रिया समय (अधिकतम) 254.92s 676.83s
प्रतिक्रिया समय (कुल) 1123.91s 1667.51s
पैरामीटर ~200B कुल (~20B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#85 Seed-2.0-Lite

medium
लागत
$0.005
समय
86.7s
टोकन
2,354 tok

#82 SpaceXAI: Grok 4.5

high
लागत
$0.015
समय
29.7s
टोकन
2,737 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Lite 8.0 9.8 66.7% 0 156.74s 8,247 458 31,890
Grok 4.5 10.0 10.0 100.0% 0 155.16s 9,579 357 100,752

त्वरित तुलना

तुलना जोड़ी बदलें