नेविगेशन
Advertise here

Seed-2.0-Code (medium) vs Grok 4.7 (low)

average score लगभग बराबर है: 7.4 vs 7.4. Seed-2.0-Code (medium) की benchmark लागत कम है: $1.275 vs $2.263. Grok 4.7 (low) तेज है: 63.19s vs 100.65s, pass rates 65.2% vs 73.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#125
कुल आउटपुट टोकन
384,093
प्रतिक्रिया समय (औसत)
100.65s
कुल लागत
$1.275
रैंक
#127
कुल आउटपुट टोकन
255,329
प्रतिक्रिया समय (औसत)
63.19s
कुल लागत
$2.263
अनुशंसित मॉडल Grok 4.7 (low)

It has the best score here (7.4), while responding about 1.6x faster than Seed-2.0-Code (medium).

विस्तृत तुलना

मेट्रिक Seed-2.0-Code Seed-2.0-Code medium रिलीज़: 2026-08-12 Grok 4.7 Grok 4.7 low रिलीज़: 2026-09-21
स्कोर 7.4 7.4
रैंक #125 #127
विश्वसनीयता 8.0 10.0
संगति 7.4 8.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 65.2% 73.9%
अस्थिर टेस्ट 7 5
कुल रन 69 69
प्रति परिणाम लागत 11.587 13.804
कुल लागत $1.275 $2.263
इनपुट कीमत $0.500 / 1M $2.000 / 1M
आउटपुट कीमत $3.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 244,499 365,119
आउटपुट टोकन 8,744 8,118
रीजनिंग टोकन 375,349 247,211
प्रतिक्रिया समय (औसत) 100.65s 63.19s
प्रतिक्रिया समय (अधिकतम) 626.58s 389.63s
प्रतिक्रिया समय (कुल) 2314.88s 1453.28s
पैरामीटर ~200B कुल (~20B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#125 Seed-2.0-Code

medium
लागत
$0.026
समय
122.8s
टोकन
8,630 tok

#127 SpaceXAI: Grok 4.7

low
लागत
$0.007
समय
15.2s
टोकन
1,537 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Code 8.9 7.8 88.9% 1 89.94s 8,247 496 44,062
Grok 4.7 8.4 7.4 88.9% 1 189.08s 9,579 346 99,053

त्वरित तुलना

तुलना जोड़ी बदलें