नेविगेशन
AI BENCHY
Advertise here

Seed-2.0-Code vs Granite 4.2 8B (medium)

Seed-2.0-Code average score में आगे है: 5.3 vs 5.2. Granite 4.2 8B (medium) की benchmark लागत कम है: $0.009 vs $0.151. Seed-2.0-Code तेज है: 14.67s vs 45.97s, pass rates 36.4% vs 34.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#237
कुल आउटपुट टोकन
23,433
प्रतिक्रिया समय (औसत)
14.67s
कुल लागत
$0.151
रैंक
#243
कुल आउटपुट टोकन
19,330
प्रतिक्रिया समय (औसत)
45.97s
कुल लागत
$0.009
अनुशंसित मॉडल Granite 4.2 8B (medium)

Its score stays close to the best score here (5.2 vs 5.3), while costing about 18.4x less than Seed-2.0-Code.

विस्तृत तुलना

मेट्रिक Seed-2.0-Code Seed-2.0-Code none रिलीज़: 2026-08-12 Granite 4.2 8B Granite 4.2 8B medium रिलीज़: 2026-09-02
स्कोर 5.3 5.2
रैंक #237 #243
विश्वसनीयता 8.6 8.7
संगति 8.1 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 36.4% 34.9%
अस्थिर टेस्ट 5 1
कुल रन 66 66
प्रति परिणाम लागत 2.503 0.117
कुल लागत $0.151 $0.009
इनपुट कीमत $0.500 / 1M $0.100 / 1M
आउटपुट कीमत $3.000 / 1M $0.150 / 1M
कुल इनपुट टोकन 159,749 52,909
आउटपुट टोकन 23,433 7,058
रीजनिंग टोकन 0 12,272
प्रतिक्रिया समय (औसत) 14.67s 45.97s
प्रतिक्रिया समय (अधिकतम) 132.84s 557.96s
प्रतिक्रिया समय (कुल) 322.71s 1011.42s
पैरामीटर ~200B कुल (~20B सक्रिय) 8B
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#237 Seed-2.0-Code

none
लागत
$0.030
समय
140.6s
टोकन
9,924 tok

#243 IBM: Granite 4.2 8B

medium
Provider returned error
लागत
$0.000
समय
0.2s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Seed-2.0-Code 3.6 9.8 0.0% 0 13.42s 7,230 505 0
Granite 4.2 8B 5.5 10.0 33.3% 0 12.09s 8,439 2,445 3,900

त्वरित तुलना

तुलना जोड़ी बदलें