नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Granite 4.1 8B vs Grok 4.20

Grok 4.20 average score मध्ये पुढे आहे: 4.1 vs 4.0. Granite 4.1 8B चा benchmark खर्च कमी आहे: $0.007 vs $0.057. Grok 4.20 वेगवान आहे: 1.11s vs 1.45s, pass rates 9.1% vs 27.3%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#224
एकूण आउटपुट टोकन्स
5,996
प्रतिसाद वेळ (सरासरी)
1.45s
एकूण खर्च
$0.007
क्रमांक
#220
एकूण आउटपुट टोकन्स
1,923
प्रतिसाद वेळ (सरासरी)
1.11s
एकूण खर्च
$0.057
शिफारस केलेले मॉडेल Grok 4.20

It has the strongest score in this comparison (4.1) and the best overall balance of cost and response time across all 2 models.

तपशीलवार तुलना

मेट्रिक Granite 4.1 8B Granite 4.1 8B none प्रकाशन: 2026-05-01 Grok 4.20 Grok 4.20 none प्रकाशन: 2026-03-31
स्कोअर 4.0 4.1
क्रमांक #224 #220
विश्वसनीयता 10.0 लागू नाही
सुसंगतता 10.0 8.1
बरोबर चाचण्या
प्रति प्रयत्न पास दर 9.1% 27.3%
अस्थिर चाचण्या 0 0
एकूण रन 66 54
प्रति निकाल खर्च 0.315 1.570
एकूण खर्च $0.007 $0.057
इनपुट किंमत $0.050 / 1M $1.250 / 1M
आउटपुट किंमत $0.100 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 113,827 41,313
आउटपुट टोकन्स 5,996 1,923
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 1.45s 1.11s
प्रतिसाद वेळ (कमाल) 16.67s 6.04s
प्रतिसाद वेळ (एकूण) 31.96s 19.96s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#224 IBM: Granite 4.1 8B

none
खर्च
$0.001
वेळ
3.2s
टोकन्स
491 tok

#220 xAI: Grok 4.20

none
खर्च
$0.004
वेळ
6.5s
टोकन्स
1,367 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Granite 4.1 8B 4.5 10.0 0.0% 0 775ms 8,344 525 0
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0

झटपट तुलना

तुलना जोडी बदला