नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Granite 4.1 8B vs Qwen3.5-9B (medium)

Granite 4.1 8B average score में आगे है: 4.0 vs 3.8. Granite 4.1 8B की benchmark लागत कम है: $0.007 vs $0.036. Granite 4.1 8B तेज है: 1.45s vs 82.24s, pass rates 9.1% vs 25.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#224
कुल आउटपुट टोकन
5,996
प्रतिक्रिया समय (औसत)
1.45s
कुल लागत
$0.007
रैंक
#227
कुल आउटपुट टोकन
238,561
प्रतिक्रिया समय (औसत)
82.24s
कुल लागत
$0.036
अनुशंसित मॉडल Granite 4.1 8B

It has the best score here (4.0), while costing about 5.7x less than Qwen3.5-9B (medium).

विस्तृत तुलना

मेट्रिक Granite 4.1 8B Granite 4.1 8B none रिलीज़: 2026-05-01 Qwen3.5-9B Qwen3.5-9B medium रिलीज़: 2026-03-02
स्कोर 4.0 3.8
रैंक #224 #227
विश्वसनीयता 10.0 5.0
संगति 10.0 8.1
सही परीक्षण
प्रति प्रयास पास दर 9.1% 25.8%
अस्थिर टेस्ट 0 5
कुल रन 66 66
प्रति परिणाम लागत 0.315 1.187
कुल लागत $0.007 $0.036
इनपुट कीमत $0.050 / 1M $0.100 / 1M
आउटपुट कीमत $0.100 / 1M $0.150 / 1M
कुल इनपुट टोकन 113,827 17,070
आउटपुट टोकन 5,996 29,045
रीजनिंग टोकन 0 209,516
प्रतिक्रिया समय (औसत) 1.45s 82.24s
प्रतिक्रिया समय (अधिकतम) 16.67s 226.38s
प्रतिक्रिया समय (कुल) 31.96s 1315.88s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#224 IBM: Granite 4.1 8B

none
लागत
$0.001
समय
3.2s
टोकन
491 tok

#227 Qwen3.5-9B

medium
लागत
$0.001
समय
35.9s
टोकन
3,030 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.1 8B 4.5 10.0 0.0% 0 775ms 8,344 525 0
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129

त्वरित तुलना

तुलना जोड़ी बदलें