नेविगेशन
AI BENCHY
Advertise here

Granite 4.2 8B (high) vs Laguna S 2.1

Granite 4.2 8B (high) average score में आगे है: 4.6 vs 4.5. Laguna S 2.1 की benchmark लागत कम है: $0.022 vs $0.084. Laguna S 2.1 तेज है: 11.67s vs 235.89s, pass rates 39.4% vs 15.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#276
कुल आउटपुट टोकन
612,215
प्रतिक्रिया समय (औसत)
235.89s
कुल लागत
$0.084
रैंक
#279
कुल आउटपुट टोकन
57,634
प्रतिक्रिया समय (औसत)
11.67s
कुल लागत
$0.022
अनुशंसित मॉडल Laguna S 2.1

Its score stays close to the best score here (4.5 vs 4.6), while costing about 3.8x less than Granite 4.2 8B (high).

विस्तृत तुलना

मेट्रिक Granite 4.2 8B Granite 4.2 8B high रिलीज़: 2026-09-02 Laguna S 2.1 Laguna S 2.1 none रिलीज़: 2026-07-21 निःशुल्क उपलब्ध
स्कोर 4.6 4.5
रैंक #276 #279
विश्वसनीयता 7.6 10.0
संगति 6.3 8.8
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 39.4% 15.2%
अस्थिर टेस्ट 10 3
कुल रन 66 66
प्रति परिणाम लागत 2.085 1.205
कुल लागत $0.084 $0.022
इनपुट कीमत $0.100 / 1M $0.090 / 1M
आउटपुट कीमत $0.150 / 1M $0.180 / 1M
कुल इनपुट टोकन 43,278 125,604
आउटपुट टोकन 181,083 57,634
रीजनिंग टोकन 431,132 0
प्रतिक्रिया समय (औसत) 235.89s 11.67s
प्रतिक्रिया समय (अधिकतम) 685.87s 200.52s
प्रतिक्रिया समय (कुल) 5189.64s 256.71s
पैरामीटर 8B 118B कुल (8B सक्रिय)
उपलब्धता मुक्त स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#276 IBM: Granite 4.2 8B

high
Provider returned error
लागत
$0.000
समय
0.2s
टोकन
0 tok

#279 Laguna S 2.1

none
लागत
$0.001
समय
7.6s
टोकन
1,345 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.2 8B 3.8 4.3 33.3% 2 515.34s 7,047 42,438 154,749
Laguna S 2.1 3.4 9.7 0.0% 0 550ms 7,917 424 0

त्वरित तुलना

तुलना जोड़ी बदलें