Navigare
Advertise here

Granite 4.2 8B (high) vs Laguna S 2.1 (low)

Granite 4.2 8B (high) conduce la scorul mediu cu 4.7 vs 4.6. Laguna S 2.1 (low) are costul de benchmark mai mic, $0.109 vs $0.161. Laguna S 2.1 (low) este mai rapid cu 88.24s vs 235.35s, cu rate de reușită de 37.7% vs 23.2%.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-10-01

Modele comparate

Rang
#318
Total tokenuri de ieșire
661,367
Timp de răspuns (mediu)
235.35s
Cost total
$0.161
Rang
#324
Total tokenuri de ieșire
495,517
Timp de răspuns (mediu)
88.24s
Cost total
$0.109
Model recomandat Laguna S 2.1 (low)

Scorul rămâne aproape de cel mai bun scor de aici (4.6 vs 4.7) și răspunde de aproximativ 2.7x mai rapid decât Granite 4.2 8B (high).

Comparație detaliată

Metrică Granite 4.2 8B Granite 4.2 8B high Lansare: 2026-09-02 Laguna S 2.1 Laguna S 2.1 low Lansare: 2026-07-21 Disponibil gratuit
Scor 4.7 4.6
Rang #318 #324
Fiabilitate 8.2 10.0
Consistență 6.4 7.8
Încercări 69/69 69/69
Teste corecte
Rată de trecere pe încercare 37.7% 23.2%
Teste instabile 10 6
Rulări totale 69 69
Cost per rezultat 2.751 3.627
Cost total $0.161 $0.109
Preț de intrare $0.060 / 1M $0.090 / 1M
Preț de ieșire $0.250 / 1M $0.180 / 1M
Total tokenuri de intrare 282,658 232,641
Tokenuri de ieșire 198,563 69,335
Tokenuri de raționament 462,804 426,182
Timp de răspuns (mediu) 235.35s 88.24s
Timp de răspuns (maxim) 685.87s 814.73s
Timp de răspuns (total) 5413.09s 2029.57s
Parametri 8B 118B în total (8B activi)
Disponibilitate Sursă deschisă Ponderi disponibile

Prezentare generare modele

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#318 IBM: Granite 4.2 8B

high
Provider returned error
Cost
$0.000
Timp
0.2s
Tokenuri
0 tok

#324 Laguna S 2.1

low
Cost
$0.001
Timp
6.6s
Tokenuri
1,314 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Granite 4.2 8B 3.8 4.3 33.3% 2 515.34s 7,047 42,438 154,749
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138

Comparație rapidă

Schimbă perechea de comparație