Navigare
Advertise here

Gemma 4 26B A4B (medium) vs GPT-5.6 Luna (medium)

GPT-5.6 Luna (medium) conduce la scorul mediu cu 7.4 vs 7.3. GPT-5.6 Luna (medium) are costul de benchmark mai mic, $0.065 vs $0.101. GPT-5.6 Luna (medium) este mai rapid cu 9.64s vs 105.03s, cu rate de reușită de 71.0% vs 62.3%.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-10-02

Modele comparate

Rang
#131
Total tokenuri de ieșire
269,351
Timp de răspuns (mediu)
105.03s
Cost total
$0.101
Rang
#122
Total tokenuri de ieșire
47,986
Timp de răspuns (mediu)
9.64s
Cost total
$0.065
Model recomandat GPT-5.6 Luna (medium)

Are cel mai bun scor aici (7.4) și costă de aproximativ 1.6x mai puțin decât Gemma 4 26B A4B (medium).

Comparație detaliată

Metrică Gemma 4 26B A4B Gemma 4 26B A4B medium Lansare: 2026-04-03 Disponibil gratuit GPT-5.6 Luna GPT-5.6 Luna medium Lansare: 2026-07-09
Scor 7.3 7.4
Rang #131 #122
Fiabilitate 10.0 10.0
Consistență 9.6 9.0
Încercări 69/69 69/69
Teste corecte
Rată de trecere pe încercare 71.0% 62.3%
Teste instabile 1 3
Rulări totale 69 69
Cost per rezultat 0.679 2.822
Cost total $0.101 $0.065
Preț de intrare $0.090 / 1M $0.200 / 1M
Preț de ieșire $0.300 / 1M $1.200 / 1M
Preț citire cache $0.050 / 1M $0.020 / 1M
Preț scriere cache N/D $0.250 / 1M
Total tokenuri de intrare 224,367 212,780
Tokenuri de ieșire 27,095 6,849
Tokenuri de raționament 242,256 41,137
Timp de răspuns (mediu) 105.03s 9.64s
Timp de răspuns (maxim) 912.19s 58.09s
Timp de răspuns (total) 2310.63s 221.62s
Parametri 25.2B în total (3.8B activi) ~400B în total (~17B activi)
Disponibilitate Sursă deschisă Închis

Prețurile de cache se aplică tokenurilor de intrare. Citirea reutilizează prompturi salvate; scrierea le stochează și poate costa în plus. Tokenurile de ieșire folosesc prețul de ieșire.

Prezentare generare modele

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#131 Gemma 4 26B A4B

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
Cost
$0.000
Timp
300.0s
Tokenuri
0 tok

#122 GPT-5.6 Luna

medium
Cost
$0.014
Timp
14.6s
Tokenuri
2,362 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemma 4 26B A4B 2.9 10.0 0.0% 0 272.54s 5,062 14,838 44,567
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928

Comparație rapidă

Schimbă perechea de comparație