Navigare
Advertise here

Kev 4B (default) vs GPT-6 Luna Decisions (default)

Scorul mediu este practic egal la 2.4 vs 2.4. Kev 4B (default) are costul de benchmark mai mic, $0.002 vs $0.005. GPT-6 Luna Decisions (default) este mai rapid cu 495ms vs 5.63s, cu rate de reușită de 15.9% vs 13.0%.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-10-07

Modele comparate

Rang
#391
Total tokenuri de ieșire
28,061
Timp de răspuns (mediu)
5.63s
Cost total
$0.002
Rang
#390
Total tokenuri de ieșire
0
Timp de răspuns (mediu)
495ms
Cost total
$0.005
Model recomandat GPT-6 Luna Decisions (default)

Are cel mai bun scor aici (2.4) și răspunde de aproximativ 11.4x mai rapid decât Kev 4B (default).

Comparație detaliată

Metrică Kev 4B Kev 4B default Lansare: 2026-09-28 GPT-6 Luna Decisions GPT-6 Luna Decisions default Lansare: 2026-10-07
Scor 2.4 2.4
Rang #391 #390
Fiabilitate 10.0 10.0
Consistență 4.9 5.2
Încercări 36/69 36/69
Teste corecte
Rată de trecere pe încercare 15.9% 13.0%
Teste instabile 1 0
Rulări totale 36 36
Cost per rezultat 0.060 0.159
Cost total $0.002 $0.005
Preț de intrare $0.042 / 1M $0.100 / 1M
Preț de ieșire $0.000 / 1M $0.000 / 1M
Preț citire cache N/D $0.000 / 1M
Preț scriere cache N/D $0.000 / 1M
Total tokenuri de intrare 42,804 47,583
Tokenuri de ieșire 28,061 0
Tokenuri de raționament 0 0
Timp de răspuns (mediu) 5.63s 495ms
Timp de răspuns (maxim) 17.79s 842ms
Timp de răspuns (total) 67.61s 5.94s
Parametri 4B ~400B în total (~17B activi)
Disponibilitate Sursă deschisă Închis

Prețurile de cache se aplică tokenurilor de intrare. Citirea reutilizează prompturi salvate; scrierea le stochează și poate costa în plus. Tokenurile de ieșire folosesc prețul de ieșire.

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Kev 4B 4.5 6.7 33.3% 0 771ms 21,603 12,207 0
GPT-6 Luna Decisions 2.5 6.7 0.0% 0 447ms 22,197 0 0

Comparație rapidă

Schimbă perechea de comparație

Command A+lowvsGPT-6 Luna DecisionsdefaultCommand A+lowvsKev 4BdefaultCommand A+nonevsGPT-6 Luna DecisionsdefaultCommand A+nonevsKev 4BdefaultGemini 3 Flash PreviewhighvsKev 4BdefaultGemini 3 Flash PreviewhighvsGPT-6 Luna DecisionsdefaultCommand A+highvsGPT-6 Luna DecisionsdefaultCommand A+highvsKev 4BdefaultCommand A+mediumvsGPT-6 Luna DecisionsdefaultGPT-6 Luna DecisionsdefaultvsGrok 4.20noneCommand A+mediumvsKev 4BdefaultKev 4BdefaultvsGrok 4.20none