Navigare
Advertise here

GPT-6 Luna (low) vs Qwen3.5 Plus 2026-04-20 (medium)

Qwen3.5 Plus 2026-04-20 (medium) conduce la scorul mediu cu 7.7 vs 7.6. GPT-6 Luna (low) are costul de benchmark mai mic, $0.033 vs $0.488. GPT-6 Luna (low) este mai rapid cu 23.23s vs 54.06s, cu rate de reușită de 63.8% vs 65.2%.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-10-01

Modele comparate

Rang
#116
Total tokenuri de ieșire
24,880
Timp de răspuns (mediu)
23.23s
Cost total
$0.033
Rang
#113
Total tokenuri de ieșire
200,348
Timp de răspuns (mediu)
54.06s
Cost total
$0.488
Model recomandat GPT-6 Luna (low)

Scorul rămâne aproape de cel mai bun scor de aici (7.6 vs 7.7) și costă de aproximativ 15.2x mai puțin decât Qwen3.5 Plus 2026-04-20 (medium).

Comparație detaliată

Metrică GPT-6 Luna GPT-6 Luna low Lansare: 2026-09-23 Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium Lansare: 2026-04-20
Scor 7.6 7.7
Rang #116 #113
Fiabilitate 9.7 9.7
Consistență 8.5 9.1
Încercări 69/69 69/69
Teste corecte
Rată de trecere pe încercare 63.8% 65.2%
Teste instabile 4 2
Rulări totale 69 69
Cost per rezultat 0.267 3.481
Cost total $0.033 $0.488
Preț de intrare $0.100 / 1M $0.300 / 1M
Preț de ieșire $0.500 / 1M $1.800 / 1M
Total tokenuri de intrare 195,928 176,539
Tokenuri de ieșire 5,728 4,419
Tokenuri de raționament 19,152 195,929
Timp de răspuns (mediu) 23.23s 54.06s
Timp de răspuns (maxim) 89.37s 203.01s
Timp de răspuns (total) 534.22s 1189.36s
Parametri ~400B în total (~17B activi) ~397B în total (~17B activi)
Disponibilitate Închis Închis

Prezentare generare modele

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#116 GPT-6 Luna

low
Cost
$0.002
Timp
19.2s
Tokenuri
2,598 tok

#113 Qwen3.5 Plus 2026-04-20

medium
Cost
$0.008
Timp
76.7s
Tokenuri
4,355 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
GPT-6 Luna 6.0 7.2 55.6% 1 15.39s 7,302 493 6,655
Qwen3.5 Plus 2026-04-20 6.2 8.7 33.3% 0 125.25s 7,630 308 58,682

Comparație rapidă

Schimbă perechea de comparație