Navigare
AI BENCHY
Advertise here

GPT-5.6 Luna (medium) vs Qwen3.7 Max

Scorul mediu este practic egal la 7.4 vs 7.4. GPT-5.6 Luna (medium) are costul de benchmark mai mic, $0.072 vs $0.197. Qwen3.7 Max este mai rapid cu 4.56s vs 7.43s, cu rate de reușită de 62.1% vs 68.2%.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-08-29

Rang
#94
Total tokenuri de ieșire
44,525
Timp de răspuns (mediu)
7.43s
Cost total
$0.072
Rang
#92
Total tokenuri de ieșire
12,446
Timp de răspuns (mediu)
4.56s
Cost total
$0.197
Model recomandat GPT-5.6 Luna (medium)

Are cel mai bun scor aici (7.4) și costă de aproximativ 2.8x mai puțin decât Qwen3.7 Max.

Comparație detaliată

Metrică GPT-5.6 Luna GPT-5.6 Luna medium Lansare: 2026-07-09 Qwen3.7 Max Qwen3.7 Max none Lansare: 2026-05-22
Scor 7.4 7.4
Rang #94 #92
Fiabilitate 10.0 9.9
Consistență 9.2 10.0
Încercări 66/66 66/66
Teste corecte
Rată de trecere pe încercare 62.1% 68.2%
Teste instabile 2 0
Rulări totale 66 66
Cost per rezultat 2.601 1.581
Cost total $0.072 $0.197
Preț de intrare $0.200 / 1M $1.475 / 1M
Preț de ieșire $1.200 / 1M $4.425 / 1M
Total tokenuri de intrare 89,685 95,992
Tokenuri de ieșire 5,701 12,446
Tokenuri de raționament 38,824 0
Timp de răspuns (mediu) 7.43s 4.56s
Timp de răspuns (maxim) 29.85s 72.30s
Timp de răspuns (total) 163.54s 100.30s
Parametri ~400B în total (~17B activi) ~1T în total (~40B activi)
Disponibilitate Închis Închis

Prezentare generare modele

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#94 GPT-5.6 Luna

medium
Cost
$0.014
Timp
14.6s
Tokenuri
2,362 tok

#92 Qwen3.7 Max

none
Cost
$0.046
Timp
195.0s
Tokenuri
12,171 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

Comparație rapidă

Schimbă perechea de comparație